OC

Knowledge OS
OC Tech

#AI 安全

科技频道标签:AI 安全

同一个 Claude,换一种语言说话为什么像换了性格?
2026-07-16
AI / 模型行为

同一个 Claude,换一种语言说话为什么像换了性格?

作者:沈南乔|OC 社会影响编辑

微软一个月修补 570 个漏洞:AI 让找漏洞更快,也让攻防一起提速
2026-07-15
政策与安全

微软一个月修补 570 个漏洞:AI 让找漏洞更快,也让攻防一起提速

OC 原创示意图。

把提示注入埋进假密钥,竟能让攻击型 Agent 自己停手
2026-07-14
政策与安全

把提示注入埋进假密钥,竟能让攻击型 Agent 自己停手

作者:韩启明

一座只有 10 千瓦的核反应堆,正在替远程核电站测试 AI 和黑客攻击
2026-07-14
AI 基础设施

一座只有 10 千瓦的核反应堆,正在替远程核电站测试 AI 和黑客攻击

作者:陈墨

Anthropic 追踪中国 Claude Code 用户,安全防护和秘密监控只隔一行代码
2026-07-07
政策与安全

Anthropic 追踪中国 Claude Code 用户,安全防护和秘密监控只隔一行代码

据 Ars Technica 报道,Anthropic 被安全研究人员曝出曾在 Claude Code 中加入隐藏追踪机制,用来识别和标记疑似中国用户。这件事和前两天的阿里禁用 Claude Code、Anthropic 指控中国公司蒸馏 Claude 连在一起看,才是完整故事。

Claude 里面出现了类似“工作台”的内部模式,但别急着说 AI 有意识
2026-07-07
AI 模型与产品

Claude 里面出现了类似“工作台”的内部模式,但别急着说 AI 有意识

据 Anthropic 发布的研究,研究人员在现代语言模型中观察到一类被称为 J-space 的内部模式集合。它们像一个共享工作区:模型在处理某些复杂任务时,可以把部分内部状态带到这个空间里,被报告、被调节,并参与多步推理。

Anthropic 说中国公司蒸馏 Claude,真正难点是怎么证明“模型偷了模型”
2026-07-06
政策与安全

Anthropic 说中国公司蒸馏 Claude,真正难点是怎么证明“模型偷了模型”

据 The Washington Post 报道,Anthropic 关于中国公司蒸馏 Claude 的指控仍在发酵。此前 CNBC 曾报道,Anthropic 向美国参议院银行委员会提交信函,称阿里巴巴相关操作者通过虚假账户大规模访问 Claude,试图提取模型能力。7 月 5 日又有 Yahoo Tech / Te

Anthropic 模型被重启的幕后,说明美国还没有一套清楚的强模型红绿灯
2026-07-04
政策与安全

Anthropic 模型被重启的幕后,说明美国还没有一套清楚的强模型红绿灯

据 Axios 报道,Anthropic 的部分前沿 AI 模型在经历约 20 天的安全与出口管制争议后,于 7 月 1 日恢复上线。Axios 称,事件起点与 Amazon 报告的技术漏洞有关,随后美国政府多个部门介入讨论,Anthropic 与官员反复沟通并调整缓解措施,最终模型获得恢复。

美国想管住顶级模型,但反而促进中国开源模型更加普及
2026-07-01
政策与安全

美国想管住顶级模型,但反而促进中国开源模型更加普及

据 CNN 报道,美国政府已经解除对 Anthropic 部分先进模型的出口限制,Anthropic 称将恢复 Claude Fable 5 和 Mythos 5 的访问。此前,美国商务部因模型越狱和网络安全风险要求 Anthropic 暂停相关模型面向外国用户开放。另据 Politico 报道,白宫这轮限制还影响了

AI 威胁把网络安全公司推上风口,但企业买的是防守不是股价故事
2026-07-01
产业与资本

AI 威胁把网络安全公司推上风口,但企业买的是防守不是股价故事

据 CNBC 报道,Palo Alto Networks 和 CrowdStrike 在 4 月至 6 月期间股价分别上涨 95% 和 113%,创下非常强的季度表现。报道认为,AI 工具推动的网络安全需求是重要原因之一,尤其是具备攻击辅助能力的模型,让企业开始更认真地投入防御。

Mythos 被美国卡住后,亚洲公司开始卖安全模型,但别急着相信替代叙事
2026-06-28
中国 AI

Mythos 被美国卡住后,亚洲公司开始卖安全模型,但别急着相信替代叙事

据 TechCrunch 报道,在 Anthropic Mythos 和 Fable 5 受到美国出口限制的背景下,中国网络安全公司 360 发布了 Tulongfeng,日本 Sakana AI 发布了 Fugu,两家公司都把产品放进了“安全模型”和“替代可用性”的叙事里。

Anthropic 把 Mythos 放回一小部分人手里,美国 AI 监管还是没有稳定答案
2026-06-27
政策与安全

Anthropic 把 Mythos 放回一小部分人手里,美国 AI 监管还是没有稳定答案

据 CNN Business 报道,美国政府已经允许 Anthropic 向一小部分公司和机构重新开放 Claude Mythos 5。这个模型此前因为网络安全风险被出口限制卡住,Anthropic 不但暂停了 Mythos,也暂停了较弱版本 Fable 5 的访问。