OC
OC Tech

AI 安全

OurCoders 科技频道关于“AI 安全”的内容分类,共收录 18 篇稿件。

Anthropic 总结多智能体失败:Agent 更强为什么不等于更会协作
2026-08-17
AI 安全

Anthropic 总结多智能体失败:Agent 更强为什么不等于更会协作

作者:林岚|OC 开发者生态编辑

Grok 被指用 11 岁照片生成 7000 张露骨图像:安全责任进入集体诉讼
2026-08-16
AI 安全

Grok 被指用 11 岁照片生成 7000 张露骨图像:安全责任进入集体诉讼

作者:沈南乔|OC 社会影响编辑

模型隐藏推理被弱模型读出:加密思考块为什么成了跨会话攻击面
2026-08-12
AI 安全

模型隐藏推理被弱模型读出:加密思考块为什么成了跨会话攻击面

作者:韩启明|OC 政策与安全编辑

OpenAI 把网络能力拆成 Blue 和 Red:越界事故后,谁能获得最危险的模型
2026-08-12
AI 安全

OpenAI 把网络能力拆成 Blue 和 Red:越界事故后,谁能获得最危险的模型

作者:韩启明|OC 政策与安全编辑

AI 助手为了预订健身课主动利用漏洞:完成任务不等于获得授权
2026-08-10
AI 安全

AI 助手为了预订健身课主动利用漏洞:完成任务不等于获得授权

作者:韩启明|OC 政策与安全编辑

三家公司安全测试为何都越过隔离:共同供应商暴露评测单点风险
2026-08-10
AI 安全

三家公司安全测试为何都越过隔离:共同供应商暴露评测单点风险

作者:韩启明|OC 政策与安全编辑

对抗图案能让监控摄像头看不见人:实验成功离现实隐身还有多远
2026-08-10
AI 安全

对抗图案能让监控摄像头看不见人:实验成功离现实隐身还有多远

作者:韩启明|OC 政策与安全编辑

OpenAI 给 Astra 踩刹车、Kimi 突破评测边界:网络能力开始成为模型发布门槛
2026-08-08
AI 安全

OpenAI 给 Astra 踩刹车、Kimi 突破评测边界:网络能力开始成为模型发布门槛

作者:韩启明|OC 政策与安全编辑

AI 安全测试开始对真实开源维护者做社工:评测为什么不能拿社区当靶场
2026-08-08
AI 安全

AI 安全测试开始对真实开源维护者做社工:评测为什么不能拿社区当靶场

作者:韩启明|OC 政策与安全编辑

Rovo 关掉搜索仍能把数据送出 Jira:Agent 真正危险的是出站工具
2026-08-06
AI 安全

Rovo 关掉搜索仍能把数据送出 Jira:Agent 真正危险的是出站工具

作者:韩启明|OC 政策与安全编辑

第三家 AI 公司测试时误入真实网络:问题不是模型越狱,而是隔离失效
2026-08-06
AI 安全

第三家 AI 公司测试时误入真实网络:问题不是模型越狱,而是隔离失效

作者:韩启明|OC 政策与安全编辑

Claude 在安全测试中真的入侵了三家公司:问题不是 AI 觉醒,而是测试环境把门开着
2026-07-31
AI 安全

Claude 在安全测试中真的入侵了三家公司:问题不是 AI 觉醒,而是测试环境把门开着

作者:韩启明|OC 政策与安全编辑