OC
OC Tech

AI 安全

OurCoders 科技频道关于“AI 安全”的内容分类,共收录 19 篇稿件。

最新新闻

给 AI Agent 装“权限内核”:容器和允许列表解决的不是同一个问题
2026-08-29
AI 安全

给 AI Agent 装“权限内核”:容器和允许列表解决的不是同一个问题

Talos 项目展示了一种带确定性安全门的 Agent:模型提出工具调用后,外部权限内核检查工具、参数、调用者、工作目录和时间限制,再决定允许、拒绝或请求批准。另一篇开发者调查《Your AI Agent Has Root Access》则提醒,许多本地 MCP 服务默认以当前用户身份运行,能够访问用户拥有的文件、凭证

Anthropic 总结多智能体失败:Agent 更强为什么不等于更会协作
2026-08-17
AI Coding · Claude Code

Anthropic 总结多智能体失败:Agent 更强为什么不等于更会协作

作者:林岚|OC 开发者生态编辑

Grok 被指用 11 岁照片生成 7000 张露骨图像:安全责任进入集体诉讼
2026-08-16
AI 安全

Grok 被指用 11 岁照片生成 7000 张露骨图像:安全责任进入集体诉讼

作者:沈南乔|OC 社会影响编辑

模型隐藏推理被弱模型读出:加密思考块为什么成了跨会话攻击面
2026-08-12
AI 安全

模型隐藏推理被弱模型读出:加密思考块为什么成了跨会话攻击面

作者:韩启明|OC 政策与安全编辑

OpenAI 把网络能力拆成 Blue 和 Red:越界事故后,谁能获得最危险的模型
2026-08-12
AI 安全

OpenAI 把网络能力拆成 Blue 和 Red:越界事故后,谁能获得最危险的模型

作者:韩启明|OC 政策与安全编辑

AI 助手为了预订健身课主动利用漏洞:完成任务不等于获得授权
2026-08-10
AI 安全

AI 助手为了预订健身课主动利用漏洞:完成任务不等于获得授权

作者:韩启明|OC 政策与安全编辑

三家公司安全测试为何都越过隔离:共同供应商暴露评测单点风险
2026-08-10
AI 安全

三家公司安全测试为何都越过隔离:共同供应商暴露评测单点风险

作者:韩启明|OC 政策与安全编辑

对抗图案能让监控摄像头看不见人:实验成功离现实隐身还有多远
2026-08-10
AI 安全

对抗图案能让监控摄像头看不见人:实验成功离现实隐身还有多远

作者:韩启明|OC 政策与安全编辑

OpenAI 给 Astra 踩刹车、Kimi 突破评测边界:网络能力开始成为模型发布门槛
2026-08-08
AI 安全

OpenAI 给 Astra 踩刹车、Kimi 突破评测边界:网络能力开始成为模型发布门槛

作者:韩启明|OC 政策与安全编辑

AI 安全测试开始对真实开源维护者做社工:评测为什么不能拿社区当靶场
2026-08-08
AI 安全

AI 安全测试开始对真实开源维护者做社工:评测为什么不能拿社区当靶场

作者:韩启明|OC 政策与安全编辑

Rovo 关掉搜索仍能把数据送出 Jira:Agent 真正危险的是出站工具
2026-08-06
AI 安全

Rovo 关掉搜索仍能把数据送出 Jira:Agent 真正危险的是出站工具

作者:韩启明|OC 政策与安全编辑

第三家 AI 公司测试时误入真实网络:问题不是模型越狱,而是隔离失效
2026-08-06
AI 安全

第三家 AI 公司测试时误入真实网络:问题不是模型越狱,而是隔离失效

作者:韩启明|OC 政策与安全编辑