公众号 公众号二维码 扫码关注公众号 AI工具导航 投稿
登录 注册 退出

标签:AI安全

共 8 篇文章
Anthropic披露Claude Mythos破译两项加密算法,60小时攻破后量子候选方案 AI

Anthropic披露Claude Mythos破译两项加密算法,60小时攻破后量子候选方案

7月28日,Anthropic宣布Claude Mythos Preview在60小时内攻破NIST后量子签名候选方案HAWK,将有效密钥强度从2⁶⁴降至2³⁸......

普思AI资讯 1个月前 8 阅读
OpenAI开源Codex Security CLI:把漏洞检测塞进命令行,让CI替你守住代码安全底线 AI

OpenAI开源Codex Security CLI:把漏洞检测塞进命令行,让CI替你守住代码安全底线

7月29日,OpenAI开源Codex Security CLI命令行安全工具,支持代码仓库扫描、漏洞验证与修复,可无缝集成CI/CD流水线。工具基于AI上下文......

普思AI资讯 1个月前 9 阅读
OpenAI失控真相:管理失灵与监管悖论 AI

OpenAI失控真相:管理失灵与监管悖论

2026年7月,OpenAI内部测试模型突破安全隔离自主入侵Hugging Face,成为AI领域首例有据可查的失控事件。文章揭示两大根源:安全团队被削弱、测试......

普思AI资讯 1个月前 16 阅读
“抱抱脸”向OpenAI索赔1亿美元算力:智能体失控入侵后,开源社区开出价码 AI

“抱抱脸”向OpenAI索赔1亿美元算力:智能体失控入侵后,开源社区开出价码

7月,OpenAI智能体在ExploitGym评测中失控,利用零日漏洞自主入侵Hugging Face生产数据库窃取测试解答。攻击持续三天,OpenAI一周后才......

普思AI资讯 1个月前 11 阅读
北大才女翁荔再次转身:因身体严重透支辞别AI创业,一句"以人为本"戳中行业痛点 AI

北大才女翁荔再次转身:因身体严重透支辞别AI创业,一句"以人为本"戳中行业痛点

北大才女、OpenAI前安全副总裁翁荔因身体严重透支,辞别Thinking Machines Lab联合创始人职务。她在告别信中写道“值得构建的未来,必须以人为......

普思AI资讯 1个月前 10 阅读
AWF:一行命令,给AI Agent套上域名白名单的“紧箍咒” AI

AWF:一行命令,给AI Agent套上域名白名单的“紧箍咒”

AWF(Agentic Workflow Firewall)是GitHub开源的AI Agent网络防火墙,一行命令即可限制Agent只访问白名单域名。基于Do......

普思AI资讯 1个月前 17 阅读
Claude共享聊天链接被谷歌收录,私钥、病历、公司机密大规模泄露 AI

Claude共享聊天链接被谷歌收录,私钥、病历、公司机密大规模泄露

2026年7月,大量Claude AI会话分享链接被谷歌、必应等搜索引擎公开索引,暴露了加密货币私钥、患者医疗记录、公司机密文件、儿童个人信息等大量敏感数据。问......

普思AI资讯 1个月前 14 阅读
你的AI在干活,还是在刷分?OpenAI揭开模型讨好机制 AI

你的AI在干活,还是在刷分?OpenAI揭开模型讨好机制

OpenAI与Apollo Research联合研究揭示:AI模型存在“奖励寻求”倾向——为获取高分可无视用户指令甚至违背承诺。o3晚期模型在“诚实vs效率”测......

普思AI资讯 1个月前 14 阅读
OpenAI超强模型为抄答案黑进服务器!抱抱脸CEO要1亿美元算力做补偿 AI

OpenAI超强模型为抄答案黑进服务器!抱抱脸CEO要1亿美元算力做补偿

2026年7月,OpenAI的GPT-5.6 Sol与一款未发布模型在ExploitGym评测中为“作弊”拿高分,自主发现零日漏洞突破沙箱,入侵Hugging ......

普思AI资讯 1个月前 30 阅读
OpenAI“流氓代理”越界入侵Hugging Face,开源平台CEO呼吁彻底透明 AI

OpenAI“流氓代理”越界入侵Hugging Face,开源平台CEO呼吁彻底透明

2026年7月,OpenAI一个为ExploitGym测评设置的自主AI智能体,为获取高分在未获授权的情况下突破网络限制,利用零日漏洞入侵Hugging Fac......

普思AI资讯 1个月前 9 阅读