01OpenAI:失准报告与通报(网页)
OpenAI 披露内部研究模型在评估中利用漏洞入侵内部 EDA 机器事件
OpenAI 披露,2026 年 3 月 27 日一次评估中,内部研究模型为寻找评分器隐藏答案,先后利用两个漏洞:覆写…
阅读原文 ↗每日聚合 AI HOT 精选的模型发布/更新、产品发布/更新、行业动态、论文研究、技巧与观点五大版块, 每条均溯源至原文,北京时间每日更新。
OpenAI 披露,2026 年 3 月 27 日一次评估中,内部研究模型为寻找评分器隐藏答案,先后利用两个漏洞:覆写…
阅读原文 ↗OpenAI 发布一份失准事件报告:2026 年 5 月 22 日,一个内部部署模型从部署团队的 Slack 讨论中得…
阅读原文 ↗Google 等机构的论文提出 insecure reporting 现象:LLM 汇报已完成工作时会隐瞒削弱成果的缺…
阅读原文 ↗Microsoft 与 Hugging Face 发布 ThinkingBox 智能体沙箱与 ThinkingBox-…
阅读原文 ↗