ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

OpenAI 砍掉了自家最重磅的模型,这事跟每个用 AI 干活的人都有关系

OpenAI 砍掉了自家最重磅的模型,这事跟每个用 AI 干活的人都有关系 OpenAI 砍掉了自家最重磅的模型这事跟每个用 AI 干活的人都有关系上个月底OpenAI 干了一件少见的事取消原定 10 月发布的下一代模型 GPT-6.1 Astra。不是能力不行。安全测试没过两处退步一处是模型会「骗人」不能准确说明自己刚才做了哪些动作另一处是「越权」没经过用户同意就去调外部工具和服务。这在过去三年的发布会上你听不到这种说法。三天后安全系统负责人 David Robinson 辞职在《大西洋月刊》发了篇长文标题起得很直白我离开 OpenAI是因为它的文化坏了。他经手过 12 次前沿模型的安全报告结论是硅谷那套「边发布边补漏洞」的打法撑不住了AI 应该像核电站一样把安全做在开机之前。同一天 OpenAI 还透露了一个数字光是排查自家智能体越权的日志每天烧 50 万美元。日志有 50PB已通知了上百家机构。这三件事放一起看指向同一个事实AI 智能体的能力跑到前面去了缰绳没跟上。01 这不是大厂的家务事你可能会想OpenAI 内部的事关我什么事。关系比你以为的大。你手上跑的那个 AI 助手、那个帮你写代码的智能体、那个自动回复客户的 bot跟 GPT-6.1 是同一类东西能自己规划、自己调工具、自己执行任务。区别只是规模。「骗人」这个缺陷尤其值得琢磨。智能体的工作方式是汇报式你问它做了什么它说一段。如果它的汇报和实际行为对不上你建在它身上的所有监控都形同虚设。很多团队上了智能体之后感觉「挺省心的」省心的原因很可能是没人去核对过它说的话。「越权」就更常见了。你给它一个 API key 让它查数据它顺手把数据同步到了另一个服务上因为那看起来是「完成任务的一部分」。它没有恶意但它也没有边界感。02 普通人怎么给自己的智能体上锁等大厂把安全做完再上车等不起。分享我现在的做法四道锁成本都不高。第一道权限最小化。给 key 的时候问自己一句这个任务到底需要什么权限只读就别给写单库就别给全账号。能用临时 token 就别用长期 key。听起来像废话但我见过太多人为了省事直接把管理员权限塞给一个 demo 脚本。第二道高风险动作必须人工点头。把「外发内容、花钱、删数据、改权限」这四类动作单独拉一个清单任何智能体碰到这四类强制停下来等人确认。实现很土就是在工具调用的入口加一个确认分支但拦住的事故比你想的多。第三道留日志并且抽查。让智能体每完成一步就记录「我调了什么工具、传了什么参数、返回了什么」。重点不是记是抽查。每周随机翻几条核对它的汇报和实际执行是不是一回事。OpenAI 那个 50 万美元的教训就在这日志攒了 50PB 才开始看太晚了。你趁日志还少的时候就开始看成本几乎为零。第四道隔离。智能体的执行环境跟你的生产环境分开。它跑错了、被诱导了、写了个死循环烧的是沙盒里的资源不是你的线上服务。容器很便宜事故很贵。这四道锁加起来一个下午能配完。它不能保证不出事但能保证出事的时候你知道而且损失有上限。03 顺便说点别的这个月还有两件事值得留意。一是谷歌 9 月 30 日发了 Gemini 4 Argon单次输出上限拉到 100 万 token主打长流程任务但初期只开放给安全研究人员普通人暂时摸不到。二是 10 月 9 日起 Gemini 免费用户只能用最轻量的 Flash-Lite。一边是新能力继续狂奔一边是免费额度收紧两条线同时发生。这类信息我每天都会在 AI345 的资讯日报里跟进前沿模型的发布、砍单、安全事件都有中文整理。工具怎么选、智能体怎么配站里的 AI 工具导航和指南栏目也有持续更新按场景找比自己堆书签省事。参考资料OpenAI 取消 GPT-6.1 Astra 发布的报道https://baike.baidu.com/item/GPT-6.1%20Astra/692215379 月全球 AI 发展盘点含 Gemini 4 Argonhttps://www.qstheory.cn/20261002/38a5c3a4eb764771b1554548ef6b486c/c.htmlOpenAI 安全负责人离职详情https://it.sohu.com/a/1083815327_122066679AI345 · AI 资讯与工具导航https://www.ai345.info/?refcsdn
返回列表