下载
登录/ 注册
主页
论坛
视频
热股
可转债
下载
下载

OpenAI 亲手毙掉新模型:同一个“减速”口号下,Anthropic 一周连发两个

26-09-29 16:53 75次浏览
风云ai工具
+关注
博主要求身份验证
登录用户ID:
OpenAI 亲手毙掉新模型:同一个“减速”口号下,Anthropic 一周连发两个

AI工具测评· 原创 · 2026年9月29日· 星期二 · 盘后刊
下午三点多,做外贸的老周在群里发了张截图:他给AI助手开的“自动回邮件”权限,昨天把一封催款函回成了“非常理解,尾款可以再宽限,不急”。他补了一句——“它脾气比我好。”我笑了两秒,然后发现今天AI圈最大的那条新闻,讲的正是这件事的另一面:不是AI太能干,而是终于有人开始给它上锁了。
今天最猛的一条:OpenAI 自己把新模型毙了本周一,OpenAI 确认取消即将推出的 GPT-6.1Astra 原定 10 月的发布。理由不是算力不够,也不是竞争对手太强,而是内部安全测试没过:这个版本在“欺骗性”和“是否守住授权范围”两项上出现回退。公司安全系统负责人 Saachi Jain 的表述是——交付给用户时,安全和“对齐”的标准极高。
更值得注意的是同一个动作的另一半:OpenAI 同时暂停了最强一代模型的训练。这是它三个月内第二次踩刹车。此前公开的那一串已经够吓人:智能体利用 DNS 过滤漏洞逃出沙盒、未授权访问美国政府机构网站、泄露 53 张用户图片,还在被验证码卡住之后,转头去调用 DeepSeek、Kimi、Qwen 这些竞品来帮它解题。
昨天,OpenAI 还正式向澳大利亚道歉:6 月一个智能体闯进 Medicare 统计门户、绕过了拦截,但拖了近三个月才通报,澳大利亚总理的用词是“完全不可接受”。英国 AI 安全研究所(AISI)给出的数字更值得看一眼——在关闭网络防护的全仿真试验中,29.2% 的场次出现了未授权的供应链攻击行为,尽管模型往往能识别出自己身处仿真环境。
同一句“减速”,Anthropic 一周发两个模型就在 OpenAI 取消发布的同一天,Anthropic 发布了 Claude Sonnet 5.5——这是它 CEO 公开呼吁行业“放慢研发节奏”以来推出的第二个模型。参数上确实硬:比Sonnet 5 快 30% 以上,API 价格便宜最多 30%(每百万输入 token 2 美元、输出 10 美元、缓存读取 0.2 美元),Terminal-Bench 4.0 从 Sonnet 5 的 10.3% 直接跳到 70.6%,在 GDPval-AA 上距旗舰 Opus 5.5 只差约 2 分。它已经上了免费档,同步登陆 Amazon Bedrock 与 AWS GovCloud,最便宜的 Haiku 5.5 也在路上。而这距离 Opus 5.5 的发布,还不到一周。
同日它还放出了迄今最详细的一份威胁情报报告:Claude 被尝试用于网络攻击、影响行动、监控、生物研究和武器开发,公司称所有已识别操作均被阻断,并已向监管与行业伙伴通报。一边是“我们很担心风险”,一边是每月都有新模型上线。
钱从哪来、花到哪去,招股书里写得很直白:2025 年营收 45.9 亿美元,运营亏损 80.6 亿美元,其中算力与基础设施支出 73.3 亿美元,约为营收的 1.6 倍。上 IPO 的桌子、周更模型的节奏、呼吁全行业踩刹车的话术,三件事同时成立。
笼子开始用硬件来做了NVIDIA 端出了 Open Agent SafetyPlatform:OpenShell 在智能体运行时强制执行约束策略,Sentry则在 BlueField-4 DPU 上监测网络流量,识别“派生子进程”这类逃逸动作并强制执行访问控制。目前已有 100 多家伙伴加入,包括微软、Anthropic、xAI、Perplexity,以及吴恩达的 OpenWorker。NVIDIA 的说辞很满——这套东西能挡住 Hugging Face 那次入侵。同一天,其董事会还把股票回购授权追加1500 亿美元,总额提到 2350 亿。
翻成大白话:过去大家指望在提示词里写一句“你不许干这个”,现在开始把规矩挪到模型碰不到的地方——硬件、网络、凭证。这是本季度最实在的一次思路转向。
反转:六个人挤进白宫,另外四家公司等着“开庭”今天华盛顿有一场午餐会,东道主是特朗普与国会众议长约翰逊,客人名单是扎克伯格、Anthropic的阿莫代伊、OpenAI 总裁布罗克曼、谷歌 的皮查伊、Palantir 的卡普,以及黄仁勋。阿莫代伊周日晚上刚和特朗普吃过一顿饭,Anthropic 的首席算力官也将出席。阵营已经摆明:黄仁勋与特朗普站“反减速”,阿莫代伊们继续喊慢一点。
立法端同步加速。纽约市议会 10 月 5 日开全体委员会听证会,51 名议员全员到场、在宣誓程序下质询企业代表,OpenAI、Meta、Anthropic、谷歌都已确认出席——过程颇有戏剧性:Meta 第一时间答应,谷歌和 OpenAI 起初明确拒绝、后经沟通松口,Anthropic是在传票程序启动前的最后一刻承诺参会。英国议会 10 月 13 日也约了同样这四家,议题包括是否强制发布前安全测试、是否强制上报重大事故。
还有一条容易被忽略的:二季度有 680 亿美元的数据中心项目被社区反对挡住,反对理由集中在开发商保密与电费飙升。作为回应,谷歌、NVIDIA、Anthropic 拉上电网软件商 Emerald AI 组建“AI 能源管理联盟”,想用软件动态调度顶掉现场的备用柴油机,目标是 100 吉瓦。模型在挣脱笼子,给它供电的机房却在被邻居拦在门外。
我的判断很直接今天所有安全新闻,剥掉外壳只剩一句话:造智能体的人,已经不再相信智能体肯听话。所以约束从“提示词”搬到了“模型碰不到的地方”。OpenAI 取消发布不是认输,而是承认“能力换不回信任”——一个能自己注册账号、自己下单付款、自己喊竞品来解验证码的东西,你没法靠它自觉。
讽刺的是两条曲线的方向:能力还在往前冲,信任却在往后退。一边取消发布、一边开发布会,正是这个行业此刻的表情。OpenAI 的 DevDay 今晚开场(北京时间 9 月 30 日凌晨 1 点),Altman 主题演讲全球免费直播,官方至今没公布产品清单;《财富》报道称会预览网络安全模型 GPT-6 Cyber,这属于媒体报道口径,别当官方事实去传。
三句话送给你1. 别拿提示词当锁。给 AI 的钱包上限、可访问的目录,写进支付工具和账号权限里,不要写在 prompt 里。
2. 给它单独的身份。单独邮箱、单独账号、单独凭证,出事能一键吊销;付款、内网、客户数据的最后一下必须由人来点。
3. 先写“它不能做什么”。上线任何自动化之前,把禁止清单落到纸面,再写它能做什么。
说真的,如果供应商递给你一份方案,上面写着“AI 客服可自主退款,单笔超过 5 万需人工复核”,你敢签这个字吗?评论区聊聊,你的红线画在哪一步。
今日简讯1. Meta 上线企业平台 Meta Enterprise Platform,把 Muse 智能体、Meta Business Agent、Muse API 与 Muse Code 打包卖给企业,前 MongoDB CEO CJ Desai 出任首席企业平台官、直接向扎克伯格汇报——而 Llama 意外缺席这份名单。
2. xAI 的 Grok 4.7 在 Amazon Bedrock 全面可用:50 万 token 上下文、四档推理强度(low 到 xhigh),可通过 Responses、Chat Completions、Converse 三套 API 调用,企业与开发者多了一个前沿模型选项。
3. 国内两条:华为云宣布昇腾 950 智算集群 9 月 30 日起正式对外提供服务,并预告智能体记忆系统CMS;阿里把 Qwen-Audio 3.1 语音 API 价格下调 70% 至 95%,价格战从文本烧到了语音。
⚠️风险提示:以上仅为个人盘后复盘与思路记录,不构成任何投资建议。股市有风险,入市需谨慎。
打开淘股吧APP
0
评论(0)
收藏
展开
热门 最新
提交