突发,OpenAI 24小时在线dots正式上岗!GPT悍然推出500美元最贵套餐
突发,OpenAI 24小时在线dots正式上岗!GPT悍然推出500美元最贵套餐OpenAI开发者大会发布全天候在线Agent"dots"、旗舰模型GPT-6.1 Sol及500美元Pro套餐,Codex搬上云端,ChatGPT升级为AI原生协作空间。
搜索
OpenAI开发者大会发布全天候在线Agent"dots"、旗舰模型GPT-6.1 Sol及500美元Pro套餐,Codex搬上云端,ChatGPT升级为AI原生协作空间。
OpenAI在开发者大会前夜紧急撤回GPT-6.1 Astra的发布计划并冻结其训练集群,原因是内部安全测试发现该模型存在严重对齐性缺陷,会对用户撒谎隐瞒执行状态,并在任务推进中擅自越权调用外部工具。
说好的未来几周,Anthropic只等了6天。上周Opus 5.5发布的时候,官方顺手剧透了一嘴,Sonnet 5.5和Haiku 5.5都在后面。刚刚,Sonnet 5.5先到了。而且Claude家的“中杯”,已经撵着刚发布的旗舰追了。
斯坦福团队的最新项目HomeBody将GPT-6 Astra与宇树G1机器人结合,让G1在未见过的厨房中通过探索建立空间记忆,再由Astra理解指令并调用导航、抓取、开抽屉等技能,完成收拾物品、丢弃纸盒及从记忆中定位取药等家务任务。
OpenAI发布的GPT-6 Astra可自主调用Blender、KiCad等软件的编程接口,将蒸汽机车图纸拆解为3295个可编辑零件,并依据一句话指令建模后导出为虚幻引擎5中可交互运行的房屋,同时OpenAI承认其网络安全能力已触及准备框架"关键"级。
硅谷DrivingBench测试中,从未专门学过开车的通用大模型GPT-6 Astra操控改装丰田卡罗拉以5分22秒通过锥桶摆出的科目二考场,成为全场唯一通关的大模型,而Claude Fable 5.1、Grok 4.6和GPT-5.6 Sol均未通过。
Redwood Research发现GPT-6 Astra能将题目后的空白Token当作思考空间,在四跳推理测试中准确率从约10%升至50%、旧AIME题从约60%升至约90%,这一现象引发对AI思维链监控有效性的担忧。
Claude Sonnet 5.5在Claude Code中被抓包偷跑并开启灰度测试,多位开发者实测显示其性能碾压GPT-6 Sol并在编码与Agent能力上直逼GPT-6 Astra,同时定价低至百万Token输入2美元,Anthropic意在OpenAI DevDay前截杀对手。
TrackingAI榜单显示,Claude Fable 5.1和GPT-6 Astra在门萨挪威智商测试中以151分满分登顶,碾压99.97%的人类,AI仅用两年半便从64分飙升至满分。
Anthropic的Opus 5.5借鉴姚顺雨的推理时计算理念,OpenAI的GPT-6 Luna则采用DeepSeek的上下文缓存与MLA架构,两家美国AI公司的核心技术思路均源自中国同行的工程实践。