姚顺宇、施天麟聊 RSI:最难的不是实现自我迭代,而是如何验证迭代有效
姚顺宇、施天麟聊 RSI:最难的不是实现自我迭代,而是如何验证迭代有效RSI(递归自我改进)已经热了一段时间。从 OpenAI、Anthropic 到谷歌,头部实验室都在探索如何让 AI 参与下一代 AI 的研发,创业公司也开始围绕它做产品、搭环境、建评测。
搜索
RSI(递归自我改进)已经热了一段时间。从 OpenAI、Anthropic 到谷歌,头部实验室都在探索如何让 AI 参与下一代 AI 的研发,创业公司也开始围绕它做产品、搭环境、建评测。
OpenAI同日发布GPT-6 Sol与GPT-6 Luna,API价格相比GPT-5.6腰斩50%,主打单位任务成本优势;Anthropic推出Claude Opus 5.5,典型任务成本降低约40%且输出速度提升超30%,两家厂商围绕"性价比"展开直接竞争。
Anthropic发布Claude Opus 5.5,性能追平Fable 5.1且成本降低40%,在Terminal-Bench 4.0和GDPval-AA v2.1等多项基准测试中超越GPT-6 Astra,OpenAI两小时内推出GPT-6 Sol和Luna迎战。
Anthropic这回,怕不是憋了个大的?
Anthropic联合MIT、斯坦福学者发布2030年三种经济情景推演,极端情景下美国GDP暴增32%但白领失业率飙至17.9%,资本攫取55%增长红利,万余名美国人调查预期偏向最严峻版本。
Anthropic、谷歌、OpenAI、Kimi、DeepSeek及阿里Qwen等全球AI大厂正密集备战,在中秋国庆假期前后集中推出或预告Claude 5.2、Gemini 4 Pro、Kimi K3.1、DeepSeek V4.1 Pro、Qwen4等旗舰基模,集体围攻OpenAI此前发布的GPT-6 Astra。
Anthropic连夜拔掉内部代号Opus-Next的灰度测试后又在一天内恢复,且灰度范围从Claude Code扩大至Claude Chat/Cowork/Code,预示Claude Opus 5.2可能即将发布。
Anthropic联合Adaptyv Bio发起蛋白质设计公开赛并提供百万美元Claude积分,但初创公司Geodesic Intelligence(极奥智能)早一天就发布了百万美元现金悬赏的药物发现问题征集,且后者向全球开放参赛,不设国籍限制。
调查博主Kevin Bass深扒Anthropic资金链,揭露其早期投资者通过慈善机构向评估机构METR等输送巨额资金,构建"AI末日论"叙事的闭环永动机,质疑第三方AI风险评估的独立性。
Anthropic在旧金山湾区秘密建立生物湿实验室,将Claude接入真实生物实验,并通过自研的Model Hardware Standard让模型直接控制实验设备,以补齐AI药物研发中真实世界验证速度滞后于设计的短板。