最卷一夜! Claude 5.5 发布,性能直逼 Fable,还要卷价格
最卷一夜! Claude 5.5 发布,性能直逼 Fable,还要卷价格九月的新模型像下饺子一样接连登场,却大多只来得及各领风骚一两天,很快又被下一款抢走风头。
搜索
九月的新模型像下饺子一样接连登场,却大多只来得及各领风骚一两天,很快又被下一款抢走风头。
DeepSeek 快醒醒,ChatGPT 要打到家门口了。
6天,2000多万,小米这场史无前例的「炼丹直播」终于尘埃落定。
谁还没有被GPT-6 Astra搓3D的案例狠狠刷屏啊!
过去一周,Jev 成了整个 AI 圈最火的新模型。
就在刚刚,我们看到了不少令人意外的数据。
定了!林俊旸离职半年,新任千问负责人终于就位—— 前华为天才少年刘大一恒。
看来啊,老马显然也知道,国庆前后这几天的基模圈不好混。
AI产业的两道坎,浪潮信息怎么翻?
骁龙首次双旗舰齐发,最高8核CPU、GPU内置AI核、NPU内存扩容,安卓旗舰大战正式开打。
RSI(递归自我改进)已经热了一段时间。从 OpenAI、Anthropic 到谷歌,头部实验室都在探索如何让 AI 参与下一代 AI 的研发,创业公司也开始围绕它做产品、搭环境、建评测。
CPU的价值,在Agent时代,真的需要被重估了。
这个月,我基本是在高强度地用 GPT-6 Astra。
「思考力商品化」的新经济。
最近看到了一个挺有意思的东西,就是TypeSafe AI 做的 Jev。Reddit 上很多人用它玩 DOOM,也有人拿它玩 Mario。我申请之后,拿到 API Key 后,也做了一个网页小游戏,想看看它到底在里面起什么作用。一开始,我最想弄清楚的其实很简单:同样是让 AI 操作游戏,为什么要用 Jev?GPT 不能做吗?当然能。
剪映的 AI 边界,正不断延展。
家人们,你们看下面这两张图,能分得出哪张是AI,哪张是真实的吗?
数学界,真被AI追到家门口了!
5天。 不用搭景,不用等演员,导演陆川和团队,直接用AI把一场发生在400年前的明代灾难现场,搓出来了!
从真武 V900 到新一代磐久超节点服务器,平头哥八年来陆续布局的 AI 芯片、CPU、scale up 互联、scale out 网络和存储芯片,开始被装进同一套算力系统。
OpenAI同日发布GPT-6 Sol与GPT-6 Luna,API价格相比GPT-5.6腰斩50%,主打单位任务成本优势;Anthropic推出Claude Opus 5.5,典型任务成本降低约40%且输出速度提升超30%,两家厂商围绕"性价比"展开直接竞争。
Anthropic发布Claude Opus 5.5,性能追平Fable 5.1且成本降低40%,在Terminal-Bench 4.0和GDPval-AA v2.1等多项基准测试中超越GPT-6 Astra,OpenAI两小时内推出GPT-6 Sol和Luna迎战。
开发者mizorewww将开源决策模型Laya移植到Apple MLX框架,推出本地版Laya-MLX,可在Apple Silicon Mac上以低于1GB内存运行并摆脱PyTorch与云端API依赖,421M版本峰值内存943.6MiB、322M多语言版本687.6MiB。
小米正式发布并开源 MiMo-V2.6 系列模型,罗福莉称其背后的研究创新和工程难度超过 DeepSeek R1,在 Artificial Analysis Intelligence Index v4.3 中以 46.32 分成为当前得分最高的开源模型,价格仅为海外同级模型的 1/20 至 1/60。
过去一年,Agent 的讨论大多围绕模型本身展开:推理能力更强、上下文更长、工具调用更稳定。但进入真实工作流后,另一个问题开始变得更关键:Agent 的能力从哪里来,又如何被持续复用。
今天中午,看到 MVLAND上线了深度创作模式。
就在今天,外媒The Information曝出内幕—— OpenAI内部的AI模型,已经开始「自己训练自己」了!
就在刚刚,马斯克SpaceXAI正式发布,全新主力模型Grok 4.7!
个人 AI,环球同此凉热。
AI视频,已经开始挑战「实时造世界」了!