DeepSeek新论文公开Agent训练!梁文锋署名
DeepSeek新论文公开Agent训练!梁文锋署名大模型训练拼的是算力,Agent训练拼的是环境。
搜索
大模型训练拼的是算力,Agent训练拼的是环境。
9 月 16 日,在谷歌 DeepMind 深度参与了 Gemini 2.5/3、世界模型 Genie 2/3 以及具身智能体 Sima 2 研发的核心研究员 Bonnie Li 宣布离职,转会 OpenAI。
这年头,实时生成的世界模型越来越会「造世界」了。
这几天,Jev 模型在开发者社区引发讨论。
价格卷过DeepSeek Flash。
DeepSeek正训练约2万亿参数的新模型,并计划将后续模型参数规模进一步推至8万亿,加入新一轮超大参数模型竞赛。
今年,AI 创业到底往哪里走,变得比过去更难判断。 模型公司不断向应用层下探,一些 To C 产品刚找到的功能,可能下一次模型更新就会被直接覆盖。另一边,机器人、世界模型等概念又速升温,越来越多创业公
最近,一个叫Jev的新模型突然火了。
大模型江湖变天了。
在大模型在拼命刷 Benchmark 卷编程的时候,「不能说话」的 Jev 却意外成了 AI 圈的新顶流,究其原因,大模型应用的价值正在从「生成什么」,进一步延伸到「能否理解复杂信息,并据此做出可靠判断」。