AI自己榨干算力!让Kimi K3自己写「超级算子」,推理快了3倍
AI自己榨干算力!让Kimi K3自己写「超级算子」,推理快了3倍Inferact开源TPU巨型算子与浪潮信息发布元脑SD200 Ultra超节点服务器,两家公司分别用谷歌TPU v7和128颗本土AI芯片,通过算子融合让Kimi K3推理性能提升3倍以上,且浪潮信息让K3自主编写超级算子。
搜索
Inferact开源TPU巨型算子与浪潮信息发布元脑SD200 Ultra超节点服务器,两家公司分别用谷歌TPU v7和128颗本土AI芯片,通过算子融合让Kimi K3推理性能提升3倍以上,且浪潮信息让K3自主编写超级算子。
清华大学联合无问芯穹与上海交通大学开源了面向具身模型的端侧推理引擎APXInf,通过全栈优化在Thor芯片上将π0.5推理速度提高约10.7倍,并引入可由Agent执行的工程化流程以适配模型的持续迭代。
苹果真正的AI杀手锏并非Siri,而是硬件路线——在新任CEO John Ternus主导下,苹果计划于2029年前后重返企业服务器市场,推出搭载两枚或四枚M8 Ultra芯片的设备用于本地AI推理,凭借统一内存架构为企业提供开箱即用的AI部署方案。
谷歌DeepMind确认Gemini 4进入后训练早期并加速发布,计划通过SpaceX发射搭载TPU芯片的卫星测试太空算力,前DeepMind工程师Robert O'Callahan因认为AI发展太快宣布辞职。
韩国将国家经济与股市押注在三星和SK海力士的HBM芯片上,AI浪潮催生半导体员工天价奖金与全民加杠杆炒股爆仓并存的畸形格局,导致青年失业恶化与社会撕裂加剧。
henry 发自 凹非寺 量子位 | 公众号 QbitAI “这是目前中国算力性能最强的AI芯片,性能达到M890的3倍。” 9月22日的云栖大会上,阿里巴巴集团CEO吴泳铭这样介绍新一代真武V900
在2026云栖大会具身智能论坛上,阿里云展示了覆盖采、存、洗、标、质检增广、训练评测到数据管理的全栈数据产线能力,通过Qwen标注、HappyHorse增广、PAI训练与平头哥真武芯片协同,将具身智能企业的反馈迭代周期从周级压缩至日级,穹彻智能、苏度科技、莫刻机器人等企业已率先跑通这条数据飞轮。
北京时间 9 月 23 日,在 2026 骁龙峰会上,高通 CEO 克里斯蒂亚诺・安蒙(Cristiano Amon)正式介绍了高通面向 Agent 时代的战略转型。与此同时,高通发布了两款新一代旗舰手机 SoC:第六代骁龙 8 超级至尊版(Snapdragon 8 Elite Extreme Gen 6)与第六代骁龙 8 至尊版(Snapdragon 8 Elite Gen 6)。
本期节目对比了Groq、Cerebras与OpenAI在推理芯片上的三条技术路径,指出业界正围绕SRAM提升带宽性价比进行系统级异构收敛,并分享了英伟达首席科学家Bill Dally关于局部性与追求全局最优的芯片设计哲学。
骁龙首次双旗舰齐发,最高8核CPU、GPU内置AI核、NPU内存扩容,安卓旗舰大战正式开打。