AI资讯新闻榜单内容搜索-Moe

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Moe
一出手就表现惊艳!国产开源大模型又杀出一匹黑马

一出手就表现惊艳!国产开源大模型又杀出一匹黑马

一出手就表现惊艳!国产开源大模型又杀出一匹黑马

至知创新研究院开源了采用稀疏 MoE 架构的代码与复杂任务导向大模型 IQuest-Q1,该模型总参数约 320B、激活参数仅约 15B,在代码生成、终端操作、智能体任务等多项评测中表现均衡,并展示了从前端交互、游戏开发到强化学习训练调试等场景的可交付能力。

来自主题: AI资讯
9778 点击    2026-09-30 11:16
高通CEO安蒙:我眼中的“智能体时代”和“中国速度”

高通CEO安蒙:我眼中的“智能体时代”和“中国速度”

高通CEO安蒙:我眼中的“智能体时代”和“中国速度”

在2026骁龙峰会上,高通CEO安蒙发布第六代骁龙8至尊版双旗舰平台并强调行业正迈向意图驱动的智能体AI时代,联合中国企业在手机端侧部署300亿参数MoE模型,同时指出高通已拓展至PC、汽车、机器人和数据中心等业务,肯定中国企业的智能体创新速度。

来自主题: AI资讯
6711 点击    2026-09-29 11:08
笔记本跑7000亿参数GLM!无GPU也行? SSD当显存用火爆GitHub

笔记本跑7000亿参数GLM!无GPU也行? SSD当显存用火爆GitHub

笔记本跑7000亿参数GLM!无GPU也行? SSD当显存用火爆GitHub

GitHub火热开源项目Colibrì以纯C实现分层推理框架,通过AI内存多层化将SSD、RAM和VRAM组成动态调度系统,无需GPU即可让普通笔记本运行744B参数GLM-5.2等超大MoE模型,已揽获32k Star并支持9个模型家族。

来自主题: AI资讯
9835 点击    2026-09-26 15:01
梁文锋狙击战:深扒那些梁文锋署名的论文有多牛

梁文锋狙击战:深扒那些梁文锋署名的论文有多牛

梁文锋狙击战:深扒那些梁文锋署名的论文有多牛

过去三年,梁文锋极少以第一作者或通讯作者身份,出现在 V3.2、V4、V4.1-Flash 这些动辄上百人署名的旗舰模型整体报告中;却始终把名字签在 MLA 注意力、MoE 路由机制、mHC 拓扑流形、DSpark 推理算子、DSec 智能体沙盒这些最底层的原子技术论文上。

来自主题: AI技术研报
9051 点击    2026-09-25 10:13
刚刚,阶跃Step 5 Preview发布!一举杀进全球开源前三

刚刚,阶跃Step 5 Preview发布!一举杀进全球开源前三

刚刚,阶跃Step 5 Preview发布!一举杀进全球开源前三

阶跃星辰发布新一代旗舰基座模型Step 5 Preview,以44分的AA智能指数成绩跻身全球开源模型前三,采用600B总参数/27B激活的稀疏MoE架构并原生支持1M上下文,在代码生成、长程Agent、深度研究与金融尽调等场景表现突出。

来自主题: AI资讯
9535 点击    2026-09-20 15:13
刚刚,DeepSeek V4.1 Flash正式上线!已适配Harness

刚刚,DeepSeek V4.1 Flash正式上线!已适配Harness

刚刚,DeepSeek V4.1 Flash正式上线!已适配Harness

DeepSeek V4.1 Flash 正式在网页、App 和 API 端全面上线,采用 552B 参数的 MoE 架构与 Causal-Encoder-Decoder 设计,性能全面超越 V4 Pro 并原生支持多模态,DeepSeek Harness v0.1.5 也同步适配。

来自主题: AI资讯
10282 点击    2026-09-10 14:42
DeepSeek V4 多模态开源,我们把它的视觉链路拆了一遍

DeepSeek V4 多模态开源,我们把它的视觉链路拆了一遍

DeepSeek V4 多模态开源,我们把它的视觉链路拆了一遍

图片不只被编码,还直接参与 Attention、MoE 与 Agent 推理。

来自主题: AI技术研报
10302 点击    2026-09-02 09:27
刚刚,蚂蚁百灵大模型开源轻量级混合推理MoE模型——Ling-3.0-tiny。

刚刚,蚂蚁百灵大模型开源轻量级混合推理MoE模型——Ling-3.0-tiny。

刚刚,蚂蚁百灵大模型开源轻量级混合推理MoE模型——Ling-3.0-tiny。

今日,蚂蚁百灵大模型开源了一款轻量级混合推理MoE模型——Ling-3.0-tiny。该模型总参数量为7.9B,推理时激活参数量为1.3B,主要面向高效本地部署而设计。其同步提供BF16、FP8和INT4三个版本,已在DGX Spark、MacBook、Mac mini等设备上完成验证,兼顾性能、效率与可部署性。

来自主题: AI资讯
10138 点击    2026-08-12 01:27
全球第一超算跑满血DeepSeek!一张GPU没用,打造超智融合「Token工厂」

全球第一超算跑满血DeepSeek!一张GPU没用,打造超智融合「Token工厂」

全球第一超算跑满血DeepSeek!一张GPU没用,打造超智融合「Token工厂」

在“灵晟”国产超算登顶最新一期全球超级计算机TOP500榜单后,清程极智与“灵晟”联合完成纯CPU MoE模型分布式推理方案:16节点即可流畅运行DeepSeek-V3/R1-671B模型,在batch_size=2048时,输出吞吐量与80张主流GPU集群相当。

来自主题: AI资讯
8694 点击    2026-08-08 13:35