AI资讯新闻榜单内容搜索-模型训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型训练
TPAMI26 | 全面升级PolaFormer++:极性感知计算流 +通道级尖峰,实现线性注意力的新天花板

TPAMI26 | 全面升级PolaFormer++:极性感知计算流 +通道级尖峰,实现线性注意力的新天花板

TPAMI26 | 全面升级PolaFormer++:极性感知计算流 +通道级尖峰,实现线性注意力的新天花板

继 ICLR 2025 的 PolaFormer 之后,哈工大(深圳)与鹏城实验室合作的扩展版本 PolaFormer++ 近日被 IEEE TPAMI 正式接收。新版本在理论框架、特征映射设计和实验覆盖面上全面升级:首次给出判定特征映射是否具备「降熵尖锐性」的理论判据,并提出极性感知的通道级尖锐(PaCS)特征映射,在六大类视觉核心任务上全面验证了线性注意力的潜力。

来自主题: AI技术研报
8819 点击    2026-09-18 09:35
Meshy: 角色驱动下SPMD范式的RL训练框架

Meshy: 角色驱动下SPMD范式的RL训练框架

Meshy: 角色驱动下SPMD范式的RL训练框架

在过去的几年里,LLM RL 系统的工作负载发生了巨大的变化。早期的 RLHF 围绕同步训练展开:模型按固定顺序进行生成、打分和训练,每个阶段之间有着明确的同步边界。如今,系统还需要处理异步生成、持续训练、多轮 Agent 以及与外部环境的交互 —— 那些在同步执行中原本隐含的状态、版本和故障边界,现在都必须显式地进行管理。

来自主题: AI技术研报
10462 点击    2026-09-17 10:11
自进化社媒Agent!浙大x北大:从多模态任务编排到反馈驱动

自进化社媒Agent!浙大x北大:从多模态任务编排到反馈驱动

自进化社媒Agent!浙大x北大:从多模态任务编排到反馈驱动

当大模型已经能够快速生成文案、图片和视频,一个更进一步的问题是:Agent 能否从执行过的任务中积累经验,并在持续交互中改进后续行为?

来自主题: AI技术研报
10051 点击    2026-09-16 14:40
把记忆交给CPU,大模型会变快

把记忆交给CPU,大模型会变快

把记忆交给CPU,大模型会变快

拿Agent做Coding,想必大家都已经很熟悉了。

来自主题: AI资讯
10424 点击    2026-09-16 14:40
复杂的Harness Evolution,甚至不如多跑几遍

复杂的Harness Evolution,甚至不如多跑几遍

复杂的Harness Evolution,甚至不如多跑几遍

一个 Agent 第一次没把任务做对。

来自主题: AI技术研报
6913 点击    2026-09-16 14:40