AI资讯新闻榜单内容搜索-不

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 不
假如有一万张卡,RL训练该怎么扩大规模?十万张呢?

假如有一万张卡,RL训练该怎么扩大规模?十万张呢?

假如有一万张卡,RL训练该怎么扩大规模?十万张呢?

当预训练将大模型带到新的能力起点,强化学习则通过持续的探索与反馈,不断激发模型在新环境、新任务中的推理与行动能力,决定它们还能走多远。

来自主题: AI技术研报
8115 点击    2026-09-22 14:43
世界模型是上不了桌的另开一桌

世界模型是上不了桌的另开一桌

世界模型是上不了桌的另开一桌

时间到了2026年9月,我们基本可以宣布世界模型是一个垃圾概念。

来自主题: AI资讯
6759 点击    2026-09-22 14:43
你的 Codex 额度有救了,你甚至可以接入JEV来玩红警

你的 Codex 额度有救了,你甚至可以接入JEV来玩红警

你的 Codex 额度有救了,你甚至可以接入JEV来玩红警

上周发了折腾 WebCodex 的文章《把ChatGPT几乎无限的网页额度当Codex用》,文章下面,就有小伙伴接着问:能不能让不同的模型,去干不同的活?

来自主题: AI资讯
8048 点击    2026-09-22 11:46
预训练Token消耗直接腰斩!上海AI Lab&上交大提出全新预训练任务,开源首个8.9B隐空间大模型NCP-ArchPreview

预训练Token消耗直接腰斩!上海AI Lab&上交大提出全新预训练任务,开源首个8.9B隐空间大模型NCP-ArchPreview

预训练Token消耗直接腰斩!上海AI Lab&上交大提出全新预训练任务,开源首个8.9B隐空间大模型NCP-ArchPreview

自现代大模型诞生以来,“下一个Token预测(Next-Token Prediction, NTP)”就被奉为不可撼动的黄金律条。然而,逼着模型逐字死记硬背,真能学会宏观语义规划吗?

来自主题: AI技术研报
7780 点击    2026-09-22 11:18
简单讲讲 Agent 的工作原理

简单讲讲 Agent 的工作原理

简单讲讲 Agent 的工作原理

现在的 Agent 的产品越来越多,有些主打 Coding,有些事做日常办公,也有些用于情感陪伴虽然这些产品的用途不同,背后的工作原理其实都大同小异,便是 Harness 对上下文的自动化编排

来自主题: AI技术研报
10069 点击    2026-09-22 11:17
ACM Multimedia 2026 Oral|从「转述痕迹」到「看见证据」:ForgeryVCR用视觉中心推理重塑图像取证范式

ACM Multimedia 2026 Oral|从「转述痕迹」到「看见证据」:ForgeryVCR用视觉中心推理重塑图像取证范式

ACM Multimedia 2026 Oral|从「转述痕迹」到「看见证据」:ForgeryVCR用视觉中心推理重塑图像取证范式

随着编辑工具与生成模型的快速普及,「改图」正在变得越来越容易,篡改者可以在几乎不改变画面观感的前提下完成内容伪造,给内容真实性核验、平台治理与数字媒体信任带来新的风险。因此,图像取证与可信鉴伪证据,成为了内容安全中尤为重要的一环。

来自主题: AI技术研报
9657 点击    2026-09-22 09:51