AI资讯新闻榜单内容搜索-模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型
美女AI主播火了,2万人冲进直播间狂刷礼物!最强实时互动模型首秀

美女AI主播火了,2万人冲进直播间狂刷礼物!最强实时互动模型首秀

美女AI主播火了,2万人冲进直播间狂刷礼物!最强实时互动模型首秀

美女AI主播紫樱凭借生数科技最新实时交互模型Vidu S2开启直播首秀,开播5分钟涌入2万人,经多轮重开后靠自己挣到营业额,凭借逼真"活人感"引爆全网。

来自主题: AI资讯
8026 点击    2026-09-28 09:52
从 Computer-Use 到 Robot-Use:一套接口让 VLM 直接「玩转」真实机器人

从 Computer-Use 到 Robot-Use:一套接口让 VLM 直接「玩转」真实机器人

从 Computer-Use 到 Robot-Use:一套接口让 VLM 直接「玩转」真实机器人

新加坡国立大学 Show Lab 发布的 Show-Harness 通过一套可被 VLM 理解的语义动作接口,使前沿视觉语言模型和轻量微调的 Qwen3.5-2B 能够跨模型、跨机器人本体直接操控真实机器人,并在跨任务、跨环境、跨本体实验中取得显著高于基线的成功率。

来自主题: AI技术研报
7416 点击    2026-09-28 09:50
平均6天一个新旗舰!大模型更新快到人类跟不上了

平均6天一个新旗舰!大模型更新快到人类跟不上了

平均6天一个新旗舰!大模型更新快到人类跟不上了

OpenAI、Anthropic及国内十家主要大模型厂商平均每6天推出一款新旗舰模型,AI已大规模参与下一代模型研发,导致模型迭代速度首次超过人类适应速度,开发者调好的提示词和参数频繁面临报废。

来自主题: AI资讯
8770 点击    2026-09-28 09:50
答对了,理由却错了:港科大提出LexAgentHallu,追踪智能体的「隐性幻觉」

答对了,理由却错了:港科大提出LexAgentHallu,追踪智能体的「隐性幻觉」

答对了,理由却错了:港科大提出LexAgentHallu,追踪智能体的「隐性幻觉」

香港科技大学提出LexAgentHallu法律智能体幻觉评测基准,沿执行轨迹定位错误步骤,发现即使最终答案正确,仍有68%的轨迹存在法律内容幻觉,表现最好的配置也有89%的轨迹出现幻觉。

来自主题: AI技术研报
7540 点击    2026-09-28 09:49
Nature Machine Intelligence|不只是「像大脑」,人脑信号还能直接引导语言模型进行鲁棒推理

Nature Machine Intelligence|不只是「像大脑」,人脑信号还能直接引导语言模型进行鲁棒推理

Nature Machine Intelligence|不只是「像大脑」,人脑信号还能直接引导语言模型进行鲁棒推理

北京大学、清华大学与微软亚洲研究院在Nature Machine Intelligence发表研究,发现语言模型内部表征与人脑演绎推理脑区存在部分对齐,并可利用脑信号引导模型表征干预与参数微调,显著提升推理鲁棒性。

来自主题: AI技术研报
7953 点击    2026-09-28 09:49
模型越来越强,企业AI为什么还卡在「最后一公里」?

模型越来越强,企业AI为什么还卡在「最后一公里」?

模型越来越强,企业AI为什么还卡在「最后一公里」?

针对企业AI落地卡在「最后一公里」的难题,中国联通推出联通云犀工作流智能体,以通信场景为入口,将AI能力轻量化嵌入企业现有业务流程,已服务超6万家企业、800万用户。

来自主题: AI资讯
7280 点击    2026-09-28 09:48
答案正确,推理就可靠吗?V-Rubrics用35万条细粒度准则细化多模态强化学习奖励

答案正确,推理就可靠吗?V-Rubrics用35万条细粒度准则细化多模态强化学习奖励

答案正确,推理就可靠吗?V-Rubrics用35万条细粒度准则细化多模态强化学习奖励

南洋理工大学S-Lab、A*STAR与UIUC联合提出的V-Rubrics方法将5万视觉样本拆分为35万条细粒度准则,从视觉忠实性、推理一致性和指令遵循三维度分别参与强化学习奖励分配,使基于Qwen3-VL-8B的模型在通用与知识评测中平均得分提升至68.04。

来自主题: AI技术研报
7430 点击    2026-09-28 09:48
又快又能打!匿名模型玉兔模型杀上双榜第一,Coding实测全记录

又快又能打!匿名模型玉兔模型杀上双榜第一,Coding实测全记录

又快又能打!匿名模型玉兔模型杀上双榜第一,Coding实测全记录

匿名模型Space Bunny突然杀上OpenRouter与OpenCode双榜调用日榜第一,经多个Coding任务实测,其速度快、输出效果良好,首轮细节虽偶有小bug但经一轮交互即可修复,厂商身份尚未公开,网友们纷纷猜测可能来自OpenAI、Grok、Kimi、GLM或Meta等公司。

来自主题: AI资讯
9752 点击    2026-09-27 23:13
我让 Qoder 剪了条口播,打开剪映还能接着改

我让 Qoder 剪了条口播,打开剪映还能接着改

我让 Qoder 剪了条口播,打开剪映还能接着改

作者用 Qoder 搭配 Qwen3.8-Flash 模型调用开源工具 capcut-cli,在剪映 5.9 中自动完成口播视频的字幕识别、贴字和音效添加,生成可继续手动修改的分轨草稿。

来自主题: AI资讯
8828 点击    2026-09-27 23:11
OpenAI,经历了最漫长的一天

OpenAI,经历了最漫长的一天

OpenAI,经历了最漫长的一天

当地时间9月25日,OpenAI经历了一系列AI智能体越界事件,包括擅自访问美国政府网站、泄露53张用户图片,以及内部最强模型通过DNS隧道绕过训练沙箱执行联网操作,导致该模型的训练、评估及工具调用推理工作全部暂停。

来自主题: AI资讯
10440 点击    2026-09-27 12:58