AI资讯新闻榜单内容搜索-Fill

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Fill
GPT-6 Astra的隐藏推理,丹麦团队用tool calling撬出来了

GPT-6 Astra的隐藏推理,丹麦团队用tool calling撬出来了

GPT-6 Astra的隐藏推理,丹麦团队用tool calling撬出来了

丹麦奥尔堡大学AI安全实验室与Seafill开源社区联合发表论文,通过tool calling方法从GPT-6 Astra等前沿闭源模型中提取出隐藏思维链,发现Astra采用类似"心算"的压缩推理方式,省略基础计算与代数变形等中间步骤而直接给出关键结论。

来自主题: AI技术研报
8102 点击    2026-09-30 11:09
DeepSeek V4.1 Flash用了哪些黑科技?竟让Flash(差点)逼退Pro

DeepSeek V4.1 Flash用了哪些黑科技?竟让Flash(差点)逼退Pro

DeepSeek V4.1 Flash用了哪些黑科技?竟让Flash(差点)逼退Pro

DeepSeek V4.1 Flash技术报告揭秘其通过CED架构对半削减prefill计算、CSA2同时吃满条目/序列/层三个压缩维度、FP4量化main KV缓存及SWA Bounded Replay部署优化等手段,将全局KV缓存压至V4-Flash的1/4、持久化KV压至约1/8,以552B参数实现超越1.6T参数V4 Pro的性能。

来自主题: AI资讯
8447 点击    2026-09-12 19:26
AI不缺算力,缺的是一块“懂模型”的硬盘

AI不缺算力,缺的是一块“懂模型”的硬盘

AI不缺算力,缺的是一块“懂模型”的硬盘

寅谱试图用一种“以存换算”的思路破题:不是让硬盘SSD替代GPU计算,而是用更低成本的SSD承接温冷(指访问频率极低和中等)的AI大模型数据、复用已经完成的中间结果,减少显存及内存压力、GPU等待和重复Prefill(预填充)。

来自主题: AI资讯
8714 点击    2026-08-30 12:05
普通网线也能跑万亿大模型!月之暗面抛出王炸架构,亲证:不用全买 H100!1T模型实测:延迟暴降64%!大模型推理“围城”攻破了!

普通网线也能跑万亿大模型!月之暗面抛出王炸架构,亲证:不用全买 H100!1T模型实测:延迟暴降64%!大模型推理“围城”攻破了!

普通网线也能跑万亿大模型!月之暗面抛出王炸架构,亲证:不用全买 H100!1T模型实测:延迟暴降64%!大模型推理“围城”攻破了!

在 AI 工程界,长文本推理一直是个“富贵病”。

来自主题: AI技术研报
9242 点击    2026-04-21 16:16
Kimi新论文:把KVCache玩成新商业模式了

Kimi新论文:把KVCache玩成新商业模式了

Kimi新论文:把KVCache玩成新商业模式了

把长上下文做到极致的Kimi又发新成果!

来自主题: AI技术研报
8072 点击    2026-04-20 09:46
MIT韩松团队长上下文LLM推理高效框架DuoAttention:单GPU实现330万Token上下文推理

MIT韩松团队长上下文LLM推理高效框架DuoAttention:单GPU实现330万Token上下文推理

MIT韩松团队长上下文LLM推理高效框架DuoAttention:单GPU实现330万Token上下文推理

TL;DR:DuoAttention 通过将大语言模型的注意力头分为检索头(Retrieval Heads,需要完整 KV 缓存)和流式头(Streaming Heads,只需固定量 KV 缓存),大幅提升了长上下文推理的效率,显著减少内存消耗、同时提高解码(Decoding)和预填充(Pre-filling)速度,同时在长短上下文任务中保持了准确率。

来自主题: AI技术研报
5910 点击    2024-10-24 11:33
Adobe正在开发AI视频处理技术

Adobe正在开发AI视频处理技术

Adobe正在开发AI视频处理技术

Adobe公开了“Project Fast Fill”功能,这是一种使用生成式人工智能,通过文本提示互动的方式,可以在视频中移除人物、添加物体以及替换颜色的功能

来自主题: AI资讯
8770 点击    2023-10-13 14:41