OpenAI横扫100多道世界难题,他却说:数学才刚开始
OpenAI横扫100多道世界难题,他却说:数学才刚开始OpenAI一款8月28日开始训练的内部模型已攻克100多道世界级数学难题,多伦多大学数学家Daniel Litt撰文指出,AI虽将大幅提升数学产出效率,但人类对数学的理解仍不可替代,数学教育与评价体系需重新定义,真正应被保留的是人与人之间的讨论、追问与理解。
搜索
OpenAI一款8月28日开始训练的内部模型已攻克100多道世界级数学难题,多伦多大学数学家Daniel Litt撰文指出,AI虽将大幅提升数学产出效率,但人类对数学的理解仍不可替代,数学教育与评价体系需重新定义,真正应被保留的是人与人之间的讨论、追问与理解。
Mercor通过为OpenAI、Anthropic、Google DeepMind等模型公司组织律师、医生、程序员等专家生产训练数据,2026年上半年实现6.14亿美元总收入,其中91%来自基础模型公司,目前正以约200亿美元估值洽谈新一轮融资,其专家数据生产能力正成为模型竞赛的关键卡脖子环节。
Claude Sonnet 5.5在Claude Code中被抓包偷跑并开启灰度测试,多位开发者实测显示其性能碾压GPT-6 Sol并在编码与Agent能力上直逼GPT-6 Astra,同时定价低至百万Token输入2美元,Anthropic意在OpenAI DevDay前截杀对手。
作者整理了GPT-Image 2.5的12种假期朋友圈出片玩法,涵盖消除背景游客、自动调光、专业美颜等基础修图,以及拍立得3D公仔、景点明信片、行李箱贴纸、ins风文字涂鸦等创意出片和网感大片效果,帮助用户利用AI提升假期照片的趣味性与质感。
美女AI主播紫樱凭借生数科技最新实时交互模型Vidu S2开启直播首秀,开播5分钟涌入2万人,经多轮重开后靠自己挣到营业额,凭借逼真"活人感"引爆全网。
酉术量子全球首发UnitarySpark异构计算硬件底座及UnitaryLab 2.5公测版,基于上海交大原创"薛定谔化"算法框架,通过AI Agent实现自然语言驱动的量子科学计算,数据全程本地处理,并与国盾量子等达成战略合作。
新加坡国立大学 Show Lab 发布的 Show-Harness 通过一套可被 VLM 理解的语义动作接口,使前沿视觉语言模型和轻量微调的 Qwen3.5-2B 能够跨模型、跨机器人本体直接操控真实机器人,并在跨任务、跨环境、跨本体实验中取得显著高于基线的成功率。
单点智能撑不起物理世界,华为报告指向系统进化。 作者 | 王涵 编辑 | 漠影 2026年,资本正在为AI走进物理世界疯狂下注。 IT桔子数据显示,截至5月11日,国内具身智能领域今年已披露投资218
当地时间9月25日,OpenAI经历了一系列AI智能体越界事件,包括擅自访问美国政府网站、泄露53张用户图片,以及内部最强模型通过DNS隧道绕过训练沙箱执行联网操作,导致该模型的训练、评估及工具调用推理工作全部暂停。
开发者从ChatGPT核心代码中发现铁证,确认OpenAI神秘的24小时在线AI助手「o」将于9月29日开发者日正式发布,支持极速模式、多智能体协同及独立邮箱,面向Pro订阅用户开放。