刚刚,我们用千问创作做了一部「JoJo的奇幻买瓜」
刚刚,我们用千问创作做了一部「JoJo的奇幻买瓜」阿里千问创作平台上线 Wan 3.0 视频生成模型及 Agent Teams 多智能体协作模式,用户输入剧本与一句话提示词即可由编剧、导演、美术、分镜师、配乐师等 Agent 自动接力完成影视短剧制作,文章以"华强买瓜"剧本配合《JoJo的奇妙冒险》风格进行实测,展示了从需求拆解、角色资产生成、镜头提示词确认到视频拼接与片段迭代修改的完整流程。
搜索
阿里千问创作平台上线 Wan 3.0 视频生成模型及 Agent Teams 多智能体协作模式,用户输入剧本与一句话提示词即可由编剧、导演、美术、分镜师、配乐师等 Agent 自动接力完成影视短剧制作,文章以"华强买瓜"剧本配合《JoJo的奇妙冒险》风格进行实测,展示了从需求拆解、角色资产生成、镜头提示词确认到视频拼接与片段迭代修改的完整流程。
群核科技发布3D生成模型Lux3D,最快20秒即可批量生成带PBR材质的3D资产,并同步内测世界模型产品,以显式3D路线打造可交互数字空间的底层能力。
8 月 26 日,群核科技正式发布了 AI 3D 生成模型 Lux3D。它提供标准版、极速版和渲染器能力,还能通过 API、插件接入 Codex、WorkBuddy 等 Agent 及主流设计工作流。
过去几年,视频生成模型在清晰度、运动表现和画面质感上不断进步。输入一句文字,模型已经能够生成颇具电影感的视频。
今天的视频生成模型,已经越来越像一个会拍电影的导演。
图像生成模型正从「会创作」转向「可操作」。
太卷了!过去两年,视频生成模型把画面参数几乎卷了个遍。
这两天,Arena 平台上突然出现一款神秘的图像生成模型,代号「mona-lisa-1」。有人让该模型「生成一张你的创造者的图片」,模型点名 OpenAI 和奥特曼。且有网友用 OpenAI 验证工具检测生成图片后,确认图片中带有 OpenAI 的 SynthID 水印。
只做一次生成器前向,就能得到一张图,这是一步生成追求的效率。但想把采样步数降到 1,难题其实在训练端:怎样用足够稳定、简单的监督信号,让生成分布靠近真实分布?
近日,浙江大学 OmniAI 团队在 《Show, Don’t Tell: Evaluating Spatial Cognition in Generative Pixels Rather Than LLM Text》 中提出 ProVisE,让图像生成模型直接在图中回答空间问题,并将视觉答案还原为原 benchmark 可以评分的结构化预测。