浅译周报
视频模型升级与 AI 影视合作
6 月 22 日至 28 日,共收录资讯 35 条。火山引擎在 FORCE 大会发布 Seedance 2.5,同场发布 Seedream 5.0 Pro 与 Seed-Audio 1.0。Adobe 宣布收购 Topaz Labs,并在 Creative Cloud 内置 30 多个第三方模型。影视方面,Google DeepMind 与 A24 建立合作并投资约 7500 万美元,华策与 Utopai 宣布全 AI 制作的《西游记:失落的五百年》。Figma Config 2026 发布 Motion 与 Code Layers,OpenAI 开放 GPT-5.6 有限预览。
头条豆包 Seedance 2.5 发布:30 秒原生直出、50 素材联合生成、局部一致性编辑01视频与音频模型
本版导读火山引擎发布 Seedance 2.5,可 30 秒原生单段直出,支持 50 个全模态素材联合生成;同场发布的 Seed-Audio 1.0 可生成人声、音效与 BGM。阿里 HappyHorse 1.1 升级五个维度。FastWan-QAD 开源,单卡 RTX 5090 用 1.8 秒生成 5 秒 480P 视频。一篇分析称国内 AI 视频赛道进入商业化验证阶段。
火山引擎在 FORCE 大会发布 Seedance 2.5,首次实现 30 秒原生单段直出和 50 个全模态素材联合生成,同步发布图像模型 Seedream 5.0 Pro 和音频模型 Seed-Audio 1.0。
原文 ↗字节 Seedance 2.5 与阿里 HappyHorse 1.1 同日亮相,可灵估值下调至 150 亿美元,Sand.ai 融资超亿美元——深度分析认为国内 AI 视频赛道正从「技术炫技」进入「商业化验证」阶段。
原文 ↗Sky Computing Lab 开源 FastWan-QAD 量化感知蒸馏方案,单卡 RTX 5090 端到端 1.8 秒生成 5 秒 480P 视频,较标准版显著降低硬件门槛,模型与代码已完整开源。
原文 ↗字节跳动于 FORCE 大会(6 月 23 日)发布 Seed-Audio 1.0,支持零样本多模态参考生成人声、音效与 BGM 全要素,可输出多角色对白与拟音,单次时长达 2 分钟并可延伸至数十分钟。
原文 ↗阿里 HappyHorse 1.1 版本升级动态表现力、9 图角色一致性、复杂场景指令、视觉质感和音频口播五个维度,同步宣布启动 Horsepower AI 影像大赛(张纪中评委)。
原文 ↗02设计软件动态
本版导读Adobe 宣布收购 Topaz Labs,Astra 与 Wonder 模型将整合进 Firefly;Creative Cloud 全系内置 30 多个第三方模型。Figma Config 2026 发布原生动效时间轴 Motion 与双向同步的 Code Layers。字节 TRAE 推出 Work Design 模式。
Adobe 宣布收购曾获艾美奖的 AI 图像与视频增强公司 Topaz Labs,其旗舰模型 Astra(视频超分)与 Wonder(图像增强)将整合进 Firefly 及 CC 全系产品;Neurostream 技术可在消费级设备本地运行大型 AI 模型;交易预计 2026 年下半年完成,Topaz 现有工具同期保持独立可用。
原文 ↗Figma Config 2026 发布三项核心更新:画布内原生动效时间轴 Figma Motion(含 AI Agent 生成动效,当日 Open Beta)、设计与代码双向同步的 Code Layers,以及接入 Notion / Slack / GitHub 等 14+ 工具的 Design Agent MCP Connectors。
原文 ↗Adobe 将 30+ 第三方行业模型内置进 Creative Cloud 全系(Firefly / Express / Photoshop / Illustrator 等),含 Kling 3.0、Veo 3.1、FLUX.2、Runway Gen-4.5、Luma、ElevenLabs 等,现有 CC 订阅即可调用、无需额外付费。
原文 ↗Adobe CC 6 月 23 日周次更新:Photoshop 生成填充新增 FLUX Kontext 和 Google Gemini 作为可选伴侣模型,Generative Upscale 新增 Topaz Gigapixel 选项,After Effects AI 转描工具同步重构。
原文 ↗Taste Skill 在 GitHub 获 51K 星,通过布局、排版、动效规则库为 AI 编程工具提供设计规范约束,旨在解决 Vibe Coding 同质化「AI 味」问题,提升 AI 辅助生成界面的视觉品质。
原文 ↗字节 TRAE 推出 Work Design 模式,可精准识别设计系统组件库,输入需求后自动生成 UI 设计稿并同步转代码,覆盖从设计到开发的完整工作流。
原文 ↗AI工坊pro 发布 2026 年 AI 设计工具全收录,按图像、视频、3D、UI 等使用场景分类整理,覆盖当前主流工具生态。
原文 ↗03AI 影视与广告
本版导读Google DeepMind 与 A24 建立 AI 研究合作并投资约 7500 万美元,是 Google 首次持股电影公司。华策影视与 Utopai 宣布用 PAI 平台全流程制作《西游记:失落的五百年》。可口可乐中国世界杯 TVC 的 5 人 5 城场景全由 Prompt 生成。腾讯视频披露火龙漫剧 5 个月产出 7 万部。
Google DeepMind 宣布与独立电影公司 A24 建立 AI 研究合作并投资约 7500 万美元,DeepMind 研究员将与 A24 主创并肩开发 AI 分镜与工作流工具,这是 Google 首次持股电影公司。
原文 ↗华策影视与 Utopai Studios 联合宣布《西游记:失落的五百年》,采用 Utopai 第二代 PAI 平台全流程制作,被定位为全球首部工业级全 AI 中国经典 IP 动画剧集,第一季定向全球流媒体与广播发行。
原文 ↗可口可乐中国 2026 世界杯限定版 TVC 5 人 5 城场景全由 Prompt 生成(操盘方百度一镜),范志毅数字人实现 2 秒端到端实时互动,是顶级国际品牌世界杯广告预算被 AI 替代的直接落地案例。
原文 ↗腾讯视频发布 WorkRally 全链路 AI 内容生产平台,并披露火龙漫剧平台运营数据:5 个月产出 7 万部,40 万成本作品获 2000 万分账;提出「5–20 人 AI 创作小队」为 AI 时代主流生产力单元。
原文 ↗04图像、3D 与大模型
本版导读影眸发布 Hyper3D Rodin Gen-2.5,支持 12K 原生贴图。Krea 开源 12B 图像模型 Krea 2,ComfyUI v0.26.0 当日接入。字节发布 Seedream 5.0 Pro 与豆包 2.1 Pro,Midjourney 开放 V8.2 预览。OpenAI 推出 GPT-5.6 Sol、Terra、Luna 三档模型的有限预览。
影眸科技发布 Hyper3D Rodin Gen-2.5 并完成数亿元融资,首创五档思考深度机制(约 4–80 秒),支持千万面级几何、12K 原生贴图、3D ControlNet、自然语言局部编辑与递归分件,Unity/Blender/Unreal 等 DCC 全面接入。
原文 ↗ComfyUI v0.26.0 在单次版本更新中同时接入 Krea 2(12B DiT 开源图像模型,含 Raw/Turbo 两版)、Boogu-Image(Qwen3-VL-8B 编码器)、Qwen3-VL(4B/8B),并新增 Load3DAdvanced 3D 节点与 LTX2 视频上下文采样支持,工作流模板升至 0.9.26。
原文 ↗OpenAI 推出 GPT-5.6 三款模型的有限预览:Sol(旗舰)、Terra(均衡)、Luna(轻量),约 20 个组织受邀,Sol 已登顶 LMSYS 排行,预计数周内全量开放。
原文 ↗字节跳动发布豆包 2.1 Pro,Coding 与 Agent 能力较前代显著提升、对标旗舰级模型,并在多模态视觉理解评测集上保持领先,可作为设计与创作场景的多模态工作底座。
原文 ↗Midjourney V8.2 预览版可通过 --preview 参数提前体验,主要强化非 V7 审美风格路线、提升 Sref 风格板一致性;目前尚在开发阶段,表现不保证稳定,与 V8.1 Draft Mode 并行可用。
原文 ↗Krea 发布 Krea 2 技术报告,推出 Raw(LoRA 微调基座)与 Turbo(8 步推理,约 2 秒生成)两个开放权重变体,明确训练数据中不使用 AI 生成图像,采用商业友好许可,ComfyUI v0.26.0 于发布当日接入。
原文 ↗字节跳动于 FORCE 大会(6 月 23 日)发布 Seeddream 5.0 Pro,新增箭头/圈选直接标注的交互式精准编辑、多图层分离输出(可直接对接 PSD 工作流)及 10 余种语言原生文字生成,与 Seedance 2.5 构成图像→视频完整工业化链路。
原文 ↗05研究与方法
本版导读多人提出「Loop Engineering」,主张从调单次提示词转向设计以 AI 为引擎的循环工作结构。Kyutai 与 UC Berkeley 的预印本质疑 FID 指标的可靠性;ICML 2026 一篇 Spotlight 论文指出审美对齐会削弱生成图像的多样性。阿里 Qwen-Image-2.0-RL 用强化学习把文生图 Elo 提升 78 分。PQSG 基准评估视频模型的物理一致性。
Peter Steinberger、Addy Osmani(Google Cloud)命名,黄仁勋、Karpathy、Claude Code 作者 Boris Cherny 等多人呼应——「Loop Engineering」主张从调单次提示词转向设计以 AI 为引擎的持续循环工作结构,被认为是 Prompt Engineering 的范式接班。
原文 ↗Kyutai 与 UC Berkeley 联合预印本(arXiv:2606.20536)对 AI 图像生成常用评测指标 FID 的可靠性提出系统性质疑,指出不同评测环境下结论相互矛盾,「最强」排名可能依赖了一个有缺陷的指标。
原文 ↗WAIC 2026(7 月 17–20 日,上海)发布 SAIL 奖 TOP30 及青年优秀论文 TOP20,计算机视觉、具身智能、AI 创作方向均有入围,首次自举办顶级学术分会 WAIC Academic。
原文 ↗ICML 2026 Spotlight 论文指出,HPS 等 AI 图像审美评分系统的对齐机制正在削弱生成图像的艺术多样性,越符合评分标准的图像越缺乏表现力
原文 ↗阿里 Qwen 团队发布 Qwen-Image-2.0-RL(arXiv:2606.27608),通过 GRPO 强化学习与在线策略蒸馏设计图文对齐、美感、肖像三类奖励模型,文生图 Elo 从 1115 升至 1193(+78),图像编辑 Elo 从 1256 升至 1349(+93)。
原文 ↗北卡罗来纳大学、Johns Hopkins、AI2 与德克萨斯大学奥斯汀联合发布 PQSG 评估体系(arXiv:2606.25306),首次系统评估 AI 视频生成模型的物理一致性,覆盖刚体动力学、流体模拟、软体变形,揭示主流视频模型的系统性物理短板。
原文 ↗香港城市大学、斯坦福、康奈尔科技学院、德州大学奥斯汀联合研究,实现 AI 在秒级时间内生成高精度数字浮雕,相关成果已投递 SIGGRAPH 2026;目前为单一来源报道。
原文 ↗SIGGRAPH 2026 Art Papers 录用名单已公布,主题为「The Creative Complexities of Translation」,入选论文发表于 PACMCGIT 特刊,覆盖艺术×科学×技术交叉研究,有别于早先公布的 Art Gallery 入选;大会于 7 月 19–23 日在洛杉矶举行。
原文 ↗06艺术展览与教育
本版导读第十届米兰设计周中国高校展颁奖,同期举办「AI + 艺术设计教育」教学创新论坛。2026 中韩 AI 艺术作品国际邀请展在河北美术学院开幕,展出 327 件作品。中央美术学院 2026 年本科毕业展收官,8 个院系作品涵盖数码媒体方向。同济大学新增艺术设计学与人工智能双学位项目。
第十届米兰设计周中国高校设计学科师生优秀作品展颁奖典礼与「AI + 艺术设计教育」教学创新论坛同期举办,聚焦 AI 赋能艺术设计教学改革,与高校教师受众直接相关。
原文 ↗2026 中韩 AI 艺术作品国际邀请展于 2026-06-25 在河北美术学院开幕,河北美院联合韩国空间设计学会、弘益大学 MR 媒体实验室主办,展出中韩等多国艺术家 327 件 AI 艺术作品,涵盖 AI 生成、沉浸式空间设计与数字媒体艺术。
原文 ↗中央美术学院 2026 年本科毕业展于 6 月 22 日收官,8 个院系作品涵盖数码媒体、空间装置等方向,AI 辅助创作引发广泛关注。
原文 ↗同济大学正式新增艺术设计学与人工智能双学位复合型人才培养项目,是国内顶尖工科高校在 AI 与艺术设计交叉培养方向的明确战略信号。
原文 ↗07征集与赛展
- CAADRIA 2027 第32届国际会议征稿(学术会议)亚洲计算机辅助建筑设计研究学会(CAADRIA) · 截止 7月27日
- 2026 广西数智艺术与实验艺术作品展览征稿广西壮族自治区党委宣传部 + 广西文学艺术界联合会 · 截止 8月15日
- 2026 大学生 AI 艺术季 · AI 影像创作单元(AAIA)北京师范大学艺术与传媒学院(联合主办)等 · 截止 9月1日
- 第二届「复新」全球大学生智能影像创作大赛复旦大学新闻学院 · 截止 9月20日
- Architectural Intelligence 专刊 · Urban Intelligence(期刊征稿)Springer Nature × 同济大学 · 截止 10月31日
- Architectural Intelligence 专刊 · Generative Urbanisms(期刊征稿)Springer Nature × 同济大学 · 截止 11月30日
08SKILL
- anthropics/skills:Anthropic 官方 skill 合集★ 178847
- baoyu-design:本地版「Claude Design」★ 4211
- chubbyskills:中文多平台内容采集 skill 套件★ 1149
- levnikolaevich/claude-code-skills:全生命周期开发 skill 套件★ 566
- guizang-social-card:小红书图文 + 公众号封面出图 skill★ 7293
- humanize-ppt:AST 化 PPT 提纲编排 skill★ 959
- hv-analysis:横纵分析法深度长文 skill★ 20990
- khazix-writer:模仿卡兹克文风的写作规范 skill★ 20990
- md2wechat:Markdown 转公众号 HTML skill★ 3674
- trailofbits/skills:安全分析 skill 合集★ 7281
- wewrite:公众号文章全流程 skill★ 3369
- XiaohongshuSkills:基于 Chrome CDP 的小红书自动化 skill★ 3466
- 2026-W38实时视频编辑与开源图像模型
- 2026-W37Sora 关停与剪辑软件插件
- 2026-W36GPT-6 发布与世界模型更新
- 2026-W35视频生成模型集中更新
- 2026-W34版权归因研究与图像接口关停
- 2026-W33开源音乐与视频模型
- 2026-W32视频音频模型与创意软件接入
- 2026-W31视频模型发布与 AI 水印新规
- 2026-W30设计 Agent 与图像模型发布
- 2026-W29WAIC 多模态模型与交互视频
- 2026-W28Meta 图像功能下架与幽灵字体
- 2026-W27图像模型、版权诉讼与视频融资
(本期完)
条目均来自本站已发布资讯,链回原卡片与原始来源;导读与本版导读为编辑汇编,不含评价。全部资讯 →