浅译快报
2026 年 6 月 29 日 — 7 月 5 日AI × 艺术设计 · 每周综述每周一出刊

浅译周报

浅译快报 · TRANSWONDER.TOP
第 5 期 272026 年第 27 周06.29 — 07.05
23件大事71个来源16件一手23条精选7天有更新
本期导读

图像模型、版权诉讼与视频融资

6 月 29 日至 7 月 5 日,共收录资讯 23 条。Google DeepMind 发布 Nano Banana 2 Lite 与 Gemini Omni Flash,Veo 3.1 新增 9:16 竖版输出。生数科技发布实时互动数字角色模型 Vidu S1。Midjourney 向法院申请强制迪士尼等公司披露自身 AI 使用情况。可灵 AI 完成近 30 亿美元独立融资。广电总局要求 AI 生成微短剧每集加标识,7 月 1 日起施行。Apple 更新 Creator Studio,Anthropic 发布 Claude Sonnet 5。

头条Google Nano Banana 2 Lite + Gemini Omni Flash:4 秒出图、质量反超 Pro 档,静态图一键带运镜

01图像与视频模型

本版导读Nano Banana 2 Lite 约 4 秒出图,每张 1K 分辨率图约 $0.034;同日发布的 Gemini Omni Flash 可把静态图转为带运镜的视频。Vidu S1 用一张照片加实时语音生成可互动的数字角色,模型侧延迟约 200ms。Veo 3.1 新增 9:16 竖版与 4K 超分。Wan-Streamer v0.1 提出实时音视频流数字人框架。

GGoogle DeepMind一手06.30
Google Nano Banana 2 Lite + Gemini Omni Flash:4 秒出图、质量反超 Pro 档,静态图一键带运镜

Google DeepMind 于 2026-06-30 同步发布 Nano Banana 2 Lite 图像模型(约 4 秒出图、每张 1K 分辨率图约 $0.034)与 Gemini Omni Flash 静态图转带运镜视频模型;两款均已接入 Adobe Firefly 与 Google Stitch 生态。

原文 ↗
PPR Newswire一手07.03
Vidu S1:一张照片 + 实时语音生成可持续互动的 AI 数字角色,AI 视频进入实时对话范式

生数科技发布 Vidu S1:一张照片 + 实时语音即可生成可持续互动的 AI 数字角色,540P/25FPS 全双工交互,AR+扩散混合架构,模型侧延迟约 200ms

原文 ↗
GGoogle 官方一手07.01
Google Veo 3.1 重大更新:原生 9:16 竖版输出、1080p-4K 超分、跨场景角色一致性提升

Google Veo 3.1 新增原生 9:16 竖版视频输出、1080p-4K 超分辨率及跨场景角色一致性能力,已上线 Gemini App、YouTube Shorts、Gemini API 等平台

原文 ↗
aarXiv一手07.04
Wan-Streamer v0.1:首个端到端实时音视频流数字人框架,arXiv 提前公开

Wan-Streamer v0.1 提出端到端实时音视频流数字人生成框架,论文 arXiv:2606.25041 提前公开,覆盖音频驱动唇形同步与实时视频流输出全链路

原文 ↗

02版权、监管与融资

本版导读Midjourney 以「双重标准」为由,申请法院强制迪士尼、环球、华纳兄弟披露其自身 AI 使用情况。广电总局微短剧分类分层标准 7 月 1 日施行,AI 生成的微短剧须每集加提示标识。可灵 AI 完成近 30 亿美元独立融资,腾讯、阿里、百度联合领投;VAST AI 完成超 10 亿元 A3 轮融资。

新新浪财经07.03
可灵 AI 独立融资近 30 亿美元:腾讯/阿里/百度联合领投,全球 AI 视频最大单笔融资纪录

快手旗下可灵 AI 完成独立融资近 30 亿美元(约 196 亿元),腾讯/阿里/百度历史性联合领投,刷新全球 AI 视频模型最大单笔融资纪录

原文 ↗
央央视网06.29
广电总局微短剧分类分层标准 7 月 1 日施行:AI 生成微短剧须每集加标识

广电总局发布微短剧分类分层管理标准,按投资额与题材分三类实行备案与发行许可,并要求 AI 生成、制作的微短剧在每集明显位置添加提示标识,自 2026 年 7 月 1 日起施行。

原文 ↗
投投资界07.02
VAST AI Tripo 完成超 10 亿元 A3 轮融资,4399/贪玩/巨人网络等产业方参投

VAST AI 完成超 10 亿元 A3 轮融资,游戏产业方参投,Tripo 3D 大模型加速游戏/影视/工业设计商业化落地

原文 ↗

03生成与图形学研究

本版导读港科广、美团等开源 GenEvolve,让图像生成由 Agent 自主编排工具调用。美团开源海报生成、编辑与评判三项工作。ICML 2026 杰出论文奖由两篇扩散模型论文获得。SIGGRAPH 2026 公布技术论文最佳奖,CMU 平面映射算法获奖;Google DeepMind 的 AI 辅助油画风短片入选计算机动画节。

机机器之心一手07.01
GenEvolve:自进化图像生成 Agent 开源,工具编排轨迹替代单步提示词

GenEvolve 将图像生成从『一句话提示词』升级为 Agent 自主编排工具调用轨迹,港科广+美团+港科大+新加坡国立联合开源

原文 ↗
美美团技术团队一手06.29
美团开源 AIGC 海报体系 PosterCraft/PosterOmni/PosterReward:「生成—编辑—评判」闭环

美团开源覆盖生成、编辑、评判全链路的 AIGC 海报技术体系,含 PosterCraft、PosterOmni、PosterReward 三项工作(分别入选 ICLR/CVPR 2026),并已在真实业务落地。

原文 ↗
IICML 官方一手07.05
ICML 2026 杰出论文揭晓:清华扩散语言模型与 MIT/耶鲁采样算法同获大奖

ICML 2026 两篇扩散模型论文同获杰出论文奖:清华黄高团队 JustGRPO(GSM8K 89.1%)与 MIT/耶鲁高精度采样算法;英伟达 Motive 获荣誉提名

原文 ↗
搜搜狐一手07.04
SIGGRAPH 2026 技术论文 5 大设计方向:3D 感知/身体交互/AI 产品化/虚实融合/设计工具

从 SIGGRAPH 2026 技术论文提炼 5 大设计前沿方向:3D 空间感知、身体与情境交互、AI 产品化、虚实融合、设计工具,覆盖从感知到工具的完整链路

原文 ↗
SSIGGRAPH 2026 官方一手06.30
SIGGRAPH 2026 技术论文最佳奖:CMU 平面映射算法 3D 矢量化速度提升数量级,7 月洛杉矶举行

SIGGRAPH 2026 于 2026-06-30 公布技术论文最佳奖:CMU 平面映射算法获最佳论文(3D 矢量化速度提升数个数量级),慕尼黑工大时空流体仿真获荣誉提名;大会 7 月 19–23 日在洛杉矶举行(第 53 届)。

原文 ↗
SSIGGRAPH 2026 官方一手07.02
SIGGRAPH 2026 计算机动画节:Google DeepMind AI 辅助油画风动画短片《Dear Upstairs Neighbors》入选

SIGGRAPH 2026 计算机动画节入选 Google DeepMind 团队 AI 辅助油画风动画短片,艺术家全程主导 + AI 协同创作模式获学院奖认证节展认可

原文 ↗
新新智元07.03
中科大等联合综述 500+ 篇文献:扩散模型的「生成一致性危机」三类框架与开源评测

中科大+清华+剑桥等机构联合综述 500+ 篇论文,系统分析扩散模型『生成一致性危机』,提出外部/内部/规范三类一致性框架

原文 ↗

04创作工具与平台

本版导读Apple 免费更新 Creator Studio,Final Cut Pro 新增端侧 AI 自动遮罩与自动字幕。Agnes AI 发布 Pavo 平台,可把一句话拆成剧本、分镜直至成片,自研模型 API 永久免费。Google Labs 开源 DESIGN.md,为 AI 编码工具描述设计系统。ComfyUI v0.27.0 支持 Int8 量化,Runway 推出 Agent Skills。

AApple Newsroom一手06.30
Apple Creator Studio 重大更新:Final Cut Pro 端侧 AI 自动遮罩与字幕,Pixelmator Pro 跨应用打通

Apple 于 2026-06-30 免费更新 Creator Studio:Final Cut Pro 新增端侧 AI 的 Auto Mask(自动分离皮肤/头发/天空等)、Generate Subtitles(自动字幕转录)、Edit Detection(从成品还原原始片段);Pixelmator Pro 与 FCP/Keynote/Pages/Numbers 跨应用实时同步编辑。

原文 ↗
量量子位06.30
Agnes AI 发布 Pavo 创作平台:一句话拆剧本到成片,全模态自研模型 API 永久免费

Agnes AI 发布 PC 端创作平台 Pavo,用智能路由把「一句话」自动拆成剧本、角色设计、分镜直至成片;其自研文本/图像/视频全模态模型 API 自 6 月起永久免费、不限量,在烧钱的 AI 短剧赛道以「免费」切入。

原文 ↗
GGoogle Labs一手06.29
Google Labs 开源 DESIGN.md:给 AI 编码智能体一份「看得懂」的设计系统说明

Google Labs 开源 DESIGN.md 格式规范,用 YAML 设计 token + Markdown 说明的双层结构,让 Claude Code、Cursor 等 AI 编码智能体持久、结构化地理解并遵循一套设计系统。

原文 ↗
GGitHub一手06.30
ComfyUI v0.27.0:Int8 量化模型支持,VRAM 降低约 40%、推理速度提升约 40%

ComfyUI v0.27.0 正式支持 Int8 量化模型,VRAM 需求降低约 40%、推理速度提升约 40%,适用于 Turing 及以上 GPU 架构

原文 ↗
RRunway 官方 changelog一手07.02
Runway 推出 Agent Skills:命令驱动 AI 代理接管完整广告活动与商业视频全流程

Runway 推出 Agent Skills(7/2),支持用简单命令构建完整广告活动与商业视频,AI 代理接管从概念到成片的全流程

原文 ↗

05大语言模型

本版导读Claude Fable 5 与 Mythos 5 于 7 月 1 日在全球恢复访问,此前因美国出口管制中断 19 天。Anthropic 于 6 月 30 日发布 Claude Sonnet 5,成为 Free 与 Pro 用户的默认模型,入门定价为每百万 Token $2/$10。DeepSeek 宣布 V4 将于 7 月中旬上线,并引入峰谷定价,高峰时段 API 价格翻倍。

AAnthropic一手07.01
Claude Fable 5 全球重新上线:19 天出口管制停摆后美国解除限制

Claude Fable 5 与 Mythos 5 于 2026-07-01 在 Claude.ai、Claude Code 及 API 全球恢复访问,此前因美国出口管制中断 19 天(6/12–7/1);配套新安全分类器拦截率 >99%,7/7 前 Pro/Max/Team 用户可用 50% 额度。

原文 ↗
AAnthropic 官方一手06.30
Anthropic 发布 Claude Sonnet 5:Agentic 场景最强 Sonnet,成为 Free/Pro 默认模型

Anthropic 于 6 月 30 日发布 Claude Sonnet 5,定位 Agentic 场景,性能接近旗舰 Opus 级,成为 Claude Free/Pro 用户默认模型;入门定价 $2/$10 每百万 Token(至 2026 年 8 月底),与 GPT-5.6 同日形成正面竞争格局。

原文 ↗
界界面新闻06.29
DeepSeek V4 官宣 7 月中旬上线,首次引入峰谷动态定价机制

DeepSeek 宣布 V4 版本 7 月中旬上线,将引入峰谷定价机制,高峰时段 API 价格翻倍

原文 ↗

06征集与赛展

往期周报

(本期完)

条目均来自本站已发布资讯,链回原卡片与原始来源;导读与本版导读为编辑汇编,不含评价。全部资讯 →