浅译周报
视频生成模型集中更新
8 月 24 日至 30 日,共收录资讯 11 条。阿里 Wan3.0 全球正式发布,最长 30 秒,可把文档直接转成视频,另有快速变体 Wan3.0 Prime。Google 发布 Gemini Omni 1.1 Flash,支持 40 秒视频和首尾帧双锁定。MiniMax 与 fal.ai 联合发布 H3 Max。ComfyUI 发布 v0.33.4 和 v0.34 系列,接入 Wan 3.0、Meshy-7 Ultra 等模型。Stability AI 完成 7600 万美元 B 轮融资,Pika 推出视频配音模型,Recraft 与 Figma 也有更新。
头条阿里Wan3.0全球正式发布:30秒视频、文档转视频、$0.05–$0.20/秒- 1Gemini Omni 1.1 Flash 发布:40秒视频、首尾帧双锁定、4K分辨率、Draft Mode $0.03/秒Google DeepMind官方
- 2
- 3
- 01视频生成模型4 件
- 02ComfyUI 节点更新2 件
- 03音频与音乐产业2 件
- 04图像、设计与展览3 件
- 05征集与赛展4 项
01视频生成模型
本版导读阿里 Wan3.0 全球发布,最长生成 30 秒视频,PDF、PPT、Word 文档可直接转视频,每秒 0.05 至 0.20 美元;快速变体 Wan3.0 Prime 支持文生视频、图生视频和音频输入。Gemini Omni 1.1 Flash 支持 40 秒视频、首尾帧双锁定和 4K 输出。MiniMax 与 fal.ai 发布 H3 Max,推理速度是 H3 标准版的 35 倍。
阿里巴巴Wan3.0全球发布,支持最长30秒视频生成、PDF/PPT/Word文档直接转视频,定价$0.05–$0.20/秒
原文 ↗Google发布Gemini Omni 1.1 Flash,支持40秒视频生成、首尾帧双重锁定、4K输出及$0.03/秒的Draft快速模式
原文 ↗MiniMax与fal.ai联合发布H3 Max,相比H3标准版实现35倍推理加速,在Design Arena视频质量评测中位列全球第一
原文 ↗阿里Wan3.0 Prime快速变体上线,定价$0.06–$0.30/秒,支持文字转视频、图像转视频及音频驱动视频生成三类任务
原文 ↗02ComfyUI 节点更新
本版导读ComfyUI v0.33.4 新增 Wan 3.0 原生工作流节点、Meshy-7 Ultra 3D 生成节点和字节跳动 vCube 视频增强节点,vCube 可超分到 8K。v0.34 系列集成 Pixal3D 与 TRELLIS2 原生 3D 管线,并接入 Recraft V4、Gemini Omni 1.1 Flash 和 Wan3.0 Prime。
ComfyUI v0.34系列版本集成Pixal3D+TRELLIS2原生3D管线、Recraft V4风格生成、Gemini Omni 1.1 Flash视频及Wan3.0 Prime快速变体
原文 ↗ComfyUI v0.33.4 发布,新增阿里 Wan 3.0 原生工作流节点(30秒/1080p视频+多模态输入)、Meshy-7 Ultra 3D生成节点、字节跳动 vCube 视频增强节点(至8K超分+帧率增强),同时修复若干UI稳定性问题。
原文 ↗03音频与音乐产业
本版导读Stability AI 完成 7600 万美元 B 轮融资,环球音乐、索尼音乐、华纳音乐与游戏公司 EA 联合参投。Pika 推出视频配音模型,先分析画面语义和节奏,再同步生成音效、环境声和音乐,不需要手动对口型或检索素材库。
Stability AI完成$76M B轮融资,环球音乐集团、索尼音乐、华纳音乐及游戏巨头EA联合参投,此轮融资被解读为内容产业对AI公司授权路径的战略背书
原文 ↗Pika推出专属视频配音模型,分析视频画面语义和节奏后同步生成音效、环境声和音乐底层,无需手动对口型或检索素材库
原文 ↗04图像、设计与展览
本版导读Recraft 发布 V4 Styles,可输入 1 至 10 张参考图提取视觉风格,生成风格一致的新图像。Figma 新增可拆卸 AI 对话面板、矢量路径橡皮擦和区域填色。水墨×AI 国际巡展贝尔格莱德站开幕,展出中国当代水墨与 AI 生成技术结合的作品。
Recraft发布V4 Styles功能,支持输入1至10张参考图提取视觉风格,生成与参考图高度一致的新图像
原文 ↗Figma推出可拆卸AI对话面板、矢量路径橡皮擦及区域智能填色三项新功能,进一步整合AI辅助能力至核心设计工作流
原文 ↗05征集与赛展
- 2026 ICIAD 国际文化创新艺术设计奖 ·「AIGC 与计算设计」类别ICIAD Award · 截止 8月31日
- 2026 大学生 AI 艺术季 · AI 影像创作单元(AAIA)北京师范大学艺术与传媒学院(联合主办)等 · 截止 9月1日
- Generative Art 2026 第29届生成艺术国际会议(学术会议)Generative Art International(米兰理工大学发起) · 截止 9月3日
- CHI 2027 国际人机交互会议征稿(学术会议)ACM SIGCHI · 截止 9月10日
- 2026-W38实时视频编辑与开源图像模型
- 2026-W37Sora 关停与剪辑软件插件
- 2026-W36GPT-6 发布与世界模型更新
- 2026-W34版权归因研究与图像接口关停
- 2026-W33开源音乐与视频模型
- 2026-W32视频音频模型与创意软件接入
- 2026-W31视频模型发布与 AI 水印新规
- 2026-W30设计 Agent 与图像模型发布
- 2026-W29WAIC 多模态模型与交互视频
- 2026-W28Meta 图像功能下架与幽灵字体
- 2026-W27图像模型、版权诉讼与视频融资
(本期完)
条目均来自本站已发布资讯,链回原卡片与原始来源;导读与本版导读为编辑汇编,不含评价。全部资讯 →