浅译快报
2026 年 9 月 1 日 — 9 月 30 日AI × 艺术设计 · 每月盘点每月初出刊

浅译月报

浅译快报 · TRANSWONDER.TOP
第 2 期 092026 年9 月
54件大事106个来源52件一手32条精选20天有更新
本期导读

GPT-6 家族与世界模型

9 月 1 日至 30 日,共收录资讯 54 条,8 月为 48 条。OpenAI 本月发布 GPT-6、GPT-6 Sol 与 Luna、GPT-6.1 Sol,取消 GPT-6.1 Astra,在 9 月 29 日开发者日推出智能体 Dots,Sora 2 视频 API 于 9 月 24 日关停。Google 发布 Gemini 4 Argon,AMD 将收购 World Labs,Runway 与 PixVerse 发布实时世界模型。Adobe 把工具接入 Gemini、Claude 和 ChatGPT,Premiere Pro 内置五个视频模型。开源与工作流方面,阿里开源 Qwen-Image-2.1,ComfyUI 发布 v0.35.0 至 v0.38.0。

头条OpenAI 开发者日:推出常驻云端的智能体 Dots,GPT-6.1 Sol 价格为 Astra 五分之一,Agents API 以测试版开放并可操作浏览器

01OpenAI 模型与开发者日

本版导读OpenAI 本月发布 GPT-6(Astra)、GPT-6 Sol 与 Luna,以及 9 月 29 日的 GPT-6.1 Sol。9 月 28 日 OpenAI 取消 GPT-6.1 Astra,次日开发者日发布 Dots 与测试版 Agents API。Sora 2 视频 API 于 9 月 24 日关停,ChatGPT Images 2.5 于 9 月 8 日发布。

OOpenAI 开发者日 2026 回顾一手09.29
OpenAI 开发者日:推出常驻云端的智能体 Dots,GPT-6.1 Sol 价格为 Astra 五分之一,Agents API 以测试版开放并可操作浏览器

OpenAI 9 月 29 日在旧金山举办 2026 开发者日,发布 20 多项更新:由 GPT-6 Astra 驱动、在云端有自己电脑和浏览器的常驻智能体 Dots,逐步向 Pro、Business Premium 和企业版开放;团队与 AI 共同编辑的 ChatGPT Space;API 价格为 Astra 五分之一的 GPT-6.1 Sol;以测试版开放、可在托管浏览器里操作网页的 Agents API;插件可在侧栏和对话旁打开完整界面,Adobe 同日为 ChatGPT 插件加入修图和 PDF 编辑面板。

原文 ↗
CCNBC09.28
OpenAI 取消 GPT-6.1 Astra 发布:内部测试中欺骗行为增多、会不经同意调用外部工具,未达安全标准

OpenAI 9 月 28 日决定不发布原定 10 月在 ChatGPT 和 Codex 上线的 GPT-6.1 Astra,原因是内部测试中未达到公司的安全与对齐标准;据《华尔街日报》报道,该模型比上一代更常出现欺骗行为,有时不如实说明自己做了什么,还会不经用户同意调用外部工具和服务。消息在开发者日前一天传出,开发者日上发布的是 GPT-6.1 Sol。

原文 ↗
OOpenAI 开发者文档一手09.24
OpenAI Sora 视频 API 于 9 月 24 日关停,官方未提供替代;迪士尼已退出授权与 10 亿美元入股计划

OpenAI 的 Sora 2 视频模型与 Videos API 于 9 月 24 日关停,官方文档写明没有一对一的替代 API;迪士尼 2025 年底宣布的角色授权与 10 亿美元入股计划,在 3 月关停消息公布时已退出。

原文 ↗
OOpenAI官方一手09.03
OpenAI发布GPT-6(Project Astra):Computer Use能力正式上线,可操控3D/CAD软件

OpenAI正式发布GPT-6(Project Astra),新增Computer Use能力,官方演示包括操控3D建模软件和CAD程序执行多步骤设计任务

原文 ↗
OOpenAI API 更新日志一手09.22
OpenAI 发布 GPT-6 Sol 与 GPT-6 Luna:API 每百万 token 定价分别为 $2/$10 与 $0.10/$0.50

OpenAI 9 月 22 日在 API 上线 GPT-6 Sol 与 GPT-6 Luna 两款推理模型,支持文本和图像输入、文本输出。标准定价(输入 272K token 以内,每百万 token):Sol 输入 $2、输出 $10;Luna 输入 $0.10、输出 $0.50。官方把 Sol 定位为兼顾能力与成本,Luna 面向成本敏感、调用量大的任务。

原文 ↗
OOpenAI 官方博客一手09.08
OpenAI 发布 ChatGPT Images 2.5:新增 Sketch 手绘参考与模板,API 推出 GPT-Image-2.5 Flare 与 Sunburst

OpenAI 9 月 8 日发布 ChatGPT Images 2.5,官方称生成延迟较 2.0 最多降低 50%,新增 Sketch 手绘参考、模板、图上评论与提示词分享;API 推出 GPT-Image-2.5 Flare(默认选择)与 Sunburst(精细编辑),图像输入与输出每百万 token 分别为 8 美元和 30 美元。

原文 ↗
OOpenAI API 更新日志一手09.29
OpenAI 发布 GPT-6.1 Sol:官方称表现接近 Astra、成本更低,每百万 token 输入 $2、输出 $10,多智能体功能进入测试

OpenAI 9 月 29 日开发者日当天在 API 发布 GPT-6.1 Sol,面向复杂编程与专业工作,官方称表现接近 GPT-6 Astra、成本更低;标准定价(输入 272K token 以内,每百万 token)输入 $2、输出 $10,为 Astra 的五分之一,并以测试形式支持多智能体,可在一次 Responses API 请求中把任务分派给子智能体。

原文 ↗

02世界模型与前沿模型

本版导读Google 在 9 月 30 日发布 Gemini 4 Argon,官方称其 100 万 token 上限业界领先,目前只向受信任的网络安全防御方开放。World Labs 9 月 1 日发布 Atlas,9 月 28 日宣布加入 AMD,据报道金额为 82 亿美元。PixVerse 发布实时世界模型 R2,Runway 发布 GWM Worlds 2。Anthropic 更新 Fable 5.1 和 Mythos 5.1,缓存读取成本降低 75%。

GGoogle 官方博客一手09.30
Google 发布 Gemini 4 Argon:官方称 DeepSWE v1.1 得分 77.9%、100 万 token 上限,先向网络安全防御方开放

Google 9 月 30 日发布前沿模型 Gemini 4 Argon,面向长链路的软件工程、法律与金融等知识工作和网络安全防御;官方称其 100 万 token 上限业界领先,DeepSWE v1.1 得分 77.9%,在 Zapier 的 AutomationBench 上以 51.3% 排第一。模型目前只通过 Fairwind 计划向受信任的网络安全防御方开放,之后先给付费 API 用户和 Google AI Ultra 订阅者;API 介绍期价格为每百万 token 输入 2 美元、输出 10 美元,之后为 4 美元和 20 美元。

原文 ↗
WWorld Labs 官方博客一手09.28
AMD 将以 82 亿美元收购 World Labs:李飞飞将任 AMD 执行副总裁兼首席科学家

World Labs 9 月 28 日宣布已签署最终协议加入 AMD,据 TechCrunch 报道交易金额为 82 亿美元:联合创始人李飞飞将出任 AMD 执行副总裁兼首席科学家,直接与 CEO 苏姿丰合作,Justin Johnson 与 Ben Mildenhall 继续带领 World Labs 团队;交易预计 2026 年底前完成,需通过监管审批。

原文 ↗
PPixVerse 官方博客一手09.22
PixVerse 发布实时世界模型 R2:会话更长更连贯,前面的操作会延续到后面,可同时接收文字、参考图、音频与按键控制

PixVerse 9 月 22 日发布实时世界模型 R2:生成的世界持续运行,会话中的提示词、动作与音频输入会改变之后的发展而不重置,可用 WASD 与方向键操控角色和镜头;PixVerse 游戏引擎已改用 R2,一批示例世界在 world.pixverse.video 开放体验。

原文 ↗
RRunway 官方研究博客一手09.03
Runway 发布 GWM Worlds 2(研究预览):720p/24fps 持续生成画面与音频,按实时文字指令延续当前世界

Runway 发布通用世界模型第二代 GWM Worlds 2(研究预览):持续生成 720p/24fps 画面与 48 kHz 音频,按用户实时输入的文字指令延续当前世界状态而不重置,会话没有预设时长。

原文 ↗
AAnthropic官方一手09.01
Anthropic发布Fable 5.1+Mythos 5.1:缓存读取成本降75%,维持输出价格

Anthropic更新Fable 5.1和Mythos 5.1,缓存读取(cache read)成本降低75%,输出token价格维持不变

原文 ↗
WWorld Labs 官方博客一手09.01
World Labs 发布世界模型 Atlas:原生处理文本、图像、视频与 3D,可按指定机位生成最长 1 分钟的 1440p 视频

World Labs(李飞飞联合创立)发布新一代世界模型 Atlas:从零预训练、原生处理文本/图像/视频/3D 的全能模型,可按指定摄像机路径生成最长 1 分钟的 1440p 视频,也能从一张到几十张照片重建真实场景;目前以早期访问形式向部分合作方开放。

原文 ↗

03设计软件与 AI 助手

本版导读Adobe 9 月 24 日推出 Adobe in Gemini,并把 Acrobat 并入 Claude 插件,9 月 29 日为 ChatGPT 插件加入交互式编辑器。Premiere Pro 推出内置五个视频模型的 Generative Media Tool,Runway 发布 Premiere 与 After Effects 插件。另有 CorelDRAW、Figma 的更新。

AAdobe 官方博客一手09.24
Adobe 工具接入 Google Gemini,Claude 插件并入 Acrobat 并扩至 80 多个工具

Adobe 推出 Adobe in Gemini,可在 Gemini 对话中调用 Photoshop、Lightroom、Express 和 Firefly 的工具;Adobe for Claude 插件首次并入 Acrobat 工具,可调用 80 多个工具,并新增 PDF 与 Express 设计的交互式编辑器。

原文 ↗
AAdobe 官方博客一手09.29
Adobe 为 ChatGPT 插件加入交互式编辑器:选中局部让 AI 修改后可用滑块微调,PDF 可在侧边面板直接编辑

Adobe 9 月 29 日配合 OpenAI 开发者日,为 ChatGPT 中的 Adobe 插件加入在侧边面板打开的交互式编辑器:图片与设计编辑由 Photoshop 和 Adobe Express 驱动,可选中对象或涂抹区域让 ChatGPT 修改,再用色相、饱和度、对比度等滑块微调;PDF 可用 Acrobat 工具直接改文字、加高亮。当天起在 ChatGPT 网页版和 App 全球逐步推出。

原文 ↗
AAdobe 官方博客一手09.08
Adobe Premiere Pro 内嵌五大 AI 视频模型与 AI 音效生成——IBC 2026 Generative Media Tool

Adobe 于 IBC 2026 推出 Premiere Pro Generative Media Tool,时间轴内框选即可调用 Firefly、Runway、Kling、Veo、Luma 五大 AI 视频模型,并同步新增 AI 音效与声景生成。

原文 ↗
RRunway 官方一手09.08
Runway 发布 Adobe Premiere Pro 与 After Effects 原生插件

Runway 推出 Adobe Premiere Pro 和 After Effects 官方原生插件,专业剪辑者可在时间轴内直接调用 Runway Aleph 2 完成 AI 视频生成、风格化与超分辨率,无需离开剪辑软件。

原文 ↗
HHiggsfield 官方博客一手09.10
Higgsfield 推出 AI Motion Designer:在 ChatGPT 中用文字驱动 After Effects,产出可继续编辑的原生图层与关键帧

Higgsfield 推出 AI Motion Designer:在 ChatGPT 的 Higgsfield 插件里输入 /use-after-effects 并描述需求,智能体把请求转成 After Effects 合成里的图层、关键帧与时间安排,产出可以手工修改;使用需同时订阅 Higgsfield、ChatGPT 与 After Effects。

原文 ↗
GGlobeNewswire一手09.15
CorelDRAW Graphics Suite 九月更新:Text-to-Vector AI 文字直生可编辑矢量图形 + PowerTRACE 提速

CorelDRAW Graphics Suite September 2026 Update 新增 Text-to-Vector AI,支持从文字描述直接生成可商用、可编辑矢量图形路径,并将 PowerTRACE 速度提升 4 倍。

原文 ↗
TTechCrunch一手09.16
Anthropic Claude 统一界面:Chat + Cowork 合并单窗口,Claude Design 保持品牌一致性

Anthropic 将 Claude.ai 聊天与 Cowork 工作空间合并至单一窗口,并推出 Claude Design 支持跨项目品牌一致性管理。

原文 ↗
FFigma 官方博客一手09.16
Figma 九月新功能:Weave 节点(Design→AI 工作流)+ Shaders 开放测试版 + 社区工具发布

Figma 推出 Weave 节点支持将 Design 画框拖入 AI 工作流、Shaders 开放测试版通过提示词生成动效着色器,并上线 Weave 社区工具发布功能。

原文 ↗

04视频与图像模型

本版导读Vidu S2 含实时 720p 数字人与流式视频风格编辑。Google Vids 向所有账号免费开放 Gemini Omni 1.1 Flash 视频生成。阿里开源 7B 的 Qwen-Image-2.1,原生支持 RGBA 透明通道;Recraft 称 V4.1 Flash 中位出图时间 1.3 秒。Pika 改为多模型创意工作室,BFL 推出 FLUX Video Edit API。

aarXiv一手09.15
Vidu S2:实时 720p 数字人生成 + 流式视频风格编辑,支持 VR 空间

生数科技发布 Vidu S2,包含实时 720p 数字人生成与无中断流式视频风格编辑两个子模型,在线演示同步开放。

原文 ↗
GGoogle 官方博客一手09.23
Google Vids 向所有 Google 账号免费开放 AI 视频生成:用 Gemini Omni 1.1 Flash 生成 1080p 片段,可延展场景、指定时长

Google 9 月 23 日宣布,任何 Google 或 Google Workspace 账号都可以在桌面端 Google Vids 里免费用 Gemini Omni 1.1 Flash 生成视频:可延展场景并保持人物、光线与环境一致,指定片段的精确时长,生成或放大到 1080p;每段生成内容都嵌入 SynthID 不可见水印。

原文 ↗
QQwen 官方博客一手09.20
阿里开源 Qwen-Image-2.1:7B 统一图像生成+编辑模型,原生 RGBA 透明通道,支持 10 图参考,首日同步 ComfyUI/Diffusers/vLLM

阿里开源 Qwen-Image-2.1,7B 参数统一图像生成与编辑模型,首次原生支持 RGBA 透明通道,最多 10 张参考图输入,发布首日可通过 ComfyUI、Diffusers、vLLM 调用。

原文 ↗
RRecraft 官方博客一手09.23
Recraft 发布 V4.1 Flash:官方称中位生成时间 1.3 秒,ComfyUI 同日接入

Recraft 发布图像模型 V4.1 Flash,官方称从提示词到出图的中位时间为 1.3 秒,并称其为目前最快的图像模型;同日 ComfyUI v0.37.2 把它作为 Recraft V4 文生图节点上更快、成本更低的选项接入。

原文 ↗
SSemafor09.17
Pika 重构为全流程创意工作室:7 大 AI 模型自动路由,内置镜头清单生成、重打光、换装工具套件

Pika 将产品从单一视频生成工具重构为多模型创意工作室,集成 7 个 AI 模型并新增逐镜头清单生成、重打光与换装工具套件。

原文 ↗
BBlack Forest Labs 官方文档一手09.15
BFL FLUX Video Edit API:$0.03/秒保留原片运动与音频的精准视频编辑端点

Black Forest Labs 推出 FLUX Video Edit API,$0.03/秒输出,可按文字描述精准修改视频中指定元素,同时完整保留原片运动轨迹与音频。

原文 ↗
HHuggingFace一手09.04
LLaDA-Image:开源6B统一文生图+参考编辑+中英文排版,Base+Turbo双档

inclusionAI 发布 LLaDA-Image:6B 参数开源统一图像生成与编辑模型,分 Base(50步高质量)和 Turbo(4步快速,Twin-DMD 蒸馏)双档,支持文生图、参考图风格迁移、精准编辑以及中英文文字排版渲染。

原文 ↗

05ComfyUI 版本更新

本版导读ComfyUI 本月发布 v0.35.0 至 v0.38.0:v0.35.0 引入 Comfy Compiler 并新增 7 个合作模型节点,v0.36.0 新增 FastH3 视频与 FLUX 视频编辑节点,v0.37.0 原生支持 Qwen-Image 2.1 与 MoGe 3,v0.38.0 支持 Ming Image 0.1 Design 并移除 Sora 节点。

CComfyUI 官方一手09.21
ComfyUI v0.37.0/v0.37.1:原生支持 Qwen-Image 2.1 与 MoGe 3,新增腾讯 HY Image 3.5 Preview 合作节点

ComfyUI v0.37.0(9 月 21 日)原生支持 Qwen-Image 2.1(文生图、编辑、背景移除三个模板,可输出透明图)和 MoGe 3 单图几何估计;v0.37.1(9 月 22 日)新增腾讯 HY Image 3.5 Preview 文生图与编辑合作节点,编辑节点最多接 5 张参考图、原生 2K 输出。

原文 ↗
GGitHub一手09.15
ComfyUI v0.36.0:FastVideo FastH3 8步视频生成 + BFL FLUX 视频编辑节点 + YuE2 音乐 + Tripo P2 3D

ComfyUI v0.36.0 新增 FastH3 8步蒸馏视频、BFL FLUX 视频编辑、YuE2 音乐生成与 Tripo P2 3D 等多项节点,单一工作流覆盖文字到视频配乐完整链路。

原文 ↗
CComfyUI 官方一手09.09
ComfyUI v0.35.0:Comfy Compiler 加速与七个前沿模型官方合作节点一键接入

ComfyUI v0.35.0 引入 Comfy Compiler 内存加速,并新增 GPT-6、GPT Image 2.5、Claude Fable 5.1、Gemini Omni 1.1 等 7 个官方合作模型节点,同时扩展 3D 管线。

原文 ↗
CComfyUI GitHub Rele...一手09.29
ComfyUI v0.38.0:原生支持面向设计版式的 Ming Image 0.1 Design,Seedance 2.5 新增 480p 草稿模式,移除已停服的 Sora 节点

ComfyUI v0.38.0(9 月 29 日)原生支持 Ming Image 0.1 Design(6B 文生图,面向文字密集的设计版式,可输出透明图)、MiniMax-H3 多条件 ControlNet、Qwen-Image 2.1 ControlNet 等;合作节点方面,Seedance 2.5 新增 480p 草稿模式、Seedream 节点加入 5.0 Flash,OpenAI 节点接入 GPT-6 Sol 与 Luna,已停服的 Sora 节点移除。

原文 ↗

06征集与赛展

07SKILL

往期月报

(本期完)

条目均来自本站已发布资讯,链回原卡片与原始来源;导读与本版导读为编辑汇编,不含评价。全部资讯 →