浅译快报

OpenAI

与 OpenAI 相关的资讯,按发布日倒序。

OpenAI官方/The Verge/TechCrunch· 9月9日一手 行业

OpenAI Sora API将于2026年9月24日终止服务,独立app已于4月下线,与迪士尼约$10亿规模的AI视频合作随之流产

OpenAI宣布Sora API将于2026年9月24日正式关停。Sora独立应用此前已于4月26日下线。与此同时,此前报道中规模约$10亿的Sora与迪士尼AI视频战略合作也随Sora产品线关停而终止。2024年2月发布时引爆行业想象力的旗舰AI视频产品,在不到两年内完成从里程碑到退出的完整周期。开源阵营(FLUX 3 Video、LTX-2.5、MiniMax H3)及国产视频模型(Wan 3.0、Seedance 2.5、Kling 3.5)在此期间已具备替代能力。

Sora从2024年全球最具关注度的AI视频到2026年关停,是AI商业化复杂性的典型案例;$10亿迪士尼协议流产将成为AI与传统内容产业合作中商业风险的重要参照案例。

查看原始来源 ↗

OpenAI 官方博客· 9月8日一手 模型

ChatGPT Images 2.5 新增手绘草图 Sketch 参考功能,生成速度提升 50%,并发布 Flare(速度优先)和 Sunburst(精度优先)两个 API 模型,全面取代 GPT-Image-2。

OpenAI 于 2026 年 9 月 8 日发布 ChatGPT Images 2.5,生成延迟较 2.0 降低 50%,主体保留更忠实。新增 Sketch 功能,用户可在对话窗口手绘草图作为参考——适用于勾勒房间布局、服装轮廓或创作草稿,AI 以手绘与文字双重参考生成结果。Templates 模块覆盖海报、商品图、图标、Logo、产品图等常用格式。API 同步推出两个新模型:GPT-Image-2.5 Flare(速度优先,$8/$30 per 1M tokens)与 Sunburst(精度优先,生成时间更长),全面取代 GPT-Image-2。

手绘参考图(Sketch)将「画一下表达设计意图」这一直觉动作引入 AI 生图流程,降低创意传达门槛;双轨 API 满足教学演示(速度)与精细输出(精度)两类场景需求。

查看原始来源 ↗

OpenAI官方/Fortune/CNBC· 9月3日一手 模型

OpenAI正式发布GPT-6(Project Astra),新增Computer Use能力,官方演示包括操控3D建模软件和CAD程序执行多步骤设计任务

OpenAI于9月3日正式发布GPT-6(内部代号Project Astra),核心新能力为Computer Use(计算机操控):模型可理解屏幕内容、控制浏览器和桌面应用、执行多步骤操作任务。官方演示场景包括操控3D建模软件和CAD程序,将AI能力从”内容生成”扩展至”工具操控”。GPT-6在多模态指令遵循和长上下文任务链方面有显著提升,沿用GPT-5.6架构基础进行工程优化。

Computer Use能力标志着AI从”生成助手”向”操控代理”的功能延伸,在设计和工程领域,AI直接操控专业软件执行任务的可能性正在从研究阶段走向产品落地。

查看原始来源 ↗

OpenAI 官方· 8月6日一手 模型

OpenAI 全量发布 GPT-5.6 Luna,面向所有 ChatGPT 用户开放免费无限制使用,SOL 逻辑推理与数学问题求解能力较前版本显著提升。

OpenAI 在 ChatGPT 中全量发布 GPT-5.6 Luna,向所有免费用户开放无使用次数限制,不再要求订阅 ChatGPT Plus;重点改进 SOL(Standard of Logic)推理能力,在数学解题、多步逻辑分析和代码推理任务上优于同期基准;模型延迟与响应速度也有明显改善。Luna 是 GPT-5.6 系列的标准版本,与更早发布的 GPT-5.6 Full 形成高/标准双档并行格局。

GPT-5.6 Luna 向免费用户全量开放,是 OpenAI 在国产 AI 集中发力后的竞争性回应,也意味着高校师生无需任何订阅即可接触到当前最先进的对话式 AI 推理能力。

查看原始来源 ↗

Adobe官方 / 9to5Mac· 8月6日一手 产品

Adobe在ChatGPT内上线免费统一插件,整合Photoshop/Firefly/Express/Premiere/Lightroom/Illustrator/InDesign/Acrobat/Adobe Stock共70+工具;任意ChatGPT对话中@Adobe即可调用,无需Creative Cloud订阅(免费Adobe账号即可使用Firefly文生图/文生视频);同步宣布接入Claude与Microsoft Copilot,Slack/Google Gemini列入计划。

Adobe在ChatGPT内上线免费统一插件,整合Photoshop/Firefly/Express/Premiere/Lightroom/Illustrator/InDesign/Acrobat/Adobe Stock共70+工具;任意ChatGPT对话中@Adobe即可调用,无需Creative Cloud订阅(免费Adobe账号即可使用Firefly文生图/文生视频);同步宣布接入Claude与Microsoft Copilot,Slack/Google Gemini列入计划。

Adobe统一插件意味着设计师可在ChatGPT对话流中直接调用专业创意工具全栈,无需在应用间切换——这是Adobe主动向对话式AI设计工作流让步的最清晰信号

查看原始来源 ↗

OpenAI帮助中心 + CryptoBriefing...· 8月4日一手 产品

OpenAI 宣布 8月30日关闭 ChatGPT 内的官方 DALL-E GPT,所有图像生成入口统一迁往「ChatGPT Images」(基于 gpt-image-1 和 gpt-image-1-mini)。

OpenAI 宣布 8月30日关闭 ChatGPT 内的官方 DALL-E GPT,所有图像生成入口统一迁往「ChatGPT Images」(基于 gpt-image-1 和 gpt-image-1-mini)。DALL-E 2/3 API 快照已于5月12日停用,此次是 DALL-E 产品线整合收尾。用户自建的含图像功能 GPT 不受影响;现有 DALL-E GPT 内的图片需在8/30前自行下载保存。

用 ChatGPT 做 AI 生图的设计师和艺术家需注意:8/30起使用路径改变,但能力不降(gpt-image-1 优于 DALL-E 3)

查看原始来源 ↗

OpenAI官博 + The Decoder + Bl...· 8月1日一手 模型

OpenAI 以非常规方式预告下一代旗舰模型 Astra:不发布产品,而是在数学博客第三段点名,随后将 Astra 内部版本解决的十道历史级数学难题(群论/算子代数/格密码/量子复杂度等)推上 GitHub,附249页技术报告及完整 Lean 4 机器可验证证明。

OpenAI 以非常规方式预告下一代旗舰模型 Astra:不发布产品,而是在数学博客第三段点名,随后将 Astra 内部版本解决的十道历史级数学难题(群论/算子代数/格密码/量子复杂度等)推上 GitHub,附249页技术报告及完整 Lean 4 机器可验证证明。Astra 定位为”多智能体协同运行数小时甚至数天的深度研究助手”,是 ChatGPT 之后的下一代 OpenAI 模型家族,目前未公开发布,需先通过美国政府审查。

对高校教师和科研团队的重要信号:OpenAI 明确将 Astra 定义为”能攻克极难长期研究问题的深度助手”,与日常对话式工具有质的差异

查看原始来源 ↗

科技行者· 7月17日 论文

北邮×中科院×StepFun提出MentalThink,让多模态大模型在推理中生成SVG草图「看图思考」,MindCube三维旋转测试76分超越GPT-5的56分,仅用7B参数模型。

北邮、中科院与StepFun联合团队于2026年7月提出MentalThink系统(arXiv:2607.03530),让多模态大模型在推理过程中生成SVG代码草图、渲染后「看图思考」再修正,形成「画图→看图→推理」闭环;在MindCube三维心理旋转测试中达76.0分(对比GPT-5的56.3分),VSIBench空间理解与GPT-5持平;训练仅使用7B参数模型,研究揭示了「思考媒介」(SVG vs纯文字)对空间推理能力的决定性影响。

用SVG草图辅助空间推理以7B参数超越更大基线,提示「思维媒介的选择」对特定任务能力的影响可能独立于参数量;对理解多模态AI如何在空间设计任务中借助视觉草图辅助推理有参考意义。

查看原始来源 ↗

新智元/36氪/Hacker News/Tom's G...· 7月11日一手 案例

设计师Eric Lu与Mixfont将字母编码为移动轨迹,发布24小时内达14.7M播放;GPT-5.6、Gemini、Claude均无法读取;72小时后一句方向提示使GPT-5.6完整破解,完成设计与AI认知对抗的首个完整回合制案例。

设计师Eric Lu与Mixfont团队于2026年7月11日发布Ghost Font幽灵字体:该字体将字母信息编码为移动轨迹而非传统笔画,人眼通过视觉运动感知可即时辨认,而GPT-5.6、Gemini 3.5 Pro、Claude Fable 5等主流大语言模型在发布后24小时内全部无法读取。项目发布首日在Hacker News、36氪等平台引发传播,24小时内播放量达14.7至17M。72小时后,一句简短的方向性提示(描述编码机制)使GPT-5.6完整破解了幽灵字体,攻防周期至此完整结束。该案例由此成为设计×AI认知对抗领域有据可查的首个完整回合:从视觉盲区被发现,到提示工程将其突破。

这不只是字体实验——它以可重复的形式揭示了当前大模型视觉感知的一处结构性盲区(运动编码的符号系统),并验证了提示工程在突破此类局限方面的有效边界,对研究AI视觉理解与艺术设计认知交叉的师生有直接参考价值。

查看原始来源 ↗

OpenAI官方· 7月9日一手 模型

GPT-5.6 Sol旗舰、Terra均衡、Luna轻量三款模型于7月9日全量公开,结束约两周国家安全审查,在ChatGPT与API中全球同步上线。

OpenAI旗下GPT-5.6系列——Sol旗舰版($5/$30每百万Token输入/输出)、Terra均衡版($2.5/$15)、Luna轻量版($1/$6)——于2026年7月9日全量公开发布,结束约两周的国家安全审查有限预览期,在ChatGPT、Codex及API中全球同步上线。Sol于有限预览期间登顶LMSYS竞技场排行。

新一代旗舰语言模型的全量开放将影响以GPT系列为底层的AI设计工具与工作流平台的能力上限,对下游创作工具链的演进有间接参照意义。

查看原始来源 ↗

Figma官方Blog/优设情报· 7月9日一手 产品

Figma Make正式接入GPT-5.6,支持从提示词、草图或既有Figma文件生成可运行交互原型,首轮生成质量提升,遇错误可自我修复。

Figma Make于2026年7月9日正式接入GPT-5.6,支持三种输入路径:自然语言提示词、草图图像,或现有Figma设计文件,均可直接生成可运行的交互原型。据Figma官方Blog,接入GPT-5.6后首轮生成质量明显提升,并新增错误自我修复能力,设计师可在Figma内完成从创意描述到可交互原型的完整流程。

主流设计工具与旗舰级推理模型的深度整合,意味着「草图→原型」环节所需的跳跃成本进一步降低,对教学演示、课题快速验证及设计方案迭代均有直接参考价值。

查看原始来源 ↗

OpenAI官方· 7月8日一手 模型

OpenAI发布GPT-Live-1与mini两款全双工实时语音模型,支持边听边说、主动打断及实时多语言翻译,已向ChatGPT用户和开发者开放。

OpenAI于2026年7月8日发布GPT-Live-1与GPT-Live-mini两款全双工实时语音模型,支持边听边说、主动打断与暂顿理解,以及实时多语言翻译能力。复杂推理任务将在后台调用GPT-5.5处理。ChatGPT Plus用户默认使用GPT-Live-1,Free用户使用mini版本,同时向开发者开放API接入。

全双工语音交互能力的商用化落地,为语音界面原型设计、多媒体创作及多语言教学工具的开发提供了新的底层模型选项。

查看原始来源 ↗

量子位· 7月8日一手 产品

Cowart开源插件将Codex与tldraw无限画布结合,通过视觉标注加截图的方式解决AI改图中空间关系描述难的问题。

豆包产品经理开源Cowart,一款将Codex与tldraw无限画布结合的AI图像编辑插件。用户在画布内直接框选区域或添加标注,系统自动截图并带上空间位置信息传给Codex,解决了纯文字Prompt难以描述图像空间关系的痛点。插件支持MCP工具读取选区并插入图像,可扩展至更复杂的多步编辑工作流。

将画布内的视觉标注作为AI改图的空间指令,弥补提示词在位置描述上的不足,为视觉+语言混合指令的图像编辑工作流提供了轻量可部署的参考方案。

查看原始来源 ↗

OpenAI 官方 / VentureBeat / A...· 6月26日一手 模型

OpenAI 推出 GPT-5.6 三款模型的有限预览:Sol(旗舰)、Terra(均衡)、Luna(轻量),约 20 个组织受邀,Sol 已登顶 LMSYS 排行,预计数周内全量开放。

OpenAI 有限预览 GPT-5.6,含三档定位:Sol(旗舰,$5/$30 每百万输入/输出 token)、Terra(均衡,$2.5/$15)、Luna(轻量,$1/$6)。约 20 个受邀组织可提前访问,Sol 已登顶 LMSYS 竞技场排行。发布时间受美国政府 6 月 2 日 AI 安全合规行政令协调,全量开放时间预计在数周内。

作为边界条目(垂直艺术设计相关性为 3/5)收录:GPT-5.6 多模态视觉理解能力的提升将传导至以此为底层的 AI 设计工具;使用 OpenAI API 搭建教学辅助或科研工作流的老师,可参考 Sol/Terra/Luna 三档能力与价格梯度,在全量开放后评估是否调整底层模型配置。

查看原始来源 ↗

arXiv (2606.25306) / TechWa...· 6月24日一手 论文

北卡罗来纳大学、Johns Hopkins、AI2 与德克萨斯大学奥斯汀联合发布 PQSG 评估体系(arXiv:2606.25306),首次系统评估 AI 视频生成模型的物理一致性,覆盖刚体动力学、流体模拟、软体变形,揭示主流视频模型的系统性物理短板。

北卡罗来纳大学、Johns Hopkins、AI2 与德克萨斯大学奥斯汀联合发布 PQSG(物理问题场景图)评估体系(arXiv:2606.25306,2026-06-24),首次系统评估 AI 视频生成模型的物理一致性,覆盖刚体动力学、流体模拟、软体变形三大场景,对 Sora 2、Veo 3 等商业主流模型进行了定量评分,揭示现有视频模型在物理场景上存在系统性不足。

了解 AI 视频工具的物理局限,是在课堂中准确设定工具边界的前提:动画、影视、游戏方向的师生在用 Sora 2、Veo 3 制作含流体或刚体运动内容时,可参考 PQSG 指出的具体失效场景,避免将模型缺陷当作设计意图;该评估方法本身也是「批判性使用 AI 工具」教学单元的优质素材。

查看原始来源 ↗