浅译快报

字节跳动

与 字节跳动 相关的资讯,按发布日倒序。

量子位 / 新浪科技· 7月31日 模型

字节跳动Seedance 2.5于7月31日正式发布,单次AI视频生成时长从10秒提升至30秒,支持50个多模态参考素材(图像+视频+文字混合),新增局部编辑,发布Maya/Blender插件打通影视工业流程;已全量上线即梦AI与豆包专业版。

字节跳动Seedance 2.5于7月31日正式发布,单次AI视频生成时长从10秒提升至30秒,支持50个多模态参考素材(图像+视频+文字混合),新增局部编辑,发布Maya/Blender插件打通影视工业流程;已全量上线即梦AI与豆包专业版。

30秒直出意味着一个完整分镜可在单次推理内完成

查看原始来源 ↗

量子位· 7月10日 模型

歌歌AI音乐大模型7月10日全面上线,十亿级参数华语端到端扩散+歌声合成混合架构,单卡10秒生成完整华语歌曲,中文咬字还原率较通用模型提升67%,打通字节七大平台,同期启动非遗民乐数据采集计划。

歌歌AI音乐大模型于2026年7月10日全面上线,采用十亿级参数规模的华语端到端扩散与歌声合成混合架构,支持在单卡设备上10秒内生成完整华语歌曲。相较于通用音乐模型,其中文咬字还原率提升67%,并已接入抖音、剪映、汽水音乐等字节跳动旗下七个内容平台。同期启动「中国声音采集计划」,面向非物质文化遗产民乐进行数据采集。由量子位、机器之心、IT Bear多源确认。

针对华语发音的专项优化大幅提升AI音乐在中文内容场景下的实用性,字节七平台接入意味着AI生成音乐将进入更大规模的内容分发体系。

查看原始来源 ↗

字节Seed官方· 7月8日一手 模型

字节Seedream 5.0 Pro正式发布,带来高密度信息可视化、交互式精准编辑(圈选/图层分离)、真实影像质感及10+语言原生文字生成四项核心升级。

字节跳动旗下Seed团队于2026年7月8日全球正式发布Seedream 5.0 Pro,带来四项核心升级:高密度信息可视化(可将数据与概念转化为专业排版图表);交互式精准编辑(支持圈选、点选与图层分离输出,直接对接PSD工作流);真实影像质感提升;以及支持10余种语言的原生文字生成。模型已上线Volcano Ark平台,ComfyUI同日通过Partner Nodes接入。

图像生成模型开始向「理解设计意图」方向演进,图层分离与可编辑输出将AI生图结果更紧密地嵌入现有平面设计工作流。

查看原始来源 ↗

ComfyUI官方GitHub· 7月8日一手 产品

ComfyUI v0.27.1通过Partner Nodes接入Seedream 5.0 Pro图像生成与Seed Audio 1.0多模态音频节点,同时停用Ideogram旧版并移除StabilityAI合作节点。

ComfyUI v0.27.1于2026年7月8日发布,通过Partner Nodes同步接入字节Seedream 5.0 Pro图像生成节点与Seed Audio 1.0音频节点(支持语音、音效、多角色对白生成)。同时停用了Ideogram V1/V2旧版节点,并临时移除了StabilityAI partner nodes,修复了视频解码含不可解音频流时的崩溃问题。

ComfyUI节点生态在单次更新中同时扩展到最新图像模型和多模态音频生成,用户可在同一工作流内调用最新的图文音多模态能力而无需切换工具。

查看原始来源 ↗

量子位 / TechTimes / AI Weekly...· 7月6日编辑精选 案例

独立电影人群体正悄然转向字节Seedance 2.5,AI视频生成成本约$9/分钟较传统摄制$24/分钟大幅压低,量子位、Variety等多源报道证实这一趋势正在专业创作圈扩散。

量子位、TechTimes、AI Weekly及Variety等多源报道显示,字节旗下AI视频生成工具Seedance 2.5正在好莱坞独立电影人群体中加速渗透。核心驱动因素在于成本差距:AI视频生成约$9/分钟,较传统专业摄制的$24/分钟降低约62%,价差推动部分独立电影人将其纳入正式制作流程,而非仅用于概念验证。相关加更长文已于2026-07-08写就。

AI视频工具从创意探索进入专业制作采购决策的转折,标志着成本驱动的替代逻辑开始在影视产业链中实际生效,对AI视频生成商业化进程及国内竞品格局具有直接参照价值。

查看原始来源 ↗

IT之家 / 量子位 / 36氪 / 雷锋网 / 新浪科技· 7月6日编辑精选 模型

字节跳动即梦旗下 Seedance 2.5 视频生成模型公布:主打多镜头跨场景人物一致性与专业运镜控制;公测尚未正式面向全体用户开放,具体上线时间以官方为准

字节跳动旗下即梦(Dreamina)公布新一代视频生成模型 Seedance 2.5,核心能力包括多镜头叙事场景下的跨片段人物/场景一致性保持,以及专业级运镜控制(推拉摇移跟等镜头语言),在连贯性与画面质量上均有提升。公测尚未正式面向全体用户开放,具体开放时间与范围以官方公告为准。

多镜头一致性与运镜控制是 AI 视频从「单段生成」走向「可导演式叙事视频」的关键门槛,值得关注其后续公测节奏。

查看原始来源 ↗

量子位· 6月26日 产品

字节 TRAE 推出 Work Design 模式,可精准识别设计系统组件库,输入需求后自动生成 UI 设计稿并同步转代码,覆盖从设计到开发的完整工作流。

字节跳动 TRAE 推出 Work Design 模式,量子位对此进行实测。该模式的核心能力是识别用户已有的设计系统组件库,在接收到需求描述后自动生成对应的 UI 设计稿,并同步输出可用代码,打通从界面设计到前端开发的链路。实测报告显示,组件识别精度与 UI 一致性是该模式的主要亮点。

将设计系统作为上下文输入、以 AI 自动完成设计到代码的转译,是将 AI 编程工具引入设计规范约束环境的一种实践方向,对 UI 工程化教学与组件驱动设计研究具有参考价值。

查看原始来源 ↗

新浪财经· 6月26日 观点

字节 Seedance 2.5 与阿里 HappyHorse 1.1 同日亮相,可灵估值下调至 150 亿美元,Sand.ai 融资超亿美元——深度分析认为国内 AI 视频赛道正从「技术炫技」进入「商业化验证」阶段。

2026 年 6 月下旬,字节 Seedance 2.5 与阿里 HappyHorse 1.1 几乎同日发布,与此同时可灵估值从高点下调至约 150 亿美元,Sand.ai 完成超亿美元新一轮融资。新浪财经对上述动态进行深度分析,认为国内 AI 视频赛道的竞争重心已从模型能力演示转向可量化的商业场景落地——谁能在影视、广告、短视频平台等方向率先实现稳定的付费闭环,将决定下一阶段的格局走向。

生成式 AI 视频的技术迭代速度趋于收敛,商业化路径与产品化能力的差异正在取代参数指标,成为赛道玩家的核心竞争要素。

查看原始来源 ↗

ChooseAI· 6月23日一手 模型

字节跳动于 FORCE 大会(6 月 23 日)发布 Seeddream 5.0 Pro,新增箭头/圈选直接标注的交互式精准编辑、多图层分离输出(可直接对接 PSD 工作流)及 10 余种语言原生文字生成,与 Seedance 2.5 构成图像→视频完整工业化链路。

字节跳动于 2026 年 6 月 23 日 FORCE 大会发布 Seeddream 5.0 Pro,新增三项主要能力:交互式精准编辑(支持在图像上直接以箭头标注或圈选区域的方式指定编辑目标,精确到局部内容);多图层分离输出(生成结果可按图层独立导出,直接对接 Photoshop PSD 工作流进行后期精修);以及 10 余种语言的原生文字生成能力,拓展多语言内容制作场景。Seeddream 5.0 Pro(图像)与此前发布的 Seedance 2.5(视频生成)共同构成字节在生成式视觉创作领域的图像→视频完整工业化链路。

图层分离输出与交互式局部标注编辑,将 AI 图像生成结果直接纳入专业后期管线,对「AI 生成→后期精修」教学工作流的演示与实践具有参考价值。

查看原始来源 ↗

火山引擎 / 机器之心 / 量子位 / 36氪 / A...· 6月23日一手编辑精选 模型

火山引擎在 FORCE 大会发布 Seedance 2.5,首次实现 30 秒原生单段直出和 50 个全模态素材联合生成,同步发布图像模型 Seedream 5.0 Pro 和音频模型 Seed-Audio 1.0。

火山引擎于 2026 年 6 月 23 日在 FORCE 大会(北京)发布 Seedance 2.5,核心能力包括:30 秒原生单段直出(非拼接)、同时输入最多 50 个全模态素材进行联合生成、以及画面局部一致性编辑(仅改变指定区域而不影响其余帧);ByteDance 直接从 2.0 跳号至 2.5,以版本命名强调代际差异;同步发布 Seedream 5.0 Pro 图像模型(输出可编辑分层设计图)和 Seed-Audio 1.0 音频模型(据介绍支持 0 样本多角色对白与拟音生成,具体能力以官方说明为准);4+ 中英文源同日报道。

30 秒原生直出是现阶段视频生成时长的显著突破,与图像、音频三模态同场发布代表国产生成式 AI 向统一内容创作管线方向的集中布局;Seedream 5.0 Pro 的分层设计图输出可直接接入 Figma / Photoshop 设计工作流。

查看原始来源 ↗

新华网· 6月23日 模型

字节跳动于 FORCE 大会(6 月 23 日)发布 Seed-Audio 1.0,支持零样本多模态参考生成人声、音效与 BGM 全要素,可输出多角色对白与拟音,单次时长达 2 分钟并可延伸至数十分钟。

字节跳动于 2026 年 6 月 23 日 FORCE 大会发布 Seed-Audio 1.0,该模型支持以零样本(zero-shot)多模态参考一次性生成人声、音效与背景音乐(BGM)全要素,可处理多角色对白场景与拟音需求,单次生成时长可达 2 分钟,并支持延伸至数十分钟的长内容输出;主要面向影视内容配音后期、有声书与播客等音频制作场景。

覆盖人声、音效与 BGM 三类要素的一体式多模态音频生成,将过去需要多工具协作的音频后期流程整合为单一入口,对影视制作与内容创作教学中 AI 音频工具的应用提供了新的能力参照。

查看原始来源 ↗

新华网 / 量子位 / 多源· 6月23日 模型

字节跳动发布豆包 2.1 Pro,Coding 与 Agent 能力较前代显著提升、对标旗舰级模型,并在多模态视觉理解评测集上保持领先,可作为设计与创作场景的多模态工作底座。

2026 年 6 月 23 日,字节跳动发布豆包 2.1 Pro。据新华网、量子位等报道,该版本在 Coding 与 Agent 能力上较前代有显著提升、对标旗舰级模型,并在多模态视觉理解的多项评测集上保持领先表现。对设计与内容创作场景而言,其多模态视觉理解能力可作为图像理解、素材分析等任务的底座。

通用大模型在多模态视觉理解上的持续走强,意味着「看图理解 + 推理」类能力正成为设计创作工作流的通用底座;其在教学与研究中的实际表现,值得以具体任务做对照评估。

查看原始来源 ↗

腾讯云 / 机器之心 / oschina / CSDN· 6月21日一手 产品

YC S24 团队开源 Palmier Pro macOS 视频编辑器,时间线内集成 Seedance、Kling、Nano Banana,并通过 MCP 服务器与 Claude、Codex、Cursor 等 AI Agent 无缝协作。

由 YC 2024 年夏季批次团队开发的 Palmier Pro 于 2026 年 6 月 21 日前后开源,这是一款 macOS 原生视频编辑器,在时间线内集成了 Seedance、Kling、Nano Banana 等视频生成模型,并通过内置 MCP(Model Context Protocol)服务器与 Claude、Codex、Cursor 等 AI Agent 无缝协作;中文技术社区于 6 月 23 日起展开大量讨论,四家以上媒体源核认。

将 AI Agent 协作与视频生成管线整合进桌面编辑器,是「AI 原生创作工具」形态的典型探索;对关注 AI 工具链整合或正在研究 MCP 生态的师生具有直接的实验参考价值。

查看原始来源 ↗

Runway· 6月5日 产品

Runway API 正式接入 Seedance 2.0 Fast,支持关键帧控制、参考图及参考视频生成,输出 4–15 秒视频,提供 480p/720p 两档分辨率。

Runway 于 2026 年 6 月 5 日通过 API 接入 Seedance 2.0 Fast,开发者和创作者可通过 API 调用关键帧控制、参考图生成、参考视频驱动等功能,单次生成支持 4–15 秒视频,提供 480p 和 720p 两档分辨率输出,补充了 Runway Studio 编辑器之外的程序化接入路径。

API 层接入意味着 Seedance 2.0 的视频生成能力可以嵌入自定义工具或课程平台,为有程序化批量生成需求的教学实验与创作工作流提供了新的整合入口。

查看原始来源 ↗