第 14 页
阅读Black Forest Labs 推出 FLUX 3 多模态模型:单次生成 20 秒视频加原生音频,意味着什么
Black Forest Labs 在 Early Access 阶段推出 FLUX 3 多模态模型,单次可生成最长 20 秒视频并自带原生音轨。本文拆解它的技术逻辑、与 Sora/Veo/Runway 的差异,以及创作者和国内用户该看什么。

模型发布、产品动态和行业观察统一按发布时间从新到旧排列。
Black Forest Labs 在 Early Access 阶段推出 FLUX 3 多模态模型,单次可生成最长 20 秒视频并自带原生音轨。本文拆解它的技术逻辑、与 Sora/Veo/Runway 的差异,以及创作者和国内用户该看什么。


通义千问发布Qwen-Image-3.0,支持4.5k token输入、12种语言和20多种字体,重点强化中文长文本渲染、多语言混排、多图融合与图片编辑。在19个实测场景里输出稳定,文字不崩,对中文创作者和国内开发者来说,可用性比上一代明显上了一档。

AMD宣布向Anthropic投资高达50亿美元,换取后者采购2GW的AMD MI455及后续GPU。这笔把资本和算力承诺绑在一起的交易,标志着头部AI公司开始认真执行多供应商策略,也给NVIDIA主导的高端GPU市场投下新的变量。

DAIR.AI 创始人 Elvis Saravia 提出以"任务"取代"提示词"作为 AI 智能体的交互单元,把语音、屏幕画面、文本、标注打包成完整上下文,让模型一次拿够信息,减少来回修正。该思路受 Karpathy 长语音实验启发,或将重塑 Agent 的前端采集和产品形态。

微软研究院宣布 MagenticLite 全栈开源,MagenticBrain 与 Fara 1.5 权重上线 Hugging Face,配套测试工具同步释出,企业可在自有环境部署浏览器代理。

腾讯设计Agent平台Miora正式取消邀请码,面向所有用户开放使用。该平台主打品牌设计、影视创意等多场景,内置Skill市场与记忆系统,支持自定义多模态模型。对于设计师与中小团队来说,这是又一款值得上手试的国产设计Agent。