第 5 页
阅读Google DeepMind 推出 Gemini 3.7 Flash:价格直接腰斩,主攻编程与智能体
距 Gemini 3.6 Flash 上线不到三周,DeepMind 推出 3.7 Flash,输入输出价格砍至每百万 token 0.75 和 3.75 美元,重点强化编程与智能体任务。对依赖 API 的开发者和中小团队来说,这是非常实际的成本红利。

模型发布、产品动态和行业观察统一按发布时间从新到旧排列。
距 Gemini 3.6 Flash 上线不到三周,DeepMind 推出 3.7 Flash,输入输出价格砍至每百万 token 0.75 和 3.75 美元,重点强化编程与智能体任务。对依赖 API 的开发者和中小团队来说,这是非常实际的成本红利。


MiniMax 推出 Music 3.0,开放模型权重,支持最长五分钟的全流程音乐生成。这意味着从作曲到编曲再到混音,AI 可以一次性完成。开源策略让中小开发者和内容创作者首次拿到接近商用水平的音乐模型。

阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重。这是 Qwen 旗舰级模型首次开源,总参数 2.4T,每 Token 激活 95B,原生支持 256K 上下文,可扩展至近百万 Token。

微软 AI 部门 CEO 苏莱曼宣布首个自研推理模型 MAI-Thinking-1 正式登陆 Microsoft Foundry。这是微软在推理模型赛道拿出的第一张自研牌,对开发者和企业云服务市场都值得关注。

知名 RLHF 研究者 Nathan Lambert 写完教科书后反思:当前大模型在长文非虚构写作上几乎原地踏步,编码和数学任务却已接近超人水平。他点出 GPT-4.5、Kimi K2 等写作模型正在老化,长文结构仍是 AI 写作的真正短板。

Scale AI 预告开放 Muse Spark 1.2 权重,并推出采用 Apache 2.0 协议的 30B 智能体模型 Muse Glimmer,主打在 24GB 显存运行。若兑现,开发者将更容易验证本地智能体;中文效果、稳定性和实际成本仍待模型发布与第三方实测。