通义千问开源 Qwen3.8-Flash:125B 总参数只激活 6B,训练成本砍到九分之一
通义千问放出 Qwen3.8-Flash 开源权重,作为 Qwen4 架构早期预览。125B 总参数、每 token 仅激活 6B,训练成本降至前代九分之一,API 定价低至每百万输入 0.16 美元。
AI快讯
新模型、能力更新和开发者生态。
通义千问放出 Qwen3.8-Flash 开源权重,作为 Qwen4 架构早期预览。125B 总参数、每 token 仅激活 6B,训练成本降至前代九分之一,API 定价低至每百万输入 0.16 美元。
OpenRouter 发布模型选型方法论,强调按完成任务成本而非 token 单价评估。其 MCP 服务器已在 Claude Code、Cursor 等编辑器内可查实时排名与价格,并提供 auto-beta 自动路由。
OpenAI 将 GPT-5.6 模型家族接入软件开发智能体 Kiro,含 Sol、Terra、Luna 三款。Terminal-Bench 2.1 测试显示,GPT-5.6 Terra 在 Kiro 内完成任务成本下降约 82%。这次更新由 OpenAI 与 AWS 合作优化,主打更低迭代次数和更高 token 性价比。
面壁智能发布面向 Lean 4 的数学自动形式化开源框架 MathForm,配套 FormalVerse 数据集含 36.7 万条已验证样本。在 10 万预算对照下,模型 Consistency Check 达到 60.32%,超过 FineLeanCorpus 与 NuminaMath-LEAN 两个主流基线,整套流水线完全开源可复现。
阿里推出面向真实界面的 GUI 智能体基座模型,覆盖手机、电脑、网页与 DeepSearch 场景,主打让 AI 替代人类完成跨应用操作的最后一步。
Mistral 上线 Agentic Search,把 search、open、navigate、read、grep 五个工具串成一个多步检索循环,让模型在长文档与多来源中自主查找、跳转、定位并交叉验证信息,重点解决复杂文档查询准确率不足的问题。
Anthropic 内部用 Claude Tag 构建值班智能体,把事故首响时间压到分钟级。这不只是工程演示,更说明大模型已经能嵌入值班、告警与修复链路,开始承担传统 SRE 的部分职责。
Hugging Face 博客上一篇 IBM Research 的研究显示,智能体记忆存在明显的剂量效应:强模型适合全量注入,DeepSeek-V3.2 任务完成率提升 9.5 个百分点;弱模型应选精选检索,gpt-oss-120b 提升 16.1 个百分点且仅多消耗 5% token。
Sky Computing Lab 开源 FastMetal,把 FastWan-QAD 视频模型完整搬到 Apple Silicon 上。480P 5 秒视频在 Mac 本地 30 秒即可生成,无需 CUDA 和云端,默认 INT8 量化,最低 3.9 GiB 内存就能跑。对本地创作和苹果生态用户来说,这是一份真正可用的方案。
国外技术博主整理了一份跨平台指南,教用户关闭 Windows、Chrome、Edge、Firefox、Adobe、Slack、WhatsApp 等十余款工具中越来越激进的 AI 功能,反映了 AI 默认开启正在成为新的用户痛点。