第 3 页
阅读智能体记忆不是越多越好:IBM Research 八款模型实测给出剂量表
Hugging Face 博客上一篇 IBM Research 的研究显示,智能体记忆存在明显的剂量效应:强模型适合全量注入,DeepSeek-V3.2 任务完成率提升 9.5 个百分点;弱模型应选精选检索,gpt-oss-120b 提升 16.1 个百分点且仅多消耗 5% token。

模型发布、产品动态和行业观察统一按发布时间从新到旧排列。
Hugging Face 博客上一篇 IBM Research 的研究显示,智能体记忆存在明显的剂量效应:强模型适合全量注入,DeepSeek-V3.2 任务完成率提升 9.5 个百分点;弱模型应选精选检索,gpt-oss-120b 提升 16.1 个百分点且仅多消耗 5% token。


Sky Computing Lab 开源 FastMetal,把 FastWan-QAD 视频模型完整搬到 Apple Silicon 上。480P 5 秒视频在 Mac 本地 30 秒即可生成,无需 CUDA 和云端,默认 INT8 量化,最低 3.9 GiB 内存就能跑。对本地创作和苹果生态用户来说,这是一份真正可用的方案。

国外技术博主整理了一份跨平台指南,教用户关闭 Windows、Chrome、Edge、Firefox、Adobe、Slack、WhatsApp 等十余款工具中越来越激进的 AI 功能,反映了 AI 默认开启正在成为新的用户痛点。

Modular 把 Mojo 语言连同编译器、工具链以 Apache 2.0 许可证整体开源,但编译器层面的外部贡献暂不接受,计划年底前放开。本文拆解开源边界、对开发者和企业的实际影响,以及中文用户该如何跟进。

NVIDIA CEO 黄仁勋近期在 X 平台发布长文,延续他对推理模型与物理 AI 的判断,强调算力正从训练驱动转向推理驱动。对中文开发者与企业用户意味着什么,值得拆开看。

宇树科技定档 8 月 19 日科创板上市,发行价 150.80 元/股,对应市值约 610 亿元,2025 年净利润 2.78 亿元。A 股迎来"人形机器人第一股",行业关注点从发布会演示转向真实回款能力。