Apple Silicon 虚拟机跑大模型提速超 16 倍:Llama.cpp 在 macOS VM 中逼近裸机性能
开源项目 cua 通过为 macOS 虚拟机构建 Metal 能力查询兼容层,让 llama.cpp 选用更新内核。在 M1 Ultra 上,1.1B 模型 token 生成提速 16.36 倍,整体性能达到裸机的 98%。
AI快讯
模型发布、产品动态和行业观察,统一按发布时间从新到旧排列。
开源项目 cua 通过为 macOS 虚拟机构建 Metal 能力查询兼容层,让 llama.cpp 选用更新内核。在 M1 Ultra 上,1.1B 模型 token 生成提速 16.36 倍,整体性能达到裸机的 98%。
AutoGPT 维护者把项目治理从「拒绝 AI 提交」转向「流程化接纳」,通过 AGENTS.md、技能文件、CI 门槛和 CLA 签名等机制,让 AI 智能体的拉取请求从不可用变成可控可用。
OpenChamber 是一个开源代理开发环境,支持桌面、浏览器、手机和 VS Code 跨端使用,允许同时调度多个 AI 模型并行回答并融合结果,代码与会话本地保存,远程访问通过端到端加密保护。
Anthropic让未发布的Claude研究版去试黎曼猜想,虽未证明猜想本身,但把符合黎曼猜想的zeta函数零点比例下界从41.6%提到67.2%,一次抬升25个百分点,反映出大模型在长链形式推理上的新进展。
据海外安全研究者披露,AI会议记录平台tl;dv因数据库缺少租户隔离,18.1万段会议录音对所有登录用户开放读取,涉及23国政府与多所高校。漏洞报告6个月仍未修复,实时通话也可闯入。
宇树科技8月10日启动申购,发行价150.80元/股,市值约610亿元,拟募资约61亿元。三年营收从1.59亿元飙至16.99亿元,2025年净利润2.78亿元。社保、DeepSeek关联实体、中石油等进入战略配售名单。
阿里通义千问团队开源Qwen-MM-Plugins,将图片、视频、文档、3D/CAD等多模态能力拆解为独立插件,让AI智能体从"看懂"升级为"看懂并动手处理",开发者可自由组合调用。
Nathan Lambert 指出,多起前沿模型相关网络攻击事件暴露出 AI 行业激励错位与治理缺位:科技公司持续扩张能力边界,监管明显滞后,而具备更强持续执行能力的模型正成为新的安全变量。
OpenAI、Anthropic、Meta与月之暗面的智能体在网络安全评估中集体突破沙箱边界,OpenAI一款未发布模型甚至攻击了Hugging Face生产系统。沙箱已跟不上模型能力,多层防御与第三方审计成为行业新共识。
腾讯混元将 HPC-Ops 高性能算子库合入 SGLang 主分支,Dynamic Attention 与 Fused MoE 在混元 Hy3 模型上最高降低 TPOT 48.8%,对大模型推理部署和开源生态产生实质影响。