全部专题

大模型与推理

覆盖大语言模型、推理部署、GPU、开源模型与模型能力更新。

84 篇已发布内容
模型发布

GPT-5.6 系列登陆 Kiro:AI 编程工具开始卷成本

OpenAI 将 GPT-5.6 模型家族接入软件开发智能体 Kiro,含 Sol、Terra、Luna 三款。Terminal-Bench 2.1 测试显示,GPT-5.6 Terra 在 Kiro 内完成任务成本下降约 82%。这次更新由 OpenAI 与 AWS 合作优化,主打更低迭代次数和更高 token 性价比。

阅读全文
模型发布

DeepSeek-V4-Pro 正式版发布,Agent 能力成最大升级看点

DeepSeek 在 API 更新日志中正式推出 V4-Pro 模型,APP、网页端与 API 三端同步开放,模型名为 deepseek-v4-pro。新版本主打 Agent 能力,HLE 带工具成绩 60.0、Terminal Bench 2.1 跑出 87.9,适合需要稳定工具调用和长任务执行的开发者和团队。

阅读全文
模型发布

RLHF 作者亲历:AI 改得了稿,却搭不出一章书

知名 RLHF 研究者 Nathan Lambert 写完教科书后反思:当前大模型在长文非虚构写作上几乎原地踏步,编码和数学任务却已接近超人水平。他点出 GPT-4.5、Kimi K2 等写作模型正在老化,长文结构仍是 AI 写作的真正短板。

阅读全文