第 18 页
阅读模型发布
商汤开源 SenseNova-Vision-7B-MoT:7B 模型打包十余项视觉任务
商汤近期开源视觉多任务模型 SenseNova-Vision-7B-MoT,配套发布 5000 万样本的 SenseNova-Vision Corpus。该模型统一了检测、OCR、GUI、深度与法线估计、分割、多视图等任务,并支持自然语言定义新任务,是少有的模型与数据同步全开放。

模型发布、产品动态和行业观察统一按发布时间从新到旧排列。
商汤近期开源视觉多任务模型 SenseNova-Vision-7B-MoT,配套发布 5000 万样本的 SenseNova-Vision Corpus。该模型统一了检测、OCR、GUI、深度与法线估计、分割、多视图等任务,并支持自然语言定义新任务,是少有的模型与数据同步全开放。


面壁智能CTO曾国洋提出端侧模型是AI落地的关键路径,并发布知识密度每3.5个月翻一番的"面壁定律"。2B参数的MiniCPM对标同期8B竞品,BitCPM-CANN在昇腾芯片上实现同内存多装约6倍模型,端侧AI的硬件与算法拐点正在到来。

腾讯混元发布 HyOCR-1.5,把训练、推理、模型权重完整开源,是首个全栈开放的端到端 OCR 专家模型。1B 参数覆盖 8 类文本任务,引入 DFlash 投机解码,推理最高提速 6.37 倍,在 OmniDocBench v1.6 以 94.74 分居端到端第一。

OpenAI宣布暂时取消Codex与ChatGPT Work所有付费档位的五小时使用限制,并同步推进GPT-5效率优化,活跃用户已突破600万。这是一次面向重度编码与办公用户的算力让路。

微软CEO纳德拉提出"反向信息悖论"概念:企业花钱调用AI,却在交互中把提示词、纠正反馈等专有知识交出去,信息不对称倒向AI供应商。他呼吁企业建立信任边界,掌控自有模型微调与组织记忆归属权。

Hacker News 上一个名为 AIGr.id 的'去中心化智能网络'开源项目,帖子热度极低。但它踩中分布式 AI 这件大事,值得看看它想做什么、卡在哪里。