今日焦点:开源侧 Strata 引擎让 12GB 显存跑起 125B 模型,Beam 与 Mistral Large 4 接连发布;资本侧 DeepSeek、月之暗面、OpenAI 均传出巨额融资。
模型与产品
- Strata 引擎:12GB 显存跑 125B Qwen3.8(ithome)——单张 RTX 5070 达 94 token/秒,本地大模型门槛骤降。
- Reflection AI 发布开放权重模型 Beam(ithome)——501B 稀疏激活,主打代码与智能体,对标 GLM-5.2。
- Mistral Large 4 公开预览(ithome)——号称欧美最强开源模型,月底开放权重。
行业动态
- DeepSeek 接近完成 800 亿元融资(ithome)——腾讯、宁德时代重金参与,总规模或近千亿。
- 月之暗面完成上市前融资,估值约 500 亿美元(ithome)——计划明年一季度赴港 IPO。
- OpenAI 洽谈 300 亿美元融资(ithome)——阿联酋基金或出资 100 亿美元,贝莱德磋商中。
- Meta 与微软要求员工少用 Claude(ithome)——转向自研 AI 节省成本。
开源与论文
- openTPU:AI 自主设计的推理硬件开源(hackernews)——含 RTL、编译器与模拟器,可跑 Qwen3 等模型。
- 热带几何视角缓解灾难性遗忘(arxiv)——逐单元投影器比无重放方法更精细地保留知识。
- 基础模型可从提示线索「推理」(arxiv)——特定线索将 MATH-500 准确率从 42% 提至 78%。
- PermVLA:因子化顺序正则化 VLA 学习(arxiv)——提升机器人动作预测效果。
趋势:开源模型进入低成本运行与开放权重双轮驱动阶段,融资竞赛与硬件自研将加速行业洗牌。