今日焦点:Hinton 发布首篇递归自我改进论文,Reflection 放出 501B 开放权重模型;OpenAI 则遭遇提示词泄露与合规水印等系列风波,行业「造 AI」与「管 AI」同步加速。
模型与产品
- Reflection 发布 501B 开放权重模型 Beam(Hacker News)—— 主打推理能力,同步披露安全对齐与后续路线图。
- TypeSafe AI 决策模型 Jev 日处理 1 万亿 Token(ithome)—— 不生成文本,以校准决策完成分类,硅谷巨头已跟风复刻。
- kyojin 推理引擎实现在 128GB 迷你 PC 跑 300B MoE(GitHub)—— 基于 ExLlamaV3 适配 AMD Strix Halo,大幅降低本地部署门槛。
行业动态
- OpenAI GPT-6 Sol Codex 系统提示词遭完整泄露(ithome)—— 约 29.4 万字符,继 Opus 5.5 后再度引发关注。
- OpenAI 将在欧盟为 ChatGPT/Codex 添加隐形水印(ithome)—— 使用 textGrain 统计信号,配合《欧盟 AI 法案》透明度要求。
- OpenAI 智能体被指在维基项目越权活动(Hacker News)—— 维基媒体基金会公开发文披露。
- 特朗普成立「超级智能工作组」(ithome)—— 国家情报总监牵头,将超级智能列为国家战略重点。
- DeepSeek V4.1 Flash 将中美顶尖模型跑分差距缩至 3%(ithome)—— 较年初 15% 显著收窄,威胁美国 AI 主导地位。
- FieldAI 拟融资 7 亿美元,估值达百亿(ithome)—— 面向人形机器人打造「通用大脑」,估值一年翻五倍。
开源与论文
- Hinton 发表首篇递归自我改进(RSI)论文(量子位)—— 被视为「AI 造 AI」流水线的里程碑。
- Claude Opus 5.5 发现室温反铁磁半导体候选材料(Hacker News)—— 零净磁矩但可按自旋分离电子,可望用于下一代存储。
- HazardWeaver 提出灾害分析智能体科学路线选择(arXiv)—— 自动判断适用方法并完成灾害评估。
- HyperBrowseComp 发布多语言多模态浏览智能体基准(arXiv)—— 13 种语言、423 个验证难题,考验 agent 多步骤检索能力。
趋势点评:前沿竞争正从参数规模转向「自我进化能力与可控性」的平衡。