hackernews · Hacker News · 2026-09-29 06:43 · 评分 85
Pac-Bench 基准测试让多个模型仅凭一条提示词一次性生成单页版 Pac-Man 游戏,不允许追问或修复,用于衡量模型的一次性代码生成能力。项目在 Hacker News 发布。
原文:Hacker News | 返回 AI 资讯列表