AI 编程 › AI 资讯 › 正文

Show HN: Pac-Bench – How well can models one-shot a Pac-Man game?

hackernews · Hacker News · 2026-09-29 06:43 · 评分 85

Pac-Bench 基准测试让多个模型仅凭一条提示词一次性生成单页版 Pac-Man 游戏,不允许追问或修复,用于衡量模型的一次性代码生成能力。项目在 Hacker News 发布。

原文:Hacker News | 返回 AI 资讯列表