Fable 5 一把搓了个 2,319 行游戏?我看到那 45 分钟烧了 €20 时蚌埠住了

讲真,HN 上挂着 94 分、81 条评论冲上来的那条 Shepherd's Dog: A Game by the Most Dangerous AI,我一开始以为是又一个蹭 Claude Fable 5 噱头的 demo。

结果点进 koenvangilst.nl 那篇 1 min read 短文一看,作者 Koen van Gilst 原话写着:The model started with a very long reasoning session, and after 45 minutes and more than €20 worth of tokens (!), it happily reported that Shepherd's Dog is complete — a single 2,319 line index.html with zero dependencies.

我本来以为这种话是 Anthropic 软文。Anthropic 把 Fable 5 包装成世界上最危险的 AI 模型,连 system card 都给你列出一堆 refusal / silent nerf / 数据保留 30 天的事——你跟我说它居然能耐下心搓游戏?

然后我去翻他 GitHub 那个 when-ai-fails 仓库(github.com/vnglst/when-ai-fails),发现他列了一堆 earlier models 做的失败尝试——也就是说,这不是他第一次用 AI 试做 Shepherd's Dog 这个他 had for years 的游戏想法,是试过很多次都不行。这一次 Fable 5 是头一回 one shot 跑通。

我个人认为这个角度比笼子或 silent nerf 或数据保留那几篇评论都更值得讨论。

我抽个时间把 81 条评论里前 30 条都过了一遍,争议点其实集中在三个。

一是 €20 一把搓 这个成本。81 条评论里至少 12 条在算账:€20 大约是 22 美元,按 Fable 5 xhigh 档 $30/M input + $150/M output 倒推,45 分钟的 reasoning + 一次生成 2,319 行 HTML,这 output token 数大概在 60k-80k 之间——也就是说 Koen 这 €20 里有 60-70% 是 output 阶段付的。

二是 one shot 这个词的边界。几个老 HN 评论员(id 是 steveklabnik 那种深口袋用户)在抠定义:Koen 的 one shot 是说最终交付一次成型,但他截图里显示 Fable 5 内部先跑了一个 very long reasoning session——这算不算 shot 之前的内部规划?评论里 argue 来 argue 去没有定论。

三是 zero dependencies 这个 safety 层面的解读。Fable 5 拒绝给你装 npm 包、拒绝给你调外部 API、拒绝生成需要联网的代码——但同时它能给你写 2,319 行纯前端 index.html 这种零依赖的活儿。这个 81 条评论里有个高赞评论员打趣说:Anthropic 把 LLM 训成了一个超贵的离线玩具。

我站 Koen 这一边。理由很简单:他那个 when-ai-fails 仓库是 open 的,失败的尝试都列着,没在表演我运气好。一个人拿自己卡了好几年的游戏 idea 当 benchmark,跨多个模型反复试,最后 Fable 5 一次跑通——这个叙事链条是硬的。

但有个事我现在还没完全搞懂:Fable 5 内部那个 very long reasoning session 到底跑了多久?是 30 分钟都在想架构,然后 15 分钟写代码?还是反过来?如果主要是推理阶段在烧 token,那意味着 Anthropic 在 reasoning-heavy 输出这个产品形态上找到了差异化——因为大多数闭源前沿模型是不敢让你看到 reasoning trace 的,OpenAI o-series 也是只给摘要。这个我还不太了解,等更多 benchmark 数据。

还有一个细节我比较在意:Koen 那 2,319 行 HTML 是 zero dependencies,但他仓库里链接的视频我看描述里说是有手绘 sprite 的——也就是说这个游戏是 Fable 5 把 asset 也画出来一次性塞进 HTML 里?我没看到明确说 SVG 还是 base64 内嵌,这块现在还没搞懂。

讲真,看完 Koen 这 1 min read + 81 条评论,我反而对 Fable 5 的看法做了一次大转弯——之前看 system card 一堆 safety 限制,我以为这个模型就是个高配 Opus。但 Koen 这 €20 一把搓的事,加上评论区那个离线玩具的梗,让我重新评估它。Anthropic 真的找到了一条独特路径:拒你调用一切外部资源,但能耐下心做长任务一次成型。

你们呢?你愿意为这种 45 分钟 €20 的一次成型 demo 付钱吗?还是你更想要 GPT-5.5 那种快但散的交互?哪个最让你觉得 AI 编程的未来被锁死了?

posted @ 2026-06-13 19:08  Ninghg  阅读(19)  评论(0)    收藏  举报