← 收录原文
BUILDERS · 精选整理

Builders 精选|2026-06-24

2026-06-24 · 历史整理稿

X / 推特

Latent Space 主理人 Swyx

Swyx 抛出一个少有人算清楚的账:把 OpenAI 当成「NeoCloud + NeoLab」一体的复合体来看,它对 Cursor 的投资已经靠 compute 销售合同回本了大约一半。剩下一半如果 Composer 3 跑通就完全 paid for。他认为目前没有第二家公司同时既是顶级 model lab 又是 NeoCloud(至少在 GPU 维度上),这是一种极其有效的组合。前提是公司必须事先想清楚 in-house 训练所需的 GPU supply 怎么调度。而且这个调度方案要同时 hedge 两种情况:训练大成或者训练不及预期。这个视角把 OpenAI 的资本运作和算力供给当作同一张牌来看,比单纯把它当成 AI 公司更接近真实经济模型。

OpenAI Codex 与 ChatGPT 团队 Thibault Sottiaux

Thibault 宣布 OpenAI 推出 Patch The Planet 计划,同时发布更新版 codex 安全能力和新的 GPT-5.5-Cyber 模型,主题是「加速 cyber defense」。这是 OpenAI 把安全研究方向从「发现漏洞」推进到「主动修复漏洞」的明显转折。他把发布日定义为「网络防御加速的庆祝日」,配合 Sam Altman 同日的官方推文形成完整打包。意图是把 GPT-5.5-Cyber 推向 CyberGym 等基准并跟美国政府以及安全生态合作。从 Codex 内部视角看,这次更新代表 OpenAI 把 agentic 编码能力延伸到了 security 这个高 stakes 领域。

AI 实战内容创作者 Peter Yang

Peter 这一天连发三条都跟 AI 实操有关。一是吐槽 Claude Code 里 dynamic workflow 文档没讲清楚什么时候该用,他读完仍然不明白 dynamic workflow 究竟是什么,间接反馈 Anthropic 在 onboarding 这块还不到位。二是在征集一位擅长用 Codex 或 Claude Code 做 pixel art 或 threejs 小游戏的嘉宾上他的播客,他强调自己是 gamer at heart,想正经聊清楚怎么做。三是怼最近流行的「父母 vs AI」ragebait 短视频套路:挑最易激怒的瞬间剪辑、拿走巨量转发流量。他承认自己也中招了。并指出哪怕只有一位家长看完视频就决定忽略孩子,伤害也已经造成。

Vercel CEO Guillermo Rauch

Guillermo 当天公布两个 Vercel 的新能力。第一是 Claude Design 到 Vercel 实现一键部署,把 Anthropic 那边 Claude 直接生成的设计搬到生产 hosting。path 进一步缩短到「设计稿到公网可访问」只需要点击一次。第二是 Vercel 现在原生支持 WebSocket 以及 socket.io,从 CDN 一路打通到 Fluid 运行环境。这对实时应用、聊天、协同编辑这类场景极其关键。他给 Vercel 这条加了一句「full circle moment」,因为 socket.io 早年就是他主导写的开源项目,等于把当年的 OSS 项目带回了自家平台。

Box CEO Aaron Levie

Aaron 抛出一个比较 contrarian 的判断:几乎所有 AI 模型和 agent 的进步都是 evals 的下游。开源权重的 domain 后训练靠 evals,应用层 agent 改进靠 evals,企业级 agentic 部署能否真正 augment 工作还是靠 evals。他直接喊「It's all evals」。并推出推论:未来任何企业的核心能力之一就是 evals。哪家公司能最准确地理解自己(或客户)工作流以及 agent 在其中表现得多好,谁就最有资格驱动真实的自动化。同日 Box 把 HTML 文件升级成一等公民:可以预览、编辑、版本管理、安全分享 HTML。明确瞄准「agent 产出的 HTML 内容能立刻可用」的场景。

Cursor 设计师 Ryo Lu

Ryo 在 Cursor Compile 大会做了一场 talk,主题是「在 AI 时代如何 build 产品,以及哪些东西是不变的」。他放出 YouTube 完整录像供围观。没有透露 PPT 细节但点出关键 framing:变化的是 build 的方式与速度,不变的是 craft 与 taste。对设计师以及 PM 这种处在 vibe coding 浪潮里担心被替代的角色,他想传递的是工具变了但判断力依旧稀缺。这场分享值得对照 Mike Krieger 同日在 AI & I 的 podcast 一起看。

Y Combinator CEO Garry Tan

Garry 这天最实质的发言落在加州税收政策上。他批评 California asset seizure tax 会让州政府更穷、医保资金被挤压。并直接点名 SEIU UHW 工会:哪怕护理质量和州的护理能力都被这场博弈拖垮,他们也不在乎,只剩 pure self interest。这是他延续 SF Dem 加速派立场的一次发声,针对 health care 资金链条。同日他还推荐了两件 SF 本地内容:Illuminate 的 Ben Davis 本身就是 SF treasure 级人物。以及 7x7 在 SF City Hall 的装置展,7 月 4 日就撤展,值得本地人去看一眼。

Builder Zara Zhang

Zara 发布了一个 11 分钟的 YouTube 完整 walkthrough。对象是她那个在 GitHub 已经攒到 22000+ star 的 Frontend Slides skill。她拆解了四件事:怎样用 Claude Code 做漂亮的 HTML slides(对新手友好)、她当初是怎么把这个 skill 创建出来的、读者要怎么自己写 skill。以及具体技巧比如怎样在 deck 里塞图片视频、怎样发布出去。最后她还回顾了开发过程中踩到的坑。对正在折腾 Claude Code skill 体系的人来说,这是一份从作者本人视角出发的实战课。

OpenAI CEO Sam Altman

Sam 在 Patch The Planet 发布日给出官方表态:OpenAI 想帮助所有公司变得安全,会跟美国政府以及整个安全生态协作。三个 highlight:完整版 GPT-5.5-Cyber 已上线。在 CyberGym 上拿到 state of the art performance。Patch The Planet 以及 Codex Security 把目标从「发现安全问题」推到「解决安全问题」。这是 OpenAI 罕见地把企业级安全、政府合作、agentic 编码三件事在同一个发布日打包做势,姿态相当主动。

播客

AI & I by Every — How Anthropic Uses Claude Fable 5 With Mike Krieger

核心要点: Mike Krieger 用了一个多月 Fable 5 之后的结论是,他的 workflow 已经不再围绕「输入 prompt 等回答」,而是变成「晚上 say goodnight 给 Claude,第二天看它把 monoclass 级别的任务从头跑通」。这不只是性能提升,是 work 本身的 modality 在迁移。

Mike Krieger 现在是 Anthropic Labs 负责人,也是 Instagram cofounder,今年早些时候刚从 CPO 切回 builder mode。他和 AI & I 主播 Dan Shipper 录制时距离 Fable 5 公开发布还有一天,但他在内部已经连续重度使用了一个多月。所以他给出的 take 不在 day-one impression 层面,而在「重度用户在 Fable class 下被迫重学怎样使用模型」这一层。

他描述了一个反直觉的现象:自己作为资深工程师,第一次摸 Fable 5 的感觉是 newbie again。原来的 prompting 方式、task decomposition 习惯、interactivity model 都过时了。具体到日常,他现在会先跟模型做一段 architectural planning conversation,把 infra abstraction 的层级讨论清楚,再让它产出一份 HTML page 或 markdown diagram 拿去跟团队对齐。然后才是真正的 execute 部分,常态是 5 到 6 个并行 Claude Code session 跑长 horizon 任务,主线程则保留一个高 context、低延迟的 Claude 用于即时 ping。他甚至开始为 Fable 设置 effort levels:tweak UI 这种小活动手调到 medium,他在 Opus 上从来没这么做过,因为 Fable 的 range 比 Opus 明显更宽。

成本话题他给出了非常实操的判断。Fable 比 Opus 贵,但「贵」要看怎么衡量:per-turn cost 是一回事,complete to satisfaction 的总成本是另一回事。他原话是:「it actually just does it right so that I don't have to go spend the, like, nine, ten subsequent turns be like, no. That was not quite what I meant.」对企业用户他建议从「KPI 是 spend 多少」的 phase 2 跨进 phase 3,看「谁用得有效」并允许这些人放量花钱。对个人 hobbyist 用户,他的实测是一个 weekend 写完整个 media tracker app 也只多了少量额外消耗,并没夸张到几千美元一个项目。

模型训练上最让他印象深刻的进化不是 raw IQ,是「系统感」。Fable 会在你跑了几天 session 之后冷不丁回头说:你那个 feature flag 还没打开,这事跑不通。或者在 code review 场景下,面对另一个 Claude reviewer 的意见会先思考再选择性 push back,而不是无脑「Yeah you're right, fixing」。他认为这种 judgment 的出现,是 Fable 相比上一代最关键的飞跃,跟 Claude Code 在 every 这类深度用户那里跑真实多日任务的反馈链路高度相关。

verification loop 这一块他给了具体做法。所有 PR 强制带 screenshot gallery 或者 video。对动画卡顿这种 screenshot 抓不到的问题,他直接把 FFmpeg 抓出来的视频丢给 Claude 让它 scrub through 找 jank。复杂后端无法本地起的时候,让 Claude 一次性 mock 出 in-memory 替身,再由 Claude 自动跟着 upstream 改动同步 mock 实现,把以前 SRE 最头疼的 mock 漂移问题彻底交出去。dynamic workflows 是另一个被他强烈推荐的工具:他用一个 workflow 让 Fable 在周末把一个 Python 代码库整套 port 到 TypeScript 加 Bun,模块逐个翻译、增量测试、adversarial test、覆盖检查,全部 self-orchestrate 完成。他认为这种 capability 加 workflow 的组合让长 horizon 任务才真正可被托付。

至于「software engineering 是不是终结了」这个问题,Mike 的回答是 software engineering 已经被重构。craft 的内核还在,只是从「在 TextMate 里把 Django ORM 调通」转移到「定义 intent 加验证 加系统性 ownership」。他说每个 human 还是会有 DRI(directly responsible individual),因为 product intent 这些 context 是 Claude 触不到的。最大的变化是 prototype 变成了真正的 argument-winner:PM 直接 build 一个能跑的版本去说服团队,不再靠 PPT。