← 收录原文
BUILDERS · 精选整理

Builders 精选|2026-06-23

2026-06-23 · 历史整理稿

X / 推特

Latent Space 播客主理人 / AI Engineer 创始人 swyx

swyx 在为自己新成立的 New Media Lab(承载 swyx inc 的创意工作室空间)挑选保险供应商,意外在创作者人群里发现 Corgi 这家保险公司的口碑高得离谱。他的房产中介给的反馈是「Corgi 现在覆盖了我手上每一个客户」,接近 100% 的全新增量市场占有率,他说这种渗透速度在保险这种老行业里基本闻所未闻。一家专做创作者经济细分人群的新保险公司能跑出近乎垄断的口碑,对应的是「老市场被新需求重新切分」的典型机会窗口。对正在搭建独立工作室、内容公司或一人公司的同行,他的隐含建议是别再默认大保险公司,小而专的玩家可能在 NPS 和合身度上都更强。

OpenAI Codex 与 ChatGPT 团队 Thibault Sottiaux

OpenAI Codex 团队的 Thibault Sottiaux 透露 Codex 现在支持把每周/每月的 usage reset 额度「存起来」(bank),不再像以前必须立刻用完。他向社区抛了一个偏 PM 性质的问题:大家是会囤着不舍得用,还是直接拉满不心疼?并由此引出他真正想要的反馈,Codex app 里现在有哪些地方不够 delightful、需要团队优先改?对重度 Codex 用户,这是一个被产品团队直接听见的最快通道,如果有中断重连、上下文丢失、CLI 行为、计费体感等具体痛点,现在可以直接回复他。从外部观察,他用「先发功能、再公开征集摩擦点」的方式做迭代,是 OpenAI 团队当下和社区的典型互动节奏。

150K+ 订阅 newsletter 作者 Peter Yang

Peter Yang 转载了一段 @liu8in 关于「HTML 为什么是 agentic 视频生成底座」的洞察:对方一开始想做视频 agent,但发现 LLM 没有视觉智能,直接生成视频跑不通;转向 HTML 之后突然顺了,因为 HTML 是 LLM 的母语,LLM 不仅能用 HTML/CSS/JavaScript 表达信息,还能表达视觉美学,镜头、图片、素材、SVG 都可以挂在 HTML 这一层之上。配套 demo 是从任意网站 URL 一键生成产品视频。他另外推荐了好友 Kevin 做的 ferryman.io,一次写一次发,自动把内容分发到 7+ 个社交平台。最后一条是个人反思,从小作为移民养成的「省着花」心态,在 unlimited token 时代变成了「不烧爆 limit 就是浪费」,这种认知错位他自己也没想清楚怎么处理。对正在做 video agent、产品演示、自动剪辑的 builder,「LLM 用 HTML 间接做视觉」这条路径值得放进备选方案重新评估。

Linear 产品负责人 Nan Yu

Linear 产品负责人 Nan Yu 引用了一句「Quality is irrational」并展开:做出真正高质量的产品需要两种「非理性」,一是非理性地坚持每一次都为质量做选择,即便短期 ROI 算不过来;二是非理性地相信从顶到底自己掌控,会比直接套通用框架跑出更好结果。这是对当下「拼 framework、复制 best practice」主流路径的反向押注。Linear 在工具品类里的差异化,正好来自这种 top-to-bottom 控制(动效、键盘体感、密度、字体细节全部自己拍板),所以这条算是 Linear 公开亮出自家方法论。对正在做 0 到 1 工具产品的同行,他的隐含建议是,用框架可以快速到 80 分,但要做出让用户「irrational」喜欢的产品,只能 irrational 地自己做。

Vercel CEO Guillermo Rauch

Vercel CEO Guillermo Rauch 抛了一条值得反复咀嚼的金句:「Coding agents will squeeze every ounce of IKEA effect out of you, if you let them.」翻成中文是,只要你放任不管,coding agent 会榨干你身上每一盎司「宜家效应」。宜家效应指人对自己亲手参与组装的东西会产生超出实际价值的偏爱,他用这个词警告,当你让 agent 包揽大头、只在几个角落改两句代码,你仍然会产生强烈的「这是我做的」拥有感,从而失去对结果的客观判断力。言下之意是,「自己写哪一段」必须有意识地划边界,否则 vibe-coding 会同时榨干你的判断力和成就感。他另外提到 v0 团队在性能上下了大功夫,从绘制、布局、WebGPU shader 到阻塞脚本,每一帧都被检视优化,并承诺会把这次踩坑经验回写到 Next.js 文档。对所有 vibe-coding 重度用户,前一条提醒比后一条产品更新更值得停下来想:你现在写的代码,有多少其实已经不在你脑子里了?

Box CEO Aaron Levie

Box CEO Aaron Levie 关注了 Sakana 新发布的 Fugu 模型:对外只暴露单一 API,内部用一队专家模型协同(mixture of models)处理任务,简单问题自己干,复杂问题自动调度多模型协作,verification 和 synthesis 全在系统内部完成。他认为这正是当下应用层 AI 公司搭建 agent harness 的通用范式,而 Sakana 把它做成开发者可以直接调用的 LLM 这一步本身就有价值。随着前沿闭源模型和 OSS 模型都在持续放出,「能把任务路由到最佳模型」的中间层会在下一阶段捕获巨大价值。Levie 另一条预判更狠:agent 用软件的频率会是人类的 100 倍,一次 agentic query 拉取的数据可能比一个用户整月手动操作还多;CRM、文档、企业知识、analytics 数据会被 agent 比人多消费几个数量级。这意味着会催生一组新需求:agent 防护栏、权威数据源、调用日志和审计、人机协作通道,确保 agent 不漏数据、不改错关键字段。对 SaaS 公司,这就是路标,谁能率先把产品改造成「为 headless agent 提供能力」,并把商业模式和技术路径同步调整过来,谁就拿到下一个周期的位置。

Cursor 设计师 Ryo Lu

Cursor 设计师 Ryo Lu 又给他的 ryOS(网页版怀旧 Mac OS)加了新应用 Books,支持任意 EPUB 文件、读到哪儿自动跨设备同步到 ryOS 账号,界面是怀旧木质书架。整个开发路径很说明问题:他先在 Cursor mobile(手机端 vibe-coding)起骨架,再手动调动画和纹理直到「感觉对了」。换句话说 LLM 包了 80% 体力活,设计师在最后 20% 注入审美和手感,这是 Cursor 内部产品人对 vibe-coding 工作流的现身示范。对独立产品人,ryOS 系列也是一个很好的研究样本,一个人把怀旧设计、实用工具、自有账号体系串成一个自洽小生态,正是当下「单人小宇宙」的代表案例。

Y Combinator CEO Garry Tan

Y Combinator CEO Garry Tan 重提自己开源的 GBrain,并给出 2026 这个时间点的判断,回头看会发现「拥有自己的 personal brain 和 company brain」是被严重低估的事。他的逻辑链是,AGI 已经站在可用门槛上,智能本身正在变成商品化输入;真正的解锁不是「问 AGI 一个问题」,而是把你个人和公司的私有 context 系统化沉淀下来,AGI 拿到这层 context 才能为你产生独占价值。换句话说,智能由模型方提供,context 必须你自己造。这也是他做 GBrain 并开源它的动机。对创业者和 builder,这条等于在催促,别再只把对话留在 ChatGPT 或 Claude 的临时上下文里,认真搭一个能持续喂自己上下文的「我自己的 brain」,越早开始复利越大。

独立 builder Zara Zhang

独立 builder Zara Zhang 给出一条防 AI slop 的经验法则:看你输入的 context 长度是否大于输出长度。她自己的实践是输入通常是输出的 3 到 5 倍,只要输入明显短于输出,产物几乎一定是 slop。这条规则的潜台词是,质量不来自 prompt 工程,而来自上下文密度,AI 不会凭空创造价值,它在压缩、重组、改写你提供给它的素材。她在后续回复里也特意补刀:「我说的是 context,不是 prompt。」对正在做内容、设计、文档、代码生成的 builder,这条可以直接当 ROI 标尺,要么先花时间把 context 攒厚,要么接受输出注定是平均水准。

OpenClaw 联合创始人 / OpenAI Peter Steinberger

OpenClaw 联合创始人 Peter Steinberger 出来回应了社区对 OpenClaw 现状的讨论,外界的热度确实降了,但内部一直在抓质量和扩团队,同时把项目搭成非营利组织,跟那些拿 VC、各自有商业议程的竞品形成鲜明对照。他直接亮数据,这是 OpenClaw 至今最强的一周。隐含 framing 是「我们不被热度推着走、也没融资压力,正好可以慢慢做对」。另外两条信号也值得留意,他公开表示对当下流行的 multi-model routing 持怀疑,并说「我的直觉果然是对的」;以及他正在试一种新工具消费 Twitter,等于不再用传统时间线读 Twitter。对关注独立 AI 项目治理路径的人,「非营利 + 长跑」在 OpenClaw 这里跑出了一个新的样本。

播客

Training Data — Google DeepMind's Logan Kilpatrick: Why the Model Eats the Harness

核心要点: 「今天我们说的『model』已经不是 2024 年那套裸权重了,而是一整套不断扩张的系统;agent harness 在 2026 年看起来是最大 alpha,但 12 个月内模型会把它消化成原生能力,alpha 必然移到别处。」这是 Google AI Studio 与 Gemini API 负责人 Logan Kilpatrick 对当前 LLM 行业最反共识、也最值得停下来吸收的判断。

Logan 出场的时机正好是 Google I/O 刚结束、Antigravity 发布、Gemini 3.5 Flash 用纯 post-training 反超前代 Pro 模型,信息密度极高,主线是「agent 时代 Google 怎么打、harness 怎么被模型吃掉、单一 omni 模型如何取代过去 8 个垂直模型」。

第一,Antigravity 不是一个 IDE,而是 Google 下一代 agent 通用基座。Logan 拆得很清楚,Antigravity 同时是 IDE、网页端 agent-first 体验、CLI、SDK,也可以通过 Gemini API 调用 managed agent。同一套 agent harness 现在跑在 Search、Gemini app、Cloud、AI Studio 等所有 Google 产品里。以前 Google 上百个产品没有公共主线,Gemini 出来之后是「模型」这条线,Antigravity 出来之后变成「agent harness」这条线。换句话说,Google 把 agent harness 当成下一代 Gemini 去用。

第二,「the model eats the harness」是本期最核心的工程判断。Logan 直说:「两年前 LLM 就是一组 weights,token 进 token 出。今天我们还叫它 Gemini 3.5 或 GPT 几,但它已经是一整套围绕权重生长的系统,agentic tool calling、hosted tools(search、code execution)、容器化沙箱、agent harness 都贴在外面。scaffolding 先走半步,然后模型把 scaffolding 吃掉,变成原生能力。」对应给独立开发者的明确建议是,别把「自己写 harness」当成长期 alpha 押注,12 个月内模型会原生具备这些能力,alpha 必须提前往别处搬。

第三,coding 已经事实上是 narrow superintelligence。Logan 直言「coding is just so good that it does kind of feel like narrow superintelligence」,并坦诚自己的体感:「我作为开发者反而拥有了更多 agency,以前那些刚好够不到的 idea 现在都能做。现在的问题反而是,我得把目标定得更野心一点才行。」他认为接下来出现 vertical superintelligence 的领域是 verifiability 高的:math、finance、science。科学他格外强调,因为「让正面影响尽早 happen」对整个 AI 叙事至关重要。

第四,Omni 是真·单模型,不是路由。Gemini Omni Flash 把过去要训练 8 个独立模型才能覆盖的能力(text、audio、Lyria 音乐、Nano Banana 图像、Veo 视频等)合并成一个模型,「不是 route 到不同模型,这是真正的 omni 模型」。当前对外可用主要是视频编辑能力。他在台上演讲时被观众用 Omni 实时往现场视频里加了一只跳上他大腿的狗,模型连旁边嘉宾低头看狗、轻笑的微表情都处理对了,这种细节的世界理解力让他自己也在「消化这到底意味着什么」。

第五,vibe-coding 的体量已经上量。AI Studio 上一周内被建出 350,000 个 Android 应用,他强调「这 350,000 个 app 里大多数本来根本不会被人写出来」。最流行的品类不再是游戏,而是 20% 金融与 crypto、20% 个人生产力、20% gen media,意味着 software 生产端正在被打开。

结尾他留下一句对整个生态最值得记住的 framing:「There's never been more opportunity to go and build something. At the same time, the models are doing more than they've ever done before.」focus 仍然是 startup 的超能力,大公司被迫做一堆事所以无法 focus,这正是 vertical builder 的窗口。