← 收录原文
BUILDERS · 精选整理

Builders 精选|2026-05-09

2026-05-09 · 历史整理稿

X / 推特

Box CEO Aaron Levie

Token 预算管理正在成为大型企业的热门话题。随着 agent 可以执行越来越长的任务、消耗越来越多的算力,如何在团队之间分配 token 额度已经成为真实的企业管理问题。Levie 指出,企业在人才、营销、活动、设备甚至午餐方面都会精细管理预算,token 也不会例外。更关键的挑战是:必须确保不把当月预算烧在低价值任务上,而在高价值任务需要资源时却没有额度。大公司在这件事上特别困难,因为 agent 执行的数字工作缺乏中央可见性和控制层。他预计 agentic 支出将逐渐从 IT 预算中溢出,进入各业务部门的运营预算,并催生专门解决这个问题的新软件创业机会。

Y Combinator CEO Garry Tan

Garry 对一个在 128GB MacBook Pro 上运行、支持 100 万 token 上下文窗口且具备可用 coding agent 能力的模型感到震撼,已经开始下载测试。他表示"个人软件"时代正在到来,并分享了一个实用技巧:让 coding agent 用 ASCII 画图做各种系统图,通过持续提问来迭代理解复杂系统。

Builder Zara Zhang

Zara 在 AnyGen 上发布了 32 款精美 HTML 幻灯片模板,即插即用,不需要 coding agent 也可以使用。她还构建了一个"YouTube 实时副驾驶"浏览器扩展,使用 OpenAI Realtime 2 API,agent 会在你观看视频时同步收听,可以通过实时语音对话回答关于视频内容的任何问题。她特别指出一个技术亮点:扩展能够区分 YouTube 的音频流和用户自己的声音,不会把视频内容当成指令,也不会在用户没有发问时主动回应。

FPV Ventures 合伙人 Nikunj Kothari

Nikunj 分享了一段他自己使用的 custom instructions,用于解决"模型按人类执行时间估算任务,而不是按模型执行速度估算"的问题。这段 instruction 要求模型:用模型执行单位(秒、分钟、tool calls、迭代次数)而不是人类工时来估算;区分模型可以独立完成的部分和需要人类配合的部分(如 API 注册、凭证、部署等);将阻塞模型工作的人类步骤标注为 gating step;如果任务完全需要人类,就明说而不是制造一个模型计划;如果模型可执行部分足够短,直接提出"现在开始执行"而不只是规划。

Every CEO Dan Shipper

Dan 对 Claude Mythos 发表了冷静的观察:基准测试衡量的不只是模型能力,还包括人类为让模型能力"显现"所做的提示词工程工作,这项工作本身就需要有经验的人去做,很像一种专业职位。他认为为 Mythos 的基准成绩而恐慌或亢奋都是简化的。

OpenAI CEO Sam Altman

Sam 分享了一个日常画面:启动一批 Codex 任务,然后带孩子去阳光下玩耍,午睡时间回来发现任务全部完成,这让他对未来充满乐观。他还调侃新模型 GPT-5.5 是"有着奇怪品味的自闭天才"。

Anthropic 对齐研究员 Amanda Askell

Amanda 表示,对齐研究往往聚焦于防范有害行为,但她真正兴奋的是其正面愿景:能够给 AI 模型一个诚实且积极的自我认知,让它理解自己可以成为什么,以及为什么。她对这个方向的未来充满期待。

Roblox 产品经理 Peter Yang

Peter 提出了一个高赞的 Claude Code 用户反馈:有时发送消息后,Claude Code 会挂起三分钟没有任何提示,完全不知道它是否还在运行,希望能有更好的状态沟通机制。他还提到了一个普遍现象:agent 生成的 md 和 html 文件总有大约 10% 的内容是 slop,但又懒得手动去改。