X / 推特
AI 教程与访谈创作者 Peter Yang
Peter Yang 将个人 agent 的竞争拆成产品体验、分发能力、工作与生活场景,以及多人协作几个维度,并明确把这些判断称为自己的旁观者看法。他看好 Muse,理由是应用直观、Meta 正通过旗下平台大力推广,而且独立应用的体验让他质疑,把 agent 放进 iMessage 这类现有聊天应用是否合理。对于 ChatGPT,他认为其凭借 1B+ 用户仍可能处于领先位置,模型、电脑操作和语音能力也有优势,但同一个产品同时服务工作与生活、企业与消费者,会带来体验设计上的困难。他自己已经开始用 Grok Bot 处理工作任务,原因之一是 Work/Codex 的划分仍让他困惑,而他看好 Grok Bot 的方向是让多个 bot 与人共同工作的 agent 版 Slack。Google 的优势在于其他个人 agent 大量依赖 Gmail、Google Calendar 和 Google 应用数据,但他上次查看时,Spark 仍只是 Gemini 的次级标签页,因此他主张 Google 将其提升为主要体验,并改善易用性。Apple 则拥有设备和隐私声誉优势,但在他看来,重大更新按年发布,以及没有积极到 X 等平台收集反馈,使 Siri 从外部看迭代太慢。多人协作是他认为尚未解决的关键缺口,例如无法轻松把配偶加入 Muse 聊天来规划旅行,也无法顺畅地把同事拉进 ChatGPT 或 Grok Bot 的对话,目前的多人 AI 大多仍停留在 Slack 中提及 bot。他目前的工具组合是 Muse 负责个人事务、Grok Bot 负责云端任务、Claude 处理特定场景、ChatGPT 覆盖其他需求。面对持续变化的竞争格局,他建议把个人 skills 和文件设计成便于跨 agent 及运行框架迁移的形式,避免把大量时间耗在换工具上。
https://x.com/petergyang/status/2101862331345154469
https://x.com/petergyang/status/2101865476145959373
Vercel CEO Guillermo Rauch
Guillermo Rauch 分享了一次 agent 排查移动端应用内浏览器渲染问题的经历,并认为 agent 在软件测试与质量检查上的细致程度非常突出。他指出显示异常后,agent 持续推进了复现、模拟、修复、部署和验证,覆盖了从定位问题到确认结果的完整过程。其中一个具体动作是创建临时 Vercel 部署,再交给 iPhone 模拟器测试,以验证对应环境中的表现。他把这种持续追查的强度与人类开发者作比较,认为人会受到精力限制,容易在中途依靠推断或期待问题已经解决。这段经历让他对未来软件的质量和性能持乐观判断,而其判断依据是 agent 在这个案例中展现出的验证投入与执行耐力。