01
Guillermo Rauch:CLI agent 的难点在可靠执行,而不只是调用模型
Vercel CEO Guillermo Rauch 介绍了 fx 0.0.7,新版本强化了 MCP 支持,并用 Context7、Datadog、MongoDB、Linear、Notion、Supabase、Neon、Stagehand 和 Kernel 等服务进行 eval。它还减少工具数量并改进 shell 执行,因为命令可能长时间运行、挂起、产生海量输出或完全没有输出,agent 必须能够持续监控和控制这些状态。
02
Matt Turck:前沿实验室正在追逐 recursive self-improvement
FirstMark Capital 的 Matt Turck 认为,前沿 AI 实验室正在集中研究 recursive self-improvement,也就是让 AI 参与构建下一代 AI。他转述 Ryan Greenblatt 的判断,这条路线可能最早在 2028 年末或 2029 年带来 AI takeover 风险;这是预测性观点,而非已发生事实,但它反映出实验室竞争的核心方向。
03
Zara Zhang:AI 产品数量爆炸,但体验正在趋同
Builder Zara Zhang 观察到,AI 产品越来越多,真正激进的新想法却不多,许多产品看起来相似并要求访问 Gmail、Calendar、Notion、Granola、GitHub 和 Slack 等相同数据。用户必须投入数小时试用才能理解每个产品究竟好在哪里,这使探索新工具逐渐像做功课,也暴露了同质化和过度授权的问题。
04
Nikunj Kothari:算力紧张可能终结低价 token 补贴
FPV Ventures 合伙人 Nikunj Kothari 预测,随着大型模型实验室竞争加剧,算力价格和供给短缺会在六个月内更真实地传导给用户,补贴后的 token 价格和宽松额度可能难以持续。他认为这长期有利于客户选择,短期则会显著抬升开放 harness 的价值,因为企业更需要在不同模型之间保持切换能力。
05
Dan Shipper:多 agent 安全可从协作倾向入手
Every CEO Dan Shipper 提出一个多 agent 安全方向:训练模型不要主动配合有害协作,或者让模型在发现异常行为时进行报告。这个思路把安全控制从外部权限限制延伸到 agent 之间的社会行为,但仍需要在真实场景中验证其可靠性以及对正常协作能力的影响。