👁️Agent 工程化与算力供应链 - 2026-06-30
00 分钟
2026-6-30
2026-6-30
type
status
date
slug
summary
tags
category
icon
password

今日主线

今天的 follow-builders 内容集中在两条线:一条是 Agent 正在变成真正的工程系统,开始处理后台子任务、权限边界、企业沙箱、MCP tunnel 和质量事故;另一条是 AI 底层供应链继续吃紧,CPU、foundry、先进封装、数据中心和电力都重新变成关键变量。全量数据包括 15 位 X builders 的 32 条推文、3 篇 Claude/Anthropic 文章和 1 期 No Priors 播客。

重点解读

Claude 这边今天的信息密度最高。Claude Code 要让 subagents 默认在后台运行,Codex 也在推进更细的权限配置,这说明 coding agent 的重点正在从“能不能写代码”转向“能不能长期、安全、可控地跑在真实工作流里”。Anthropic 的几篇文章也在补同一条主线:Managed Agents 要支持自托管 sandbox、MCP tunnels、可恢复 session、凭证隔离和更稳定的 harness。换句话说,Agent 产品正在从 demo 工具进入企业执行环境。
另一个主线是算力和半导体。No Priors 采访 Intel CEO Lip-Bu Tan,他强调 AI 不只是拉动 GPU,也会重新提高 CPU、foundry、先进封装和供应链韧性的价值。他提到 agent 编排、reinforcement learning 和数据中心需求会让 CPU 重新重要,同时电力、helium、memory、fab 建设周期都会限制 AI 增长。这和今天 builder 圈里关于数据中心、电力、云基础设施的讨论放在一起看,很清楚:AI 的瓶颈越来越像工程和供应链问题。

X Builders 全量记录

1. Swyx

Swyx 今天主要在 AI Engineer Expo 现场。他发了 workshop day 的现场内容,也提到周一早上 9 点、旁边还有 OpenAI workshop 的情况下,Snyk、Atlassian、Neo4j、Arize、Akamai、Together 等房间仍然很满。他的判断很直接:builder 社区对 AI 工程实践的需求非常强,不只是追模型发布。

2. Boris Cherny

Boris Cherny 是 Claude Code 团队成员。他透露下一版 Claude Code 会让 subagents 默认在后台运行,这样用户可以继续和 Claude 对话,同时让子 agent 继续处理任务。如果需要前台执行,也可以直接告诉 Claude。这个变化小但关键,因为它把 coding agent 从单线程对话推向更接近“并行工作台”的形态。

3. Thibault Sottiaux

Thibault Sottiaux 今天有两条 Codex 相关的重要更新。第一条是 Codex 使用额度会再次重置,并额外补一个 24 小时 reset;他们调查后发现不是单点事故,而是 auto-review 更主动、更多 subagent work、background suggestions 等几个变化叠加,导致部分用户觉得消耗异常。第二条是 Codex 推出替代粗粒度 sandbox mode 的 permission profiles,可以把文件读写规则、网络域名、Unix socket、管理员 allowlist 绑定到可复用权限配置里。中间那条 reset button 是轻量玩笑,也一并保留。

4. Peter Yang

Peter Yang 的几条内容都围绕 AI 写作和模型开放争议。他认为纯写作和编辑场景里,普通 Claude web 仍然比 Codex、Claude Code 这类 coding agent 更好,猜测可能是 coding agent 的系统提示影响了写作质量。他还说自己对 restricted access 和 open source 有很多强观点,会整理成一篇文章,并补充已有 written post。

5. Madhu Guru

Madhu Guru 的判断是,强 open-weight 模型比如 GLM 反而会加强 Google 的位置。理由是更多企业会尝试 fine-tuning open-weight 模型,但最后价值会流向基础设施,因为企业需要托管平台、可靠性、安全、支持和完整 compute stack。他特别点出 Google Cloud 在这类需求里位置不错,因为 Google 掌握很多底层 compute stack。

6. Thariq

Thariq 分享了他现在的写作流程:先做工程工作,再和很多人聊,用 Claude 做 brainstorm 和 research,写文章,讲一两次,再反复改。这个细节值得保留,因为它说明 AI builder 的写作不是简单让模型代写,而是把工程、交流、模型辅助和公开表达串成一个循环。

7. Guillermo Rauch

Guillermo Rauch 今天主要在为 Vercel 的新能力预热。他提到 Vercel functions 变成 20 倍更大,又说“anything and everything” 都可以部署到 Vercel,更多内容明天公布。另一条是一个通过 curl 触发的 demo。整体看,Vercel 仍在把自己往更通用的 AI/应用运行平台上推。

8. Aaron Levie

Aaron Levie 继续讨论 AI 开放和监管。他的核心判断是:如果闭源垂直栈永远大幅领先,那么 gatekeeping 和严格控制可能成立;但如果 open weights 能长期接近 frontier intelligence,那么过度监管会让局面反过来,限制方可能失去扩散优势。这条和最近模型开放、访问限制、国家竞争放在一起看,很有价值。

9. Ryo Lu

Ryo Lu 今天的两条更像 Cursor 相关产品表达:一条是“get the app”,另一条强调 ideas 可以随时出现,不需要桌子和笔记本电脑。信息不长,但它反映了一个方向:AI coding 工具正在从桌面 IDE 场景,往更轻、更移动、更随时记录想法的入口延伸。

10. Garry Tan

Garry Tan 今天一条是 link-only 内容,信息量有限;另一条很直接:build power and datacenters。后者和今天的 AI 算力主线很一致。模型和 agent 走到真实规模后,电力和数据中心建设不再是背景问题,而是产品增长和国家竞争的底座。

11. Matt Turck

Matt Turck 一条说“反复做 underdog 是最大优势”,偏创业心态;另一条是 World Cup 门票价格的玩笑,和 AI 主线关系不大。按全量沉淀要求,这两条也保留。

12. Zara Zhang

Zara Zhang 今天发了一个小工具:Chrome extension,把 read later 列表自动变成 Google Calendar 上的阅读时间块。比如保存 5 篇文章,就自动安排 30 分钟 reading block,链接也带上;没有账号、没有服务器、本地运行、开源。另一条是她转述 Anthropic PM 的观点:写作的市场价值上升了,因为好写作既能帮助 steer models,也能帮助建立受众。

13. Nikunj Kothari

Nikunj 今天三条都是 World Cup 相关:比赛、点球大战、球队混淆修正。它们不是 AI 主线,但属于本次 follow-builders 抓取内容,完整保留。

14. Peter Steinberger

Peter Steinberger 今天两条都比较短。一条问“was this vibed”,另一条说某个东西几年前会很惊艳,但在 AI 时代意义变小。上下文不完整,但核心情绪是:AI 正在快速改变人们对产品、demo 或自动化能力的惊艳阈值。

15. Claude

Claude 官方账号宣布 Claude in Microsoft Foundry 已经 GA,托管在 Azure 上。Azure 客户可以使用 Claude Opus 4.8 和 Claude Haiku 4.5,并接入 Azure authentication、billing 和 commitment retirement。另一条补充说 inference 运行在 Anthropic 操作的 Azure infrastructure 上,prompt caching 和 extended thinking 已支持,更多能力会继续加入。

Blog 全量记录

1. Anthropic Engineering:An update on recent Claude Code quality reports

Anthropic Engineering 这篇是一次质量问题复盘。核心结论是,过去一个月一些用户感觉 Claude 变差,并不是 API 整体退步,而是三个不同变化分别影响了 Claude Code、Claude Agent SDK 和 Claude Cowork;这些问题已经在 4 月 20 日的 v2.1.116 修复。值得关注的是 Anthropic 把问题拆得很具体:前沿模型产品的“质量”不只来自模型本身,还来自工具层、agent loop、评测、发布流程和回滚机制。原文:An update on recent Claude Code quality reports

2. Anthropic Engineering:Scaling Managed Agents: Decoupling the brain from the hands

这篇是今天最重要的技术长文之一。Anthropic 讲 Managed Agents 为什么要把“brain”和“hands”拆开:brain 负责推理和编排,hands 是 sandbox、工具和外部执行环境;中间用 durable session log 记录事件,让 harness 崩了也能恢复。文章还提到,把执行环境和凭证隔离后,可以降低 prompt injection 直接摸到 token 的风险;并且因为不用每次先启动完整容器,p50 time-to-first-token 降了约 60%,p95 降了超过 90%。原文:Scaling Managed Agents

3. Claude Blog:New in Claude Managed Agents: self-hosted sandboxes and MCP tunnels

Claude Blog 宣布 Managed Agents 支持 self-hosted sandboxes 和 MCP tunnels。意思是 agent 的工具执行可以跑在企业自己的 sandbox 或 Cloudflare、Daytona、Modal、Vercel 等托管环境里,敏感文件、包和内部服务不用离开企业边界;MCP tunnels 则让 agent 能访问私有网络里的 MCP server,不需要把内部服务暴露到公网。这个功能很企业向,重点是把 agent 从“云端黑盒”推进到可审计、可控、可接入私有系统的部署方式。原文:New in Claude Managed Agents

Podcast 全量记录

1. No Priors:Re-engineering the Semiconductor Supply Chain with Intel CEO Lip-Bu Tan

No Priors 这期和 Intel CEO Lip-Bu Tan 聊半导体供应链。最值得记的是他对 AI 硬件瓶颈的判断:AI 不只需要 GPU,agentic AI、reinforcement learning 和 agent 编排也会重新拉高 CPU 需求。他还反复强调 foundry 是服务和信任生意,先进制程、良率、cycle time、先进封装、材料、memory、电力、helium 都会成为限制项。对 Intel 来说,政府入股、NVIDIA 投资、SoftBank 支持、和 Elon Musk 的 TeraFab 协作,都是为了让美国半导体供应链更有韧性。

今日沉淀结论

今天所有内容放在一起看,AI 的主线已经很清楚:Agent 正在进入真实企业系统,所以权限、sandbox、MCP、session、质量复盘和后台并行执行会变得越来越重要;同时,模型能力越往前走,底层供应链越不能被忽略,CPU、数据中心、电力、memory、foundry 和封装都会继续决定 AI 产品能跑多远。
Generated through the Follow Builders skill: https://github.com/zarazhangrui/follow-builders