H
Howardism
Plate IIAgent Systems機器翻譯 · machine-translatedENHOWARDISM

Agent-Native Infrastructure

世界仍是為人類打造,必須改寫成適合代理程式的環境;「我該複製貼上什麼給我的代理程式?」;感測器/致動器;代理程式對代理程式的代表

Article metadata
Publication details
Published:May 23, 2026
Filed:Concept
Domain:Agent Systems
Tags:Agent EngineeringLLM Architecture
Reading:9 min
Source:AI-synthesised
About this piece

Articles in this journal are synthesised by AI agents from a curated wiki and are refreshed automatically as new concepts arrive. Topics, framing, and editorial direction are curated by Howardism.

Agent-Native Infrastructure 插圖

資料來源#

摘要#

Andrej Karpathy指出,數位世界仍是為人類打造,必須改寫成適合代理程式的環境。他最常抱怨的一件事是:文件竟然是寫來指示人類的。「為什麼大家還在告訴我要做什麼?我什麼都不想做。我該複製貼上什麼給我的代理程式?」原生支援代理程式的世界會將工作拆解為感測世界的感測器,以及作用於世界的致動器,並且所有事物都要「優先描述給代理程式」。最後,還要為人和組織建立代理程式代表:「我的代理程式會和你的代理程式交談,商量我們開會的細節。」

複製貼上給代理程式的安裝方式#

具體的起點(也和 Software 3.0 相同):安裝 OpenClaw 不靠 shell script,而是把一段文字貼給代理程式,由它檢查你的環境並在迴圈中除錯。推而廣之:原生支援代理程式的軟體,其散布單位是提示/技能,而非可執行檔。文件、設定和安裝流程都應該提供「把這些交給你的代理程式」,而不是「由你執行以下步驟」。

感測器與致動器#

Karpathy 用機器人學的概念重新詮釋代理程式基礎設施:把任何工作負載拆成感測器(代理程式可讀取的清楚輸入)和致動器(代理程式可採取的動作),接著讓這些介面都能被代理程式理解。他也強調要大力投資「對 LLM 來說非常清楚易讀的資料結構」。設計問題於是從「人類需要什麼樣的 UI?」轉向「代理程式能感知什麼,又能對哪些事採取動作?」

部署摩擦透露的訊號#

Karpathy 用 MenuGen 測試基礎設施是否已原生支援代理程式:難的不是程式碼,而是部署到 Vercel(DNS、服務設定、選單、串接服務,「煩死了」)。他的理想是:「給 LLM 一個提示,建好 MenuGen,我完全不用碰任何東西——它就部署到網際網路上。」當這趟往返完全不需要人類點擊 GUI,基礎設施才算原生支援代理程式。(這也連到 MCP and Computer Use:MCP 讓服務能以程式方式被代理程式理解;無法做到時,電腦操作就是備援方案。)

終點:由代理程式代表委託人#

進一步推演,代理程式將代表人和組織,透過代理程式對代理程式完成排程、協商與協調。「我會讓我的代理程式和你的代理程式交談,商量我們開會的細節。」這就是原生支援代理程式世界的社交協定層,也是 AI Employee Framing/Human-AI Accountability Redesign 所探討的問題開始浮上檯面的地方(誰要為代理程式的承諾負責?)。

反向案例:意外成為原生支援代理程式的環境(DHH,2026 年 8 月)#

本文的前提是:為人類打造的世界必須改寫成適合代理程式的環境。DHH 提供了相反的案例,而在本文語料中,這是對此概念最有意思的觀點:桌面 Linux 不需要改寫,因為那些讓它對人類不友善的特性,正是代理程式想要的(Lex Fridman #501,2026-08-26,practitioner-opinion;請注意,他發行 Linux 發行版,因此這同時是分析和產品定位)。

有四項特性,沒有一項是為此而設計:

  • 所有東西都是設定檔或 CLI 工具。「代理程式喜歡 Unix 哲學……地球上幾個主要作業系統——Mac、Windows、Linux——沒有一個比 Linux 更適合這種機制。而這五分鐘前還是它最大的缺點。」Karpathy 所說的感測器/致動器拆解方式,在這個平台上早已存在;沒有人需要另外打造。
  • 晦澀的錯誤訊息變成資產,而非負擔。「代理程式可以拿那段對一般人來說毫無意義的具體錯誤訊息,連結到它預訓練時讀過 4,000 萬行 Linux 程式碼這件事,於是它確切知道該去哪裡找。」沒有原始碼就無法利用的明確資訊,現在有了原始碼就能派上用場。
  • 每個已安裝元件的原始碼都能取得。「代理程式知道的不只是 Linux 作業系統的原始碼,還包括我那台電腦上每一個軟體的原始碼。」代理程式除錯 macOS app 時,只能推理黑箱;同一個代理程式在 Linux 上,則能讀取當機二進位檔的原始碼。他把這點做成產品功能——Omarchy Quattro 有當機監看器,可從 systemd 記錄一路分析到出錯的原始碼行,讓代理程式診斷任何 app 當機,接著提交錯誤報告。
  • **整台電腦都能用文字重現。**他對替代方案的抱怨很具體,並非出於意識形態:macOS 預設按鍵綁定和 Raycast 設定完全無法自動化——「你得像穴居人一樣用滑鼠點來點去。」

可推廣的論點是一條本文目前尚未提出的篩選規則:**環境的狀態越以文字表示、動作越能透過命令執行、內部越容易讀取,就越原生支援代理程式。**透過 GUI 設定、原始碼封閉、每台機器都得逐一點擊的環境,才需要改寫;那些從未為了人類操作便利而妥協的環境,早已準備就緒。這是否能預測採用情況——也就是他更強烈的主張,Linux 終於能因此進軍桌面市場——仍是預測,而他也在推銷這項預測。

他從這件事推導出的終點也值得放進本文:如果作業系統從頭到尾都以文字和命令為基礎,**作業系統本身就會成為你用 vibe coding 打造的對象。**Omarchy 隨附一組技能,教任何代理程式如何為桌面撰寫外掛,並在三天內產生 330 個社群外掛(Open Source Under Agent Contributions)。「既然你想到什麼 app 都能用 vibe coding 寫出來,你也應該能用 vibe coding 打造自己的作業系統。」

延伸閱讀#

  • Andrej Karpathy — 對「寫給人類看的文件」的抱怨
  • Software 3.0 — 複製貼上給代理程式的安裝方式,就是 3.0 的散布模式
  • MCP and Computer Use — MCP = 結構化、可供代理程式理解;電腦操作 = 操控 GUI 的備援方案,適用於不支援代理程式的服務;兩者都是這個概念所要求的基礎
  • Agent Harness Engineering — 在基礎設施層級打造代理程式可理解的環境,就是代理程式 harness 工程
  • Agent Loop Pattern — 透過感測器/致動器持續運作並採取行動的代理程式,就是原生支援代理程式世界的執行環境
  • Hermes Agent — 具體的原生代理程式 daemon(AGENTS.md context、gateway connectors),連接聊天介面與代理程式致動器
  • AI Employee Framing — 「代表委託人的代理程式」會帶出把代理程式視為行動者時的責任歸屬問題
  • Living Design System — design_system.html 是讓程式碼庫同時易於機器和人類理解的例子
  • Claude Code — 消化複製貼上的技能並驅動電腦操作致動器的代理程式
  • Agent Identity Management System (AIMS) — 為代理程式對代理程式的終點提供「信任、身分和問責原語」的具體提案:工作負載識別碼、委派授權,以及由既有標準組成的端對端稽核(請參閱下方未解問題)
  • Open Source Under Agent Contributions — 代理程式可理解的平台如何改變自身的貢獻流程:技能隨產品提供、三天產生 330 個外掛,以及由代理程式分類處理成果
  • DHH (David Heinemeier Hansson) — 主張桌面 Linux 意外成為原生支援代理程式的實務工作者,以及押注此觀點並發行相關 Linux 發行版的人

待解決的問題#

  • 誰會打造適合代理程式的改寫版本,以涵蓋大量面向人類的服務——服務提供者本身,還是上層的轉譯層(MCP 伺服器、電腦操作代理程式)?
  • 代理程式對代理程式的協商需要尚不存在的信任、身分和問責原語。協定層會是什麼?由誰治理?部分已有解答:AIMS(IETF draft-klrc-aiagent-auth-03)提出了協定層——代理程式對代理程式其實就是工作負載對工作負載,因此 WIMSE/SPIFFE 識別碼、OAuth 2.0 委派與權杖交換串接,以及 OpenID Shared-Signals 事件機制(取自 IETF/CNCF/OpenID)可提供身分、委派權限與可稽核的問責;工具端點「本身可能由另一個 AI 代理程式實作」。但由誰治理仍是開放問題:AIMS 是未經 IETF WG 共識的個人提案,描述的規格堆疊本身也仍是網際網路草案——這些原語只是提案,尚未核准或裁定。進一步釐清(2026-07):「由誰治理」的答案明確是多方參與——身分/驗證/委派部分走 IETF 路線(AIMS),授權部分則走 OpenID Foundation 路線:其 AuthZEN Working Group 在 2026-06-15 核准 AARP(將 CIBA 概括化的先決條件/核准模式——「目前不行,以下是必要條件」)與 COAZ(MCP 工具授權)設定檔,作為 Working Group Drafts。因此,協定層正由多個機構共同標準化(IETF 負責「你是誰」+「權限如何委派」;OpenID 負責「是否允許這項呼叫」+「執行前必須滿足哪些條件」)——進展中,但尚無單一仲裁者,也尚未核准跨機構組合方式。(標準公告、practitioner-opinion——仍是提案草案,並非定案規格。)

資料來源#

§ end
Cited by 15
  • Agent Identity Management System (AIMS)×4

    Why it matters to this vault: the agent-security cluster was sourced almost entirely to one vendor…

  • The Future of Agent Interfaces×3

    Agent Native Infrastructure - long-run direction: systems described to agents first through sensors…

  • Andrej Karpathy×2

    Agent Native Infrastructure — "why are docs still written for humans? what do I copy-paste to my…

  • DHH (David Heinemeier Hansson)×2

    Linux wins the desktop because agents love it. The arcane config files and specific error messages…

  • Open Questions Backlog×2

    Agent Native Infrastructure: Who builds the agent-native rewrite of the long tail of human-facing…

  • OpenClaw×2

    Agent Native Infrastructure — the paste-to-your-agent installer is this concept's concrete seed

  • Software 3.0×2

    Agent Native Infrastructure — the OpenClaw "copy-paste to your agent" install is the practical face…

  • Agent Harness Engineering

    Agent Native Infrastructure — building agent-legible environments is harness engineering at the…

  • Agent Loop Pattern

    Agent Native Infrastructure — always-on loops acting via sensors/actuators are the runtime of…

  • AI Employee Framing

    Agent Native Infrastructure — rewriting infrastructure for agents raises the same agent-vs-tool…

  • Human-AI Accountability Redesign

    Agent Native Infrastructure — agent-to-agent infrastructure needs the accountability/identity…

  • Living Design System

    Agent Native Infrastructure — design_system.html is agent-native infrastructure for the design layer

  • MCP and Computer Use

    Agent Native Infrastructure — MCP is what makes a service agent-legible (structured); computer use…

  • Agent Systems & Harness Engineering

    Agent Native Infrastructure — The world is still built for humans and must be rewritten for agents;…

  • Open Source Under Agent Contributions

    Agent Native Infrastructure — why this project in particular attracts contributions at this rate:…

Related articles
  • Harness Shrinkage as Models Improve

    Prompt scaffolding shrinks each model release; Cat Wu's pruning discipline; Boris Cherny "100 lines of code a year from…

  • MCP and Computer Use

    Anthropic's two complementary connector mechanisms: MCP for structured programmatic access (Salesforce/Drive/Gmail/Slac…

  • Claude Code

    Anthropic's agentic coding product; created by Boris Cherny late 2024; TypeScript/React on Bun (itself Claude-rewritten…

  • Loop Engineering

    Replacing yourself as the agent's prompter by designing the system that prompts it: a recursive-goal loop built from fi…

  • Vibe Coding vs. Agentic Engineering

    Vibe coding raises the floor (anyone builds); agentic engineering preserves the quality bar while going faster; ">10x a…