Katelyn Lesse — 為什麼 Anthropic 是一家平台公司
有請 Anthropic Claude 平台工程負責人,Katelyn Lesse 上台。
東京,早安。這是我們第一次把 Code with Claude 帶來日本,很感謝能與各位共度接下來的這幾天。今天早上,我們會談我們的模型、我們的平台,以及我們的產品。但在進入正題之前,我想先告訴大家:就在幾個小時前,我們發布了第五代 Claude 模型——Claude Mythos 5 和 Claude Fable 5。這是我們有史以來能力最強的兩個模型。我們的研究產品負責人 Dianne 稍後就會上台,跟大家更深入分享這些模型究竟特別在哪裡。
我負責 Claude 平台的工程。這個平台給開發者所需的工具,讓他們在 Claude 之上建立系統、駕馭它的智慧。這是我們協助解決世界上最重要問題的最高槓桿方式。也正因如此,Anthropic 是一家平台公司。全世界的開發者——今天在場的許多人也是——在這個平台之上創造的價值,遠遠超過我們自己單獨能打造的一切。
那麼,先從我最近在客戶身上看到的現象說起。此刻正有非常大量、威力十足的應用程式不斷推出,而其中很多就來自日本這裡。Rakuten 是我們最喜歡合作的客戶之一。他們的團隊從用 Claude Code 加速開發,進一步走到在 Claude Managed Agents 上打造客製的內部 agent,涵蓋工程、產品、業務與財務。他們有一位產品經理協調一整批 agent 團隊的方式,跟一位主管帶領一群人類團隊的方式一模一樣。現在,他們每兩週就能推出一次重大版本,而不是一季才一次,整個亞太地區也是同樣的情形。

另一個很棒的客戶是 Canva,這個來自澳洲的設計平台有數億人使用。他們大多數的使用者從來沒寫過一行程式。但在 Claude 的幫助下,Canva Code 改變了這一切。在一份設計裡,你只要開口要求加上互動的東西——像是地圖、計算機,或一個小工具——Claude 就把它做成一個能直接放進你頁面的可用迷你 app。在世界各地,人們正用 Claude 打造從前沒有人能做出來的新系統與新應用。
而我們都感受到了這個轉變。整個格局正以前所未有的速度改變。昨天還不可能的事,今天已經變得可能。我們的使命,是持續打造能力越來越強的模型,不斷拉高「能做出什麼」的天花板。

幾年前,模型開發的最前緣不過是能起草一則非常簡單的 commit message。一年前,我們站在第一屆 Code with Claude 的舞台上,Opus 4 是當時的頭條,Claude 能獨立完成一整個功能,在那時候已經令人驚嘆。六個月前,agent 已經能整夜運行,完成長時間的自主任務。兩個月前,Mythos 讀完整個 OpenBSD 原始碼樹,找到一個存在了 27 年、躲過人類審查與靜態分析將近三十年的漏洞。而就在今天稍早,我們發布了 Mythos 5 和 Fable 5。Fable 5 在幾乎所有受測的 AI 能力基準上都是最先進的,在軟體工程、知識工作、科學研究、視覺等領域都展現出卓越表現。
這些躍升的幅度越來越大,但間隔的時間卻越來越短。不過,即使模型能力在這條指數曲線上不斷進步,大多數企業的能力仍停留在線性成長。於是,「AI 能做到的」與「AI 實際為人們做到的」之間出現了一道越來越大的落差。弭平這道落差,是我們共同的機會。這也是我們打造 Claude 平台的原因。它給開發者所需的工具,去打造更強大的 agent。平台上的 API 用量年增將近 17 倍。我們已經推出了很多東西,而且還有更多即將到來。接下來這幾天,我們會分享我們的方向,也會更深入了解你們正在打造什麼。我們的目標,是讓我們的模型、平台與產品,為各位發揮得更好。
所以今天早上,我們會逐一深入。
首先,Dianne 會談我們的模型。她會進一步分享我們最新的前緣模型 Mythos 5 與 Fable 5,以及接下來會有什麼。
接著,Angela 和我會帶大家看,如何用 Claude Managed Agents 在 Claude 平台上大規模地建置與部署 agent。
今天我們也很興奮地宣布,我們推出了全新的 Claude Managed Agents 功能:你現在可以排程部署(schedule deployments),讓你的 agent 按你需要的任何節奏執行;你也可以把環境變數存放在 vault 裡,讓 agent 能安全地發出帶驗證的 API 請求,而不必把金鑰交給它們。

最後,Cat 會帶大家看 Claude Code 的最新進展——現在開發者平均每週花 20 個小時與 Claude 相處。她會介紹最新功能,像是全新的 agent view 與 dynamic workflows。
而這一切最終都回到你們身上、回到你們將要打造的東西。因為大多數人永遠不會自己去串接 Claude API。他們永遠不會打開終端機輸入 `claude`。
他們體驗 AI 的方式,是透過在座某一位在 Claude 平台上打造的東西——像是一位業務人員走進高風險的關鍵會議前,已被 Slack agent 完整簡報過;或是一位律師靠 Legora,以前所未有的速度把訴狀送出門;又或是一位開發者,使用世界上最頂尖的任何一個 coding agent。這就是為什麼我們是一家平台公司。

每一天,看著你們所有人合力打造解決世界最重要問題的方案所累積的影響力,我都深受震撼。所以,謝謝你們的到來、謝謝你們與我們的合作,也謝謝你們讓我們看見什麼是可能的。ありがとう。接下來,有請研究產品團隊的 Dianne,為各位第一次深入介紹我們最新的模型。
Dianne Penn — Fable 5 與 Mythos 5:第五代 Claude
有請研究產品管理負責人,Dianne Penn 上台。
嗨,東京早安。我是 Dianne,2023 年加入 Anthropic,從 Claude 2 開始參與了每一版 Claude。如果有人在數的話,那是橫跨 Haiku、Sonnet、Opus,以及現在的 Fable 和 Mythos,總共 21 個版本的 Claude,交付給像各位這樣的終端使用者與開發者。我們最近的一次發布就在幾個小時前。我們發布了 Claude Fable 5 和 Claude Mythos 5,第五代模型的第一個世代。Fable 5 是我們有史以來公開提供的最強模型。它與 Mythos 5 建立在相同的基礎之上。這些模型已經在加速我們 Anthropic 內部的工作。而對像各位這樣的開發者來說,Claude 將變得更強,你們的起跑線也會跟著往前移。
我們在 Anthropic 常常談「指數曲線」,但這實際上是什麼意思?對我們而言,隨著模型智慧提升,我們相信它所創造的使用情境的價值會呈指數增長。舉例來說,今天你們許多人在用的 agentic coding,其價值遠遠超過幾年前單純的自動補全。而我們已經在 Fable 5 身上看到這一點。
先從 coding 說起,因為我們相信那是你們大多數人最先感受到魔法的地方。Fable 5 在 SWE-bench Pro 上表現最高。但這個基準本身低估了整個故事。任務越長、越複雜、越精密,Fable 與市面上其他所有模型的差距就拉得越開。驅動這個差距的有兩件事。
第一,單次正確性(single-shot correctness)。給 Fable 5 一個複雜、規格明確的問題,它第一次就能命中。早期測試者告訴我們,有些單一 prompt 產出的工作量,原本要好幾組團隊花上幾天甚至幾週。第二是長視野自主性(long-horizon autonomy)。Fable 5 可以針對單一目標連續運作好幾天,全程保持連貫。即使任務橫跨數百萬 token,它仍會記得你的規格。它還能派遣 subagent,讓它們保持在正軌上——比我們提供過的任何模型都更可靠、也更有成本意識。再補一點——Fable 5 不只擅長寫程式,它更擅長讀程式。它更會分流排查線上事故,更會挖你的 repo 歷史、弄清楚什麼東西在什麼時候壞掉,還會主動提出讓它變更好的建議。
在 coding 之外,Fable 5 同樣是一大步。先看你們的組織和公司實際賴以運轉的工作。無論是財務分析、文件、簡報、試算表——Fable 5 都能端到端地處理。它會遵循指示、不偏離範圍,而它交回給你的成果會是專業等級,因為這是一個我們為大規模工作流程打造的模型。在需求不乾淨的情況下它也表現更好。我們觀察到,當你丟給 Fable 5 一個混亂、多線交錯的東西,要它自己判斷下一步該做什麼時,它能把這件事做好,並且勝過其他版本的 Claude。Fable 5 的視覺能力也是業界最強。它讀取密集的技術圖像、網頁應用、圖表、示意圖、統計圖的準確度,遠超過我們以往提供的任何一版 Claude。
到目前為止,我談的都是這種能力等級的模型好的一面。但這種量級的智慧是雙面刃。兩個月前,我們啟動了 Project Glass Wing,只把 Mythos preview 開放給一小群合作夥伴,因為它在網路安全上的能力強到有被濫用的可能。從那之後,我們建立了一套新的防護系統,而這套防護系統讓同等的智慧得以透過 Fable 5 提供,讓所有人都能使用與創造。
它的運作方式大致是這樣:當一個請求一觸及網路安全、生物或化學主題,Fable 會把它路由到我們次強的模型 Opus 4.8。回應會清楚標示,而你會以 Opus 的價格計費。我們知道這還不完美。在這些領域做正當研究的研究者,有時會撞上封鎖然後被改道。我們也持續在改進這一點。但正是這種取捨,讓我們最強的模型今天早上就能交到所有人手上,而不是幾個月之後,而我們的客戶已經在 Fable 身上找到價值。
Rakuten 發現,在最高的 effort level 下,Fable 5 會反思並驗證自己的工作,對他們來說,這讓大規模的自主自動化營運成為可能。Cognition 拿 Fable 5 跑他們的前緣 coding 評測——分數是他們測過的所有模型中最高的。他們特別點出長視野推理,以及它對陌生工具與複雜 context 開箱即用的泛化能力。而 Genspark 告訴我們,Fable 5 在他們的評測中拿下第一,正面對決打贏了他們測過的每一版模型。它在最難的任務上反而最強,例如 UI 設計和遊戲程式開發。

那 Mythos 5 呢?它和 Fable 5 是同一個底層模型,但解除了網安與生物的防護。Mythos preview 已展示了這個模型等級能做到什麼,而 Mythos 5 又更進一步。它今天起開放給我們 Glass Wing 的合作夥伴,作為 Project Glass Wing 的一部分。本月稍晚,我們會開始招收更多生命科學領域的研究者使用 Mythos 5——因為讓生物學帶有風險的那些能力,恰恰也是用 AI 創造真正善果影響力最大的能力。
那麼,身為開發者,你能用 Fable 5 做什麼?要理解這一切變化,我喜歡看的一個指標是時間視野(time horizon)——也就是模型能自主工作多久,而不會對下一步該做什麼失去連貫性。

在 Fable 5 身上,我們看到的 agent 是主動的、不必被告知就知道該做什麼。這些 agent 可以為更高層級的目標負責——那些需要判斷力、協作和主動品味的職責。舉例來說,與其請 Claude 寫一份專案進度更新,你現在可以請 Fable 確保專案一整週都保持在正軌上。與其請 Claude 產出一份財務預測,你可以叫 Fable 去擁有、更新、迭代並改進這份預測,讓它持續準確。
如各位今天所見,指數曲線持續前進。我們必須為正在浮現的能力做設計,而不只是為今天現有的模型。我們預期未來版本的 Claude,會比我們今天發布的這一版更強。
Fable 5 和 Mythos 5 只是那個未來的一瞥。那麼,身為開發者,你要怎麼把握前方這一切變化?首先,你應該為下一版 Claude 設計,而不只是當前這一版。我們無數次看到,贏家開發者是那些架構、harness 與產品體驗已準備好吸收下一波智慧躍升的人。Claude 聰明而且機智。隨著模型越來越聰明,它們其實能靠更基本的原語(primitive)走得更遠——例如檔案系統或沙箱運算環境——而在過度精密、過度複雜的 harness 裡反而施展不開。
隨著模型變得更聰明,你也需要開始打造更難的評測,為那些可能還跑不起來的體驗做原型。這正是你得以察覺「指數曲線正在你腳下移動」的方式。當某個原本不太能穩定運作的任務、原型或產品體驗開始能動了,那就是一個訊號:該提供一個你從前做不出來的神奇東西了。
最後,隨著節奏持續加快,贏的團隊是那些能在模型升級時從 Claude 榨出最多價值、並把升級當成商業機會的團隊。你應該讓模型升級變得輕鬆。這意味著自動化評測、測試流程,以及確保你持續親自上手——用新版本的 Claude 去測試、去推進、去創造新東西。這樣你才會知道,新能力是否足以為你的客戶帶來新體驗。

我們看到指數曲線持續,這代表 Claude 會變得更聰明,並能大規模地獲得新能力。而你們這些開發者,是最早感受到這件事的一群人。你們是真正能實驗、打造新產品、最早發現別人看不見的新市場機會的人。我們等不及要看你們接下來用 Fable 5 打造什麼。現在,Angela 和 Katelyn 會向大家展示 Claude 平台如何讓這一切成真。非常謝謝大家。
Angela Jiang — Claude Managed Agents:harness、context、基礎設施
有請 Claude 平台產品負責人,Angela Jiang 上台。
昨晚,在我們都熟睡的時候,某處有一個產品發現自己壞掉了。這個產品讀了自己的錯誤回報。它找到了 bug,寫好了修復,並把它推送給所有使用者。等到團隊真正醒來時,問題已經消失,changelog 也已經寫好了。在這個情境裡,沒有 standup 會議。沒有工單。而這就是一家 AI 原生公司的樣子。這不是一家人們只是「用 AI 來做自己工作」的公司,而是一家「工作本身運行在 AI 基底之上、人來決定成果應該是什麼」的公司。

如果你有對的原料,這個故事就能成真。這需要三樣東西。第一是 harness,第二是 context,第三是基礎設施。

這三者是把原始智慧轉化為真正商業成果的關鍵。而這正是 Claude 平台所提供的。我們給你 agentic harness、context 管理工具,以及生產等級的基礎設施,讓你能真正成為 AI 原生。最近,我們把這些全部打包在一起,推出了我們的新產品 Claude Managed Agents。Fable 5 是打造長時間運行 agent 的最佳模型,而 Managed Agents 是為 Claude 量身打造的。這意味著,當你把這兩者放在一起,你能用顯著更少的力氣,換到更好的 agent 成果。
好,先談 harness。harness 是讓 Claude 模型真正能「做事」的東西。它包含工具、環境,以及行動的許可。

有了 harness,模型不只是告訴你該怎麼修,它真的會把事情做成。你要的不是只會給有用建議的 AI,你要的是真的能把工作做掉的 AI。在 Claude Managed Agents 裡,我們提供一個把「大腦」和「手」分開的 agentic harness。大腦決定要做什麼,然後我們按需求啟動沙箱——也就是手——去執行工作。我們的 harness 還具備以迭代為基礎、朝向成果(outcome)運作的能力。你指定成果是什麼,managed agent 就會持續迭代,直到真正為你達成。

第二,來談 context。模型的好壞,取決於你實際給它的 context。我們提供 100 萬 token 的 context window,讓你的 agent 能消化大量內容而不劣化。但不只如此。我們也讓 agent 擁有記憶(memory),讓它們真正記得自己做過什麼。我們也讓 agent 能讀寫自己的 skill,自行補上缺少的知識。最後,我們讓 agent 能「做夢」(dream),檢視自己過去的軌跡,找出自我改進的方法。

最後,談基礎設施。如果你要打造真正長時間運行的自主 agent,這需要極端的規模與可靠性。這是最難做對的部分之一。Claude Managed Agents 會自動啟動與收掉沙箱,並在需要時生成多個 agent 艦隊,幫你優化出可靠、持久、不用你費勁就把工作做完的 agent。
打造會自我改進的公司,今天就能發生。我們已與許多在 Claude Managed Agents 上建立 agentic 系統的公司合作。他們能快上 10 倍,因為他們不必自己造 harness、不必自己管理 context,也老實說不必自己堆起所有需要的基礎設施。Notion 就用 Managed Agents 在他們的產品內直接驅動 agent 編排。結果是,他們的使用者可以在自己的 workspace 裡,直接把複雜的長時間工作委派給 Claude。而 Notion 並不孤單。Asana 用 Managed Agents 打造了 AI 隊友——這些是與人類並肩工作在 Asana 專案裡的協作型 AI agent。這些 agent 能接下任務並完成交付物。現在,我想歡迎 Katelyn 回到台上,展示如果你建立在 Claude Managed Agents 之上,一家 AI 原生公司可以是什麼樣子。
Katelyn Lesse — Demo:用 Claude Managed Agents 打造 F1 賽車儀表板
回到二月,Claude 成為 Atlassian Williams 一級方程式車隊的官方思考夥伴。F1 競賽需要一位非常熟悉賽道的偉大車手,但也需要一整隊工程師與研究員,打造一台時速接近 400 公里、裝著四個輪子的火箭。為了向大家展示 Claude Managed Agents 的實際運作,我們與一支虛構的車隊 Shinkiro Racing 合作,幫他們做了一個分析賽車的儀表板。來看看它跑起來的樣子。
這裡是我們為 Shinkiro Racing 做的儀表板。我們的設計是,側邊有這四個研究專案。每個研究專案背後都是一個用 Claude Managed Agents 打造的 agent。我們有空氣力學、胎溫、動力單元,以及車手安全。這幾個 agent 要做的,是研究在各自面向上需要改變什麼,才能讓我們的車更好。我們可以到這裡選擇啟動一次執行。現在就啟動一個。

在它執行的同時,我來談談這些 agent 是怎麼建的。就像 Angela 提到的,我們可以使用 outcomes 這個概念。outcomes 幫我們告訴每個 agent:怎樣才算真正的好。當 agent 執行時,我們會額外配置一個評分(grader)agent,去告訴原本的 agent:你做得夠好嗎?不夠的話,就繼續嘗試。
Claude Managed Agents 的新功能之一,不只是能隨需啟動 agent 執行,還能排程 agent。為了展示這個,我會用 Claude Developer Console。如果我是一位開發 Claude Managed Agents 的開發者,我會用這個 console 來做可觀測性與工具鏈,幫助我把 agent 做得真正出色。在這裡你可以看到,在我們的 sessions 裡,有我剛剛啟動的那次執行。然後也許我們可以看看另一個。你可以看到,我們對 agent 實際在做的所有事情,有更豐富的可觀測性。
不過今天我們發布的更重要的東西之一,是 deployments 這個概念。而——Wi-Fi 現在不站在我這邊。好吧,也許……好,我們跳過。deployments 這個概念讓我們可以選擇按排程啟動 agent 的執行。我原本要展示、現在只能口頭講的是:也許我們想跑一個每晚的車手安全檢查。我們希望車手安全 agent 每天晚上執行,帶著它所有的學習告訴我們,為了車手安全我們還該做什麼更好。我們可以把它排程在每天夜間執行。
但光是讓這些 agent 容易設定、容易使用還不夠。就像 Angela 提到的,這些 agent 能不能真正強大,非常重要。agent 有個有趣的特性:大多數時候它們是從零開始的。
它們沒有利用過去 session 累積的 context,來讓下一次做得更好。所以我們引入了 memory 的概念。這四個 agent 各自擁有一個檔案系統,執行時可以把學到的東西寫進記憶。
但比這更重要的是,我們打造了 dreaming 的概念。我們的 agent 可以決定:也許我該回頭看看這些過去的 session,寫一些 skill 或往記憶裡補些東西,讓下次做得更好。我可以按下這個 dream 按鈕。這會有點慢,因為 Wi-Fi 又不站在我這邊。但會發生的是:我們的 agent 會回顧它們過去的 session,把這些學習寫下來,讓下一次做得更好。

這裡的所有功能——打造一個像這樣、幫助 F1 車隊造出一台非常非常成功的賽車的儀表板所需的一切——今天都已在 Claude Managed Agents 中提供。你剛剛看到的一切,例如 outcomes、排程部署和 dreaming,今天都已在 Claude 平台上線。世界各地的開發者今天就能開始用 Fable 5 和 Managed Agents 打造。接下來 Cat 會談談,Claude Code 如何讓你身為開發者的提供變得更有樂趣。

Cat Wu — Claude Code:從 CLI 到指揮整支 agent 艦隊的控制面
有請 Claude Code 產品負責人,Cat Wu 上台。
Katelyn 和 Angela 剛剛展示了如何在 Claude 平台上打造生產級的 agent。而 Claude Code 把同樣的槓桿帶進你身為開發者的日常工作。不是你提供給客戶的 agent,而是替你提供程式碼的 agent。
首先,我想感謝今天在場以及線上觀看的所有開發者。謝謝你們在 Sonnet 3.7 還是我們的前緣模型、產品還很粗糙的時候,就信任 Claude Code。你們的支持,是團隊每天興奮進辦公室、把產品做得更好的原因。
回頭談談 Claude Code 為什麼存在。Claude Code 的使命,是弭平「一個想法」與「一個提供產品」之間的差距。

我們實現它的方式,是打造能引出模型前緣智慧的工具,並讓每一位 builder 都能用上這些工具。我們不認為自己手上有一份完成的路線圖可以分享。我們更像登山者,在一片沒有人完整測繪過的地形裡與你們並肩攀登,一邊前進一邊一起摸索什麼行得通。

我們隨著 AI 能力的提升與你們一起成長,幫你們應對沿途浮現的新挑戰。我記得就在去年,我給 Claude Code 一個任務,還要逐一審查它做的每個編輯,鉅細靡遺地指示它該改成怎樣,在這些簡單任務的每個小細節上盯著它。現在,我們許多人用 auto mode 把權限委派給 Claude,只在 Claude Code 已經測完它的修改、開好一個可供審查的 PR 之後才去看一眼。
Claude Code 始於 CLI,而 CLI 仍然是進階使用者的歸宿——他們要的是極簡的文字介面、最大的控制權與客製化空間。接著我們加入了 IDE,給那些想要同樣強大的 agent、但希望能跟著看所有程式碼變更的使用者。然後我們聽到許多人在平行跑多個 Claude Code——你們親暱地叫它 multi-Clauding。於是我們新增了兩個介面,讓這件事更容易。我自己最常用的是 Claude Desktop 上的 Claude Code。它是為想要全螢幕圖形介面的人設計的,有內建預覽、側欄控制面,以及渲染圖片與豐富輸出的能力。我們把 desktop 打造成橫跨你所有本機與雲端 session 的單一視圖,用視覺指示器標出哪些 agent 在工作、哪些需要你的輸入。
接著是我們最新的介面:CLI 裡的 Claude agents view。給那些想要控制面、又不想離開終端機的人——

你可以看到什麼在等你、什麼正在跑、什麼已經完成。你可以就地回覆解除卡點,或跳進跳出任何 session 而不失去你的位置。VS Code IDE 擴充與 Claude Desktop 上的 Claude Code,都建立在 Claude Agent SDK 之上——和你們許多人今天正在用的是同一套。
許多企業現在已經全面採用這些 Claude Code 工具。在 Anthropic,即使工程團隊規模大幅成長,工程師平均提供的程式碼量仍是過去幾年的 8 倍。我們很興奮能和大家一起,透過擁抱新挑戰、用 Claude 打造自動化去逐一擊破,來探索並重新定義工程的未來樣貌。
這裡是一些我們從使用者聽到的回饋,以及在這個社群的協助下,我們為每一條回饋打造的產品。我們聽到你們想在 code review 上花更少時間。所以我們推出了 code review 產品,部署一隊 agent 去抓出你 PR 裡的關鍵 bug。

每天有數千家公司在用,包括 Anthropic 所有內部團隊。我們聽到你們很想隨時隨地寫程式。所以我們推出了 remote control 以及 iOS 和 Android 上的 Claude Code。

現在你不用再半開著筆電走來走去,或被釘在桌前。你可以去公園、踩踩草地,還是能把 coding 任務做完。
我們聽到你們想讓 Claude Code 自動處理新工單,所以我們做了 routines。設定一次,它就會按排程、webhook 或 API 呼叫啟動,讓 Claude Code 接手對的任務。過去需要人手動啟動的工作,routines 可以替你包辦。

我們也聽到你們合進的程式碼多到資安團隊快跟不上了。所以我們做了 Claude Security。它在夜間掃描你的 codebase,標記各類弱點——包括它認為最關鍵的那些——並讓你針對每一個啟動一個 Claude Code session 去處理。

最後,我們聽到你們想要更好的方式,在 codebase 上執行有野心的大規模任務,像是大型重構與遷移。所以我們推出了 dynamic workflows。

它讓你啟動 Claude Code,以確定性的結構平行跑數十或數百個 agent,完成你最有野心的任務。這些原語彼此可組合,讓我們能更輕鬆地適應工程的未來。
我講的這一切,任何一位個人開發者今天就能上手。但特別令人興奮的,是看到各式各樣的公司以整個工程組織的規模在採用。例如,Spotify 用 Claude 遷移數千個 repo。團隊在 Claude Agent SDK 上做了一個背景 agent,讀一份用白話英文寫的遷移計畫,然後啟動一支 agent 艦隊去開 PR。他們每個月合併超過一千個 PR 進生產環境,遷移時間縮短了 90%。
另一個例子是 Mercari,日本的 C2C 市集。在 Mercari,整個工程團隊都跑在 Claude Code 上,他們實測工程產出年增 90%。我們在整個產業都看到這件事:數百萬開發者做得更多,品質也比以前更高。
現在,來看看這在實務上長什麼樣子。我很興奮要展示 Claude Code 我最喜歡的新功能之一。在這個 demo 裡,假設我們是 Kaizen Operations,為工程團隊做 app。目前我們的行銷網站只有英文,但我們想再推進 13 個市場。所以上線前得先把網站在地化。

先看我們平常用一個 Claude Code agent 會怎麼做。我們跑這個 prompt,請 Claude 把網站轉成日文。

我們會把過程加速。Claude 探索 codebase、為網站做了一個語言選單,把所有文字翻成日文。Claude 完成了,我們看看結果。這裡是完整的行銷網站,可以看到 Claude 翻的日文新版。這一個翻譯花了 Claude 大約 3 分鐘,而我們還剩 12 個。如果一次一個、循序做下去,得花將近一小時,還要對 Claude 下一堆手動 prompt。
所以我們改用 dynamic workflow,讓 Claude 建立一個可重複的流程,把所有新翻譯同時平行執行。我們 prompt Claude,要它用一個 workflow 來翻這 12 個新語言。

Claude 建立了一個 workflow,準備好之後,我們可以在側欄打開它,看著它工作。這是 Claude Desktop app 很強大的功能。你可以看到 12 個翻譯 agent 同時在跑。翻譯 agent 完成後,它會再開 12 個 agent 去驗證這些新語言的成果。這件以前要分 12 個任務跑的工作,現在一個 prompt 就能完成。而且我們還能把這個 workflow 存成 JavaScript 程式碼,在未來的翻譯中重複使用。看看輸出:Claude 現在建好了 12 個新版網站,一次動作全部在地化完成。我們可以在下拉選單裡看到全部,挑幾個語言看看成果。這只是 dynamic workflows 的一個例子。我們還能用在大規模遷移、codebase 稽核或效能優化——任何需要在確定性結構下同時跑大量 agent 的大型工作。
你們剛剛看到的一切今天都已上線,包括 dynamic workflows 和 Claude Desktop app 裡的 Claude Code。而我們最新的模型 Claude Fable 5,已開放給所有 Claude Code 使用者。所以無論你在哪裡用 Claude Code,都能用上最新的智慧。我們非常期待你們試用這些新功能,並告訴我們你們的想法。希望它們持續幫你弭平「一個想法」與「一個提供產品」之間的差距。
而這正是今天每一場演講共同指向的事。Dianne 的能力曲線、Angela 那些跑在你掌控的基礎設施上的 agent,以及我剛剛展示的東西。這是同一個故事的三層。剩下的差距,只在於我們能多快把這些了不起的能力投入為我們工作。我鼓勵你們用今天剩下的時間探索這三層。
想多了解最新模型能力,就去聽 research 場次。
如果你在為你的終端使用者打造自己的 agent,就去 Claude 平台場次。
或者,想學更多把 Claude Code 帶進日常開發工作的方法,就去 Claude Code 工作坊。
這一切都跑在 Claude Fable 5 上——我們提供過最適合 agentic 工作的模型——而且今天已經上線。謝謝大家,祝 Code with Claude 愉快。