AI 代理人支付在大約一年之內產生了四份彼此競爭的規範、兩個產業基金會,以及海量的報導。它還沒有為絕大多數商家產生的,是營收。噪音與數字之間的落差才是值得理解的部分,因為興奮的報導和輕蔑的報導都以讓人賠錢的方式弄錯了。 確實有真東西正在被打造。Google、OpenAI、Stripe、Coinbase、Shopify、Visa 和 Mastercard 都在這個領域交付了規範或產品,其中兩份規範如今歸屬於中立的基金會,而不是單一廠商。其中一部分已經在正式環境中運作。但正式環境裡的大部分流量,是機器向另一台機器購買 API 呼叫,而不是購物助理向你買一張沙發。 本文把已經交付的東西與只是掛了一排標誌的規範區分開,說明你的結帳流程和風控...
AI整合
關於AI整合的文章、指南和教程,為開發者和企業提供實用知識與技巧。並說明真實成本與取捨。
多數團隊都是從應用程式碼裡直接呼叫模型供應商。API 金鑰放在環境變數裡,SDK 呼叫只有三行,第一次就跑通了。Cloudflare AI Gateway 之所以存在,是因為接下來會發生的事。帳單來了,卻沒有人說得清是哪個功能花掉的。供應商過了糟糕的一個下午,順帶把你的產品也拖了下去。系統提示詞被改過一次,而舊的那一版回傳過什麼,沒有任何紀錄。 閘道就是放在應用程式與供應商之間的一個代理。所有請求都經過它,所以所有請求都可以被計數、記錄、快取、限流,並且在供應商出狀況時改到別處重試。對於三個原本只會被拖到很晚、再用手工方式解決的問題來說,它是最便宜的結構性修法。 底下要談的是它做什麼,它除了觀測之外還能強制什麼,它在金錢與毫秒上各要...
Agentforce 依用量計費,光是這一點就該改變你編預算的方式。多數 Salesforce 買家帶著席次授權的思維進場,問一個代理人每位使用者每月多少錢,然後拿到一個並不描述自己帳單的數字。帳單取決於代理人執行了多少次動作,而那又取決於代理人設計得有多好,以及你的知識庫有多好。 這讓它在企業軟體採購裡顯得不尋常。代理人內部的設計決策就是帳單上的項目。一步答完一個問題的代理人,成本只有磨過五步那種的五分之一,而授權條款不會告訴你自己做出來的是哪一種。你會從帳單上知道答案,通常是在第三個月。 Agentforce 到底要花多少錢? Salesforce 有兩種計費方式。Flex Credits 是每 100,000 點 USD...
WordPress 7.0 於 2026年5月20日發布,版本代號 Armstrong,比原訂 2026 年時程表上的日期晚了六週,而它是自 block editor 以來對代理商影響最大的一次核心發布。標題寫的是核心現在可以和生成式 AI 模型對話。更值得注意的細節是,核心現在還規定了外掛應該如何與這些模型對話,這悄悄改變了網站上每一個外掛能對自己地盤作出的假設。 對編輯者來說,看得見的變化並不多。多了一個 Command Palette、一個更整潔的儀表板、一個字型管理畫面,以及更好用的修訂版本。但對以維護網站為業的人來說,真正重要的變化藏在後台底下:options 資料表裡的一個憑證儲存區、一份網站能做哪些事的註冊表,以及一個...
Drupal 的 AI 已經不再是一堆按廠商拆開、誰需要誰自己掛上去的貢獻模組。它現在是一個有抽象層托底的統一專案,有安全團隊涵蓋的發布週期,並且在 Drupal CMS 裡被包裝成產品,在安裝過程中主動問你要不要把其中一部分打開。值得問的問題已經從 Drupal 能不能做 AI,變成了哪些部分值得打開,以及當四位編輯每個工作日都在用它時,每一項功能到底要花多少錢。 多數文章講到示範就停了。有人敲一段提示詞,頁面出現了;你看著聊天機器人建出一個內容類型。示範本身是真的。它沒有告訴你的是,編輯按下那個按鈕的瞬間有什麼離開了你的基礎架構,清單上的模組裡哪些從來沒有發布過穩定版,以及哪一條預算真的會漲。 Drupal AI 給企業帶來了什...
企業 AI 代理人是一個熟悉故事的當下版本:一個十分鐘就展示得很漂亮的原型,接著是六個月的努力,只為把它做到夠可靠、可以無人看管。幾乎全部預算都消耗在這兩種狀態之間的距離裡,而幾乎沒有任何行銷資料描述這段距離。 代理人與聊天機器人有一處在商業上真正要緊的差別。聊天機器人產出文字,由人來決定拿它做什麼。代理人則會採取行動:呼叫系統、寫入紀錄、發送訊息。這一轉變把風險從尷尬變成了後果,也正因如此,所需的工程紀律更接近建置一套支付系統,而不是一件內容工具。 錢實際花在哪裡: 模型是最便宜的部分。成本在工具整合、評測框架、護欄,以及交回給人的路徑上。一個簡單的內部代理人是 £5,000 到 £12,000,帶檢索的是 £12,000...
微調 vs RAG 這個題目,多半不是以問句出現,而是直接以一句結論登場:我們要拿自己的資料去微調一個模型。這大概是企業 AI 裡最花錢的一句話,而且多數時候是錯的。不是每次都錯,但確實多數如此。這句話背後幾乎只有兩種真實情況:模型不清楚我們公司的事,或者模型回答的方式不合我們的要求。前者用微調來解很糟糕,後者用微調來解很貴。 在微調、RAG 與提示詞之間做取捨,並不是工程師的口味問題。這三者處理的是完全不同類別的毛病,一旦選錯,換來的會是好幾個月的工,而最初那句抱怨依舊原樣擺在那裡。 最能省下預算的一條原則: 如果毛病出在模型不知道某件事,就用檢索。如果毛病出在模型知道,但回答的風格、格式或篇幅不對,先把提示詞改好,真的無效時才輪...
進入 2026 年後,認真考慮遷移離開 OpenAI 的團隊明顯變多了。開放權重模型在日常生產任務上的品質已經很難與頂尖模型區分開來,公開單價更低,而權重本身可以下載這一點,把與廠商的關係從依賴變成了選擇。 但這不代表切換是免費的。API 呼叫本身幾乎一模一樣,真正要做的工作在它周圍的一切。本文說明:哪些東西能原樣搬過去、哪些會悄悄出問題、怎樣設計一次有意義的比較,以及什麼時候留在原地才是正確答案。 先把預期對齊。 換廠商就是換一個基底 URL、一個模型名稱、一份憑證。但要拿回同樣的輸出品質,那是以天為單位計的提示詞工程。給一個範圍明確的功能預留一到三週。任何假設可以即時替換的估算,都是樂觀估算。 哪些東西能原樣搬過去比你想的多,這...
自架 Kimi K3 在 2026 年 7 月 27 日成為技術上可行的選項,當天 Moonshot AI 連同生產級推理支援一起公開了這個 2.8 兆參數模型的權重。許多組織讀到這則消息後得出結論:現在可以在自家硬體上執行前沿級推理,不必再按 token 付費了。 這個結論通常是錯的,但原因並非人們預想的那樣。工程上是做得到的。真正擊垮多數專案的是那筆帳,而且它往往在預算核准好幾個月後才悄無聲息地發作。 簡短回答: 在 MXFP4 精度下,2.8 兆參數在計入鍵值快取之前就已占用約 1.4TB。一個八卡 H100 節點只有 640GB,因此根本無法服務這個模型。實際的部署要從約 1.7TB 顯示記憶體起步,也就是採用 288GB ...
Kimi K3 API 帶著一個不尋常的組合登場:接近前沿水準的基準成績、積極的定價,以及可供下載的權重。Moonshot AI 在 2026 年 7 月 27 日公開了這些權重,使 K3 成為迄今公開發布的最大模型,也是這種規模的模型首次在原則上可以由你自己運行。 對於已經在向前沿供應商付費的團隊而言,這提出的是務實問題而非哲學問題:它在你的技術堆疊裡有沒有位置,把一部分流量遷過去究竟會改變什麼。本文討論成本試算、整合工作,以及那些公開數字無法轉化為生產表現的環節。 簡而言之: Kimi K3 的快取未命中輸入約為每百萬 token 3 美元,快取命中輸入約 0.30 美元,輸出約 15 美元,脈絡視窗為 1,048,576...