多數團隊都是從應用程式碼裡直接呼叫模型供應商。API 金鑰放在環境變數裡,SDK 呼叫只有三行,第一次就跑通了。Cloudflare AI Gateway 之所以存在,是因為接下來會發生的事。帳單來了,卻沒有人說得清是哪個功能花掉的。供應商過了糟糕的一個下午,順帶把你的產品也拖了下去。系統提示詞被改過一次,而舊的那一版回傳過什麼,沒有任何紀錄。 閘道就是放在應用程式與供應商之間的一個代理。所有請求都經過它,所以所有請求都可以被計數、記錄、快取、限流,並且在供應商出狀況時改到別處重試。對於三個原本只會被拖到很晚、再用手工方式解決的問題來說,它是最便宜的結構性修法。 底下要談的是它做什麼,它除了觀測之外還能強制什麼,它在金錢與毫秒上各要...
基礎設施教學
實用的 IT 基礎設施指南,涵蓋雲端、網路、容器與 Kubernetes、DevOps、監控、安全與效能。
「Drupal 很慢」這個名聲,絕大部分來自主機代管,而它幾乎總是一個採購決定,不是軟體問題。網站被認真地做了出來,然後上線在一個以「幾個 PHP 檔案的形象網站」定價的方案上。結果就是:一套帶著正經算繪管線的內容管理系統,跑在一個自己改不了的記憶體上限裡,跑在一個自己控制不了的作業碼快取上,還沒有一個能執行自身工具的命令列。 人們心裡拿來對比的是 WordPress,而這個對比是錯的。WordPress 幾乎在任何環境下都能勉強跑得動,是因為它的市占率逼著主機商把它做成幾乎在任何環境下都能勉強跑得動。Drupal 的前提不同:它假定你有較新的 PHP、較新的資料庫、真正的快取後端、一個命令列,以及一套把程式碼庫當成建置產物、而不是...
可用性 SLA 看起來像一句承諾,實際運作起來卻更像一份退款政策。供應商很清楚這一點。客戶往往並不清楚,於是在簽下服務等級協議時以為自己買到了可用性,而真正買到的,只是萬一沒拿到時的一點折扣。 這不一定是筆糟糕的交易。它只是與大多數人以為自己在簽的那筆交易不同,而這個差別恰恰在系統停擺、有人追問合約究竟怎麼寫的那一刻顯現出來。 三個九聽起來接近完美,卻允許每月 43 分鐘的停機。 四個九允許四分鐘。如果你的業務吸收得了平日下午 43 分鐘的中斷,99.9% 就足夠了,不必為更高的數字付費。如果吸收不了,再多的九也幫不上忙,因為協議給你的是一筆抵用金,而不是阻止這次中斷。 可用性 SLA 用分鐘兌現的承諾百分比把一個非常大的區間壓縮成...
在小團隊裡,災難復原通常只剩下一份從來沒人打開過的文件裡的一行字:備份已經開啟。這句話本身沒有錯,卻算不上任何問題的答案,因為它既沒有說明真正出事時救回來的資料會有多舊,也沒有說明還原一次要花多久,更沒有說明到今天為止究竟有沒有人完整地做過一次還原。 擁有備份和真的能復原之間存在一段明顯的距離,多數的服務中斷正是在這段距離裡升級成事故。一份存在、內容也夠新、卻從來沒有被還原過的備份,本質上仍然只是一個假設;而你第一次驗證這個假設的時刻,剛好是發現它其實是錯的最糟糕的時刻。 兩個數字能把意見變成計畫。 你承受得起丟多少資料,又承受得起停多久?這就是你的復原點目標與復原時間目標。只要營運那一側沒有人把這兩個數字說出口,關於備份頻率的一切...
自架 Kimi K3 在 2026 年 7 月 27 日成為技術上可行的選項,當天 Moonshot AI 連同生產級推理支援一起公開了這個 2.8 兆參數模型的權重。許多組織讀到這則消息後得出結論:現在可以在自家硬體上執行前沿級推理,不必再按 token 付費了。 這個結論通常是錯的,但原因並非人們預想的那樣。工程上是做得到的。真正擊垮多數專案的是那筆帳,而且它往往在預算核准好幾個月後才悄無聲息地發作。 簡短回答: 在 MXFP4 精度下,2.8 兆參數在計入鍵值快取之前就已占用約 1.4TB。一個八卡 H100 節點只有 640GB,因此根本無法服務這個模型。實際的部署要從約 1.7TB 顯示記憶體起步,也就是採用 288GB ...
配置一套穩健的 Cloudflare CDN 快取策略,是 2026 年為企業級網站進行速度最佳化時影響最大的工程任務之一。許多 Web 平台之所以延遲很高,是因為每一個使用者請求都必須存取源站資料庫伺服器才能算繪頁面。這種對源站的依賴會拖慢 First Contentful Paint(FCP)和 Largest Contentful Paint(LCP)等速度指標,而將靜態頁面版面與資源元件儲存在全球各地的邊緣節點,則能從最近的邊緣節點提供快速、低延遲的回應。本指南將詳細拆解快取機制、Edge Cache TTL 規則以及動態 cookie 略過配置。 快取最佳化提示: 避免快取包含已登入使用者資訊的 HTML 頁面。...
遷移到 Cloudflare Zero Trust 是企業在 2026 年替換過時企業 VPN 的關鍵現代化步驟。傳統的 VPN 網路在使用者通過初始登入牆後,會向其授予對整個企業子網的廣泛存取權限,因此單個被盜的員工憑證就會讓攻擊者能夠直接轉向敏感的資料庫伺服器。相比之下,Zero Trust 架構會評估每個應用請求的授權檢查,預設阻止未經驗證的流量。本指南介紹了用於構建 Zero Trust 環境的配置階段、安全隧道設置和策略定義。 VPN 安全風險警示: 傳統的 VPN 設置會使您的內部網路暴露於橫向移動攻擊。升級到邊緣驗證的存取路徑可確保您的資料庫保持隔離,即使員工的本地筆記型電腦被入侵也是如此。 核心要點:...
Cloudflare Pages 託管讓前端團隊能夠發布快速、安全且無需伺服器管理的程式碼。透過使用 Cloudflare Pages,開發者獲得了一個高效能的邊緣原生平台,用於部署靜態 Web 應用、單頁應用(SPA)和伺服器端渲染(SSR)框架。透過直接連接到你的 Git 儲存庫,Cloudflare 自動化建置流水線、產生預覽部署,並在全球範圍內託管資源。本指南將說明如何連接 Git、設定建置設定、設定自訂網域以及設定重新導向。 重點摘要(TL;DR) 部署邊緣原生前端應用;Cloudflare Pages 從 Cloudflare 網路在全球範圍內提供資源,確保次秒級載入時間。 自動化 Git 整合;連結你的儲存庫以觸發自動...
本 Cloudflare Workers AI 教程將向您展示如何直接在 Cloudflare 的全球邊緣網絡上部署和運行機器學習模型。借助 Cloudflare Workers AI,您可以在靠近用戶的地方執行大型語言模型(LLMs)、文本翻譯、圖像生成和語音轉文字,而無需管理複雜的 GPU 伺服器。以下步驟涵蓋了如何配置 Wrangler、編寫 fetch 處理程序、運行 Llama 模型以及優化邊緣 API 成本。 TL;DR 無伺服器運行 AI 模型;Cloudflare Workers AI 管理底層 GPU 基礎設施,僅按活躍計算量計費。 在 wrangler.toml 中配置綁定(bindings);...
Cloudflare Workers 與 AWS Lambda 都是無伺服器運算平台,但兩者的起點不同。Lambda 是龐大 AWS 生態系中確立的無伺服器標準;Workers 則是邊緣原生的,為低延遲與全球分發而生。2026 年,兩者都很出色,正確的選擇取決於你的工作負載與現有技術棧。本指南從真正重要的面向比較 Cloudflare Workers vs AWS Lambda。 重點摘要(TL;DR) Workers 在輕量的 V8 isolates 上於 edge 執行,cold start 幾乎為零,並預設全球分發 Lambda 在 AWS 區域中以 microVM 模型執行,支援眾多語言執行環境,並與 AWS...