LLM 大語言模型再強大,也無法回答訓練資料以外的內容,像是公司內部文件、最新新聞、個人筆記等。RAG(Retrieval-Augmented Generation,檢索增強生成)讓 LLM 在回答之前先從外部資料庫撈出相關段落當作參考,補上模型缺少的知識。這篇文章介紹什麼是 RAG、能做什麼、運作原理(含 Embedding 與高維度向量空間)、什麼情境適合或不適合使用 RAG,以及目前常見的 RAG 框架、向量資料庫與整合平台。
RAG 入門教學|LLM 知識、Embedding 原理與常見問答
Claude Code 圖片生成教學|透過 Codex CLI 呼叫 GPT Image 2
Claude Code 開發網站或撰寫文件時,可以呼叫本機 Codex CLI 取得插畫、Banner 與概念示意圖。本文說明 Claude Code、Codex 和圖像模型的角色,整理 ChatGPT 登入方式、codex exec 指令、生成檔案的確認與複製流程,並提供可放入專案的 SKILL.md 範本。Codex 內建生圖使用 GPT Image 2 並計入 Codex 用量,與另外提供 API Key 的圖片 API 計費分開;檔案位置、權限與等待時間則以實際版本及執行結果為準。
Code with Claude 2026 開發者大會|Anthropic 押注工具產品化,Claude Code 全面升級
Anthropic 在 2026 年 5 月舉辦第二屆 Code with Claude 開發者大會,橫跨舊金山、倫敦、東京三城。主軸押在工具產品化,把 Claude 從聊天模型升級成 Coding Agent 平台:API 用量年增 17 倍、Claude Code 上限翻倍、Managed Agents 多代理編排、Outcomes 與 Dreaming,加上 Code Review、CI auto-fix、Remote Agents 等新功能。本文整理大會重點與對開發者的實際影響。
Claude Code 節省 Token 與快取指南|運作原理、ESC 影響與 statusline 監控
Claude Code 用久了會發現 token 燒得特別快,根本原因常常不是模型話多,而是 prompt cache 沒命中。本文整理 Claude Code 的快取運作原理、什麼動作會破壞快取(包含點兩下 ESC rewind 的實際影響)、實用的節省 token 技巧,並分享一份自製 statusline 設定,讓使用者隨時看到 cache hit rate、快取剩餘時間與 context 用量,搭配 refreshInterval 每 10 秒自動更新,把每一塊錢花在刀口上。
Claude Code Skills 入門|SKILL.md 機制、放置位置與實作範例
Claude Code Skills 將可重複使用的工作流程寫成 SKILL.md,搭配專案或個人資料夾,就能透過描述自動匹配,也能以 slash command 手動呼叫。本文提供資料夾位置、最小範例、frontmatter 欄位與觸發排錯,並說明 Skills、CLAUDE.md 和 MCP 的用途差異。名稱與描述清單仍會占用 context,完整本體則依呼叫載入;理解這個界線後,可以將長範本與參考文件拆開保存,讓工作流程容易維護,也避免將按需載入誤解成完全沒有 token 成本。
Claude Code 降智/變笨事件|Anthropic 公布三個 Bug 的 post-mortem 與額度重置
2026-04-23 Anthropic 公開 Claude Code 品質下降的 post-mortem,承認過去兩個月使用者抱怨變笨、額度消耗飆升的真正原因是三個獨立 bug:reasoning effort 被降級、caching 優化錯誤把 thinking 清掉、verbosity 系統提示詞讓 coding 評測分數掉 3%。公司同日把所有訂閱者的使用額度重置、Opus 4.7 預設拉回 xhigh reasoning。這篇整理三個 bug 來龍去脈、Anthropic 為什麼這次願意承認、以及使用者實際拿到什麼補償。
Claude Code /passes 指令|贈送 Claude Pro 7 天試用券與回饋機制
Claude Code 在 2025 年 12 月加入了 /passes 指令,讓 Claude Pro Max 訂閱者可以送出 3 張 7 天免費試用券給朋友,受邀者完成付費轉換後,贈送者每張還能獲得 $10 Claude 額度回饋加上額外使用量。這篇文章整理 /passes 的使用方式、贈送者與受邀者各自需要注意的條件、跟 claude.ai 禮物訂閱的差異,以及幾個官方目前沒有完整公開的細節。
Claude Code Routines 解析|從排程 Chatbot 到Coding Agent
Anthropic 在 2026 年 4 月推出 Claude Code Routines,把 Claude Code on web 的雲端 session 打包成可被排程、API 或 GitHub 事件觸發的自動化任務。本文整理 Routines 跟 ChatGPT Tasks、Gemini Scheduled Actions 的本質差異、三種觸發方式怎麼用、Pro/Max/Team 的每日次數與 token 雙層限制,還有手機端目前完全沒整合的踩雷紀錄。
Harness Engineering|AI Agent 從提示詞工程、上下文工程演進的新顯學
Harness Engineering(駕馭工程)是 AI Agent 開發的最新顯學,承接了 Prompt Engineering(提示詞工程)與 Context Engineering(上下文工程)兩個世代留下的成果。這篇用三個時期的脈絡,講清楚 Harness Engineering 為什麼出現、解決哪些 Prompt 跟 Context 處理不了的問題,並說明舊名詞淡出不是退流行,而是成熟地融入產品,過去學的知識從來不會浪費。
Playwright CLI 教學|搭配 Claude Code 的瀏覽器自動化實戰
Playwright 是目前最主流的跨瀏覽器自動化框架,而 playwright-cli 讓我們不用建專案、不用寫測試套件,一行指令就能截圖、錄製操作、抓登入後的資料。這篇文章會介紹 Playwright 與 Puppeteer 的差異、為什麼會誕生 playwright-cli、它跟 Playwright MCP 的定位差在哪,並搭配 Claude Code 示範四個實際應用:自動截圖比對、codegen 錄製、連既有瀏覽器操控社群、把流程固化成腳本省下 AI token。