Catalog

教程總覽

共 150 篇教程,免費文章全文開放;VIP 文章開放前兩段試讀。

符合條件:56 篇
API 金鑰管理:別讓金鑰進 git,也別只靠 .env
免費 工具與工作流 進階
API 金鑰管理:別讓金鑰進 git,也別只靠 .env
金鑰外洩的成本很高,而且多數是同一種犯錯方式造成的。
2026-08-28
8 分鐘
LoRA 是什麼:用三個參數理解它在做的事
免費 模型微調 進階
LoRA 是什麼:用三個參數理解它在做的事
不用讀論文也能正確使用 LoRA。理解 rank、alpha 與目標模組這三件事就夠了。
2026-08-27
9 分鐘
把 AI 功能寫成可測試的程式:假模型與快照測試
免費 工具與工作流 進階
把 AI 功能寫成可測試的程式:假模型與快照測試
每次跑測試都真的呼叫模型,既慢又貴又不穩定。有更好的做法。
2026-08-26
9 分鐘
連續批次處理:吞吐量提升最大的一個開關
免費 部署與推理優化 進階
連續批次處理:吞吐量提升最大的一個開關
同樣的硬體,開啟連續批次後吞吐量常常翻好幾倍。理解它為什麼有效。
2026-08-26
9 分鐘
ReAct 迴圈的實作:思考、行動、觀察的最小骨架
免費 Agent 開發 進階
ReAct 迴圈的實作:思考、行動、觀察的最小骨架
不用框架也能寫出可用的 Agent 迴圈。八十行程式碼就能跑,而且每一步都看得懂。
2026-08-26
9 分鐘
用模型當裁判:可靠的 LLM-as-judge 怎麼設計
免費 資料處理與評測 進階
用模型當裁判:可靠的 LLM-as-judge 怎麼設計
讓模型評分很方便,但預設做法的偏誤很大。這幾個修正能大幅提升一致性。
2026-08-25
9 分鐘
微調資料集怎麼準備:格式、數量與品質的實際標準
免費 模型微調 進階
微調資料集怎麼準備:格式、數量與品質的實際標準
微調成敗八成取決於資料。這篇是可以直接照做的準備流程。
2026-08-25
10 分鐘
切塊策略比較:固定長度、語意邊界與結構感知
免費 RAG 檢索增強 進階
切塊策略比較:固定長度、語意邊界與結構感知
切塊是 RAG 影響最大也最便宜的調整點。三種策略的適用文件類型完全不同。
2026-08-25
9 分鐘
文件理解流程:OCR、版面解析與模型各自負責什麼
免費 多模態應用 進階
文件理解流程:OCR、版面解析與模型各自負責什麼
把整份 PDF 丟給視覺模型不是最好的做法。分工的流程更準也更便宜。
2026-08-24
9 分鐘
前綴快取:把重複的系統提示只算一次
免費 部署與推理優化 進階
前綴快取:把重複的系統提示只算一次
如果你的每個請求都帶著兩千字的系統提示,前綴快取幾乎是免費的加速。
2026-08-24
8 分鐘
Agent 的停止條件:怎麼判斷任務真的完成了
免費 Agent 開發 進階
Agent 的停止條件:怎麼判斷任務真的完成了
跑不停與提早收工都是常見故障。停止條件需要明確設計,不能只靠模型自己決定。
2026-08-24
8 分鐘
少樣本示範怎麼挑:三個會讓效果變差的常見錯誤
免費 提示工程 進階
少樣本示範怎麼挑:三個會讓效果變差的常見錯誤
加了範例反而更糟,通常不是因為範例太少,而是挑錯了。這篇講清楚範例的挑選原則與排列順序的影響。
2026-08-24
9 分鐘
訓練資料去重:近似重複比完全重複更麻煩
免費 資料處理與評測 進階
訓練資料去重:近似重複比完全重複更麻煩
完全相同的樣本好抓,改了兩個字的近似重複才是讓評測分數虛高的元凶。
2026-08-23
8 分鐘
QLoRA:在單張消費級顯示卡上微調的實際配置
免費 模型微調 進階
QLoRA:在單張消費級顯示卡上微調的實際配置
4-bit 量化加 LoRA,讓 24GB 顯示記憶體就能微調中型模型。這是可跑通的設定。
2026-08-23
9 分鐘
混合檢索:向量搜尋補不上的那一塊
免費 RAG 檢索增強 進階
混合檢索:向量搜尋補不上的那一塊
產品型號、錯誤代碼、人名這類字串,向量搜尋常常查不到。關鍵字檢索仍然不可取代。
2026-08-23
8 分鐘
串接多家模型服務:抽象層該做到什麼程度
免費 工具與工作流 進階
串接多家模型服務:抽象層該做到什麼程度
過度抽象會綁死自己,完全不抽象又難以換供應商。這是實用的中間路線。
2026-08-22
8 分鐘
從圖片抽取結構化資料:發票與表單的實作模式
免費 多模態應用 進階
從圖片抽取結構化資料:發票與表單的實作模式
單據辨識不要用自由問答,用 schema 約束加上欄位驗證。
2026-08-22
8 分鐘
量化怎麼選:INT8、FP8 與 4-bit 的實際差異
免費 部署與推理優化 進階
量化怎麼選:INT8、FP8 與 4-bit 的實際差異
量化能省記憶體也能加速,但不同精度的取捨很不一樣。這篇給選擇順序。
2026-08-22
9 分鐘
思維鏈的正確用法:什麼時候該讓模型想,什麼時候不該
免費 提示工程 進階
思維鏈的正確用法:什麼時候該讓模型想,什麼時候不該
思維鏈不是萬靈丹。用在不需要推理的任務上,只會增加延遲、成本與出錯機會。
2026-08-22
8 分鐘
學習率與訓練輪數:從損失曲線讀出該停在哪
免費 模型微調 進階
學習率與訓練輪數:從損失曲線讀出該停在哪
微調過擬合的速度比想像中快。看懂曲線比背誦超參數表有用得多。
2026-08-21
8 分鐘
重排模型該不該加:延遲與命中率的實際取捨
免費 RAG 檢索增強 進階
重排模型該不該加:延遲與命中率的實際取捨
重排幾乎一定能提升品質,問題是值不值得那 200 毫秒。這篇給判斷依據。
2026-08-21
9 分鐘
重試與降級:模型服務不穩時怎麼撐住
免費 工具與工作流 進階
重試與降級:模型服務不穩時怎麼撐住
上游會限流、會逾時、會過載。這是一套可直接用的韌性策略。
2026-08-20
9 分鐘
語音轉文字之後:標點、分段與講者辨識
免費 多模態應用 進階
語音轉文字之後:標點、分段與講者辨識
原始逐字稿幾乎不能直接用。後處理決定了它的實用價值。
2026-08-20
8 分鐘
Agent 的記憶設計:短期、長期與什麼都不記
免費 Agent 開發 進階
Agent 的記憶設計:短期、長期與什麼都不記
記憶不是越多越好。多數 Agent 需要的其實是好的摘要,而不是完整歷史。
2026-08-20
9 分鐘
評測集會腐化:三個月後你的分數還有意義嗎
免費 資料處理與評測 進階
評測集會腐化:三個月後你的分數還有意義嗎
固定的評測集用久了會失去區分度。這篇講怎麼維護它的有效性。
2026-08-19
9 分鐘
模型服務的健康檢查:光看行程還活著不夠
免費 部署與推理優化 進階
模型服務的健康檢查:光看行程還活著不夠
模型服務可以「行程還在但已經不能用」。健康檢查必須做真實推論。
2026-08-18
8 分鐘
多 Agent 協作前,先問自己是不是真的需要
免費 Agent 開發 進階
多 Agent 協作前,先問自己是不是真的需要
多 Agent 架構很吸引人,但九成情況下單 Agent 加好工具就夠了,而且更好維護。
2026-08-18
8 分鐘
提示注入的基本防線:分隔、標記與輸出檢查
免費 提示工程 進階
提示注入的基本防線:分隔、標記與輸出檢查
只要你的提示裡有使用者輸入或外部文件,就存在提示注入風險。這篇是可以今天就加上的三道防線。
2026-08-18
10 分鐘
從線上日誌挖評測題:最便宜的高品質資料來源
免費 資料處理與評測 進階
從線上日誌挖評測題:最便宜的高品質資料來源
最貼近真實的題目就在你的日誌裡,關鍵是知道要撈哪些。
2026-08-17
8 分鐘
合成資料怎麼用才不會反效果
免費 模型微調 進階
合成資料怎麼用才不會反效果
用大模型生成訓練資料很方便,但直接拿來訓練通常會把錯誤一起學進去。
2026-08-17
8 分鐘
查詢改寫:使用者問得很爛時怎麼救
免費 RAG 檢索增強 進階
查詢改寫:使用者問得很爛時怎麼救
真實的問題常是「那個怎麼用」。在檢索之前先把問題補完整,命中率會有明顯改善。
2026-08-17
8 分鐘
把提示與程式碼一起做程式碼審查:該看哪幾件事
免費 工具與工作流 進階
把提示與程式碼一起做程式碼審查:該看哪幾件事
提示改動也會造成線上事故,審查標準卻常常缺席。這是一份可用的檢查清單。
2026-08-16
8 分鐘
用提示模板管理版本:把提示當程式碼看待
免費 提示工程 進階
用提示模板管理版本:把提示當程式碼看待
提示散落在各個檔案的字串裡,就沒辦法回答「上週效果比較好的是哪一版」。
2026-08-16
9 分鐘
影片理解的取樣策略:不要每一幀都送
免費 多模態應用 進階
影片理解的取樣策略:不要每一幀都送
影片內容分析的成本主要來自幀數。取樣策略決定了成本與品質。
2026-08-14
8 分鐘
限流與排隊:流量尖峰時怎麼不整個垮掉
免費 部署與推理優化 進階
限流與排隊:流量尖峰時怎麼不整個垮掉
模型服務的資源無法瞬間擴充,所以入口的排隊策略比擴容更重要。
2026-08-14
8 分鐘
metadata 過濾:讓檢索先縮小範圍再比相似度
免費 RAG 檢索增強 進階
metadata 過濾:讓檢索先縮小範圍再比相似度
很多檢索問題不是相似度算錯,而是根本不該搜到那批文件。
2026-08-13
9 分鐘
圖片生成接進產品:提示、種子與版權的三個現實問題
免費 多模態應用 進階
圖片生成接進產品:提示、種子與版權的三個現實問題
生成圖不難,難的是穩定、可重現與可商用。
2026-08-12
8 分鐘
Agent 的成本控管:把費用當成一級指標
免費 Agent 開發 進階
Agent 的成本控管:把費用當成一級指標
Agent 的成本不是線性的,一個沒設限的迴圈就能燒掉整月預算。
2026-08-12
8 分鐘
資料集切分:隨機切分什麼時候會騙你
免費 資料處理與評測 進階
資料集切分:隨機切分什麼時候會騙你
隨機切分很方便,但在有時間性或群組性的資料上會造成嚴重高估。
2026-08-11
8 分鐘
微調模型的評測:不要只看訓練指標
免費 模型微調 進階
微調模型的評測:不要只看訓練指標
訓練損失是給訓練用的,上線決策要看另一組數字。
2026-08-11
8 分鐘
AI 功能的錯誤處理:使用者該看到什麼
免費 工具與工作流 進階
AI 功能的錯誤處理:使用者該看到什麼
模型會失敗,這是設計前提。失敗時的體驗決定了產品的可信度。
2026-08-10
8 分鐘
灰度發布模型版本:怎麼安全地換模型
免費 部署與推理優化 進階
灰度發布模型版本:怎麼安全地換模型
換模型跟改程式不一樣,行為變化沒辦法用單元測試涵蓋。要靠流量分配。
2026-08-10
9 分鐘
Agent 的可觀測性:一次任務該記錄哪些欄位
免費 Agent 開發 進階
Agent 的可觀測性:一次任務該記錄哪些欄位
Agent 出錯時無法重現,通常是因為當時什麼都沒記。這是一份可直接照抄的日誌欄位清單。
2026-08-10
9 分鐘
長文摘要的兩種策略:分段彙整與滑動精煉
免費 提示工程 進階
長文摘要的兩種策略:分段彙整與滑動精煉
文件超過上下文長度時,怎麼摘才不會漏掉關鍵段落。兩種策略各有適用情境。
2026-08-10
8 分鐘
指標選擇:準確率什麼時候會誤導你
免費 資料處理與評測 進階
指標選擇:準確率什麼時候會誤導你
類別不平衡時,準確率 95% 可能代表模型什麼都沒學到。
2026-08-09
9 分鐘
PDF 進 RAG 前的清洗:頁首頁尾、表格與換行
免費 RAG 檢索增強 進階
PDF 進 RAG 前的清洗:頁首頁尾、表格與換行
RAG 效果差,有很高比例的原因出在 PDF 抽取階段就已經爛了。
2026-08-09
8 分鐘
AI 專案的上線檢查清單:發布前的十六個確認項
免費 工具與工作流 進階
AI 專案的上線檢查清單:發布前的十六個確認項
把散落在各篇教程的重點收成一張清單,發布前逐項打勾。
2026-08-08
9 分鐘
多模態輸出的驗證:怎麼確認模型真的看懂了
免費 多模態應用 進階
多模態輸出的驗證:怎麼確認模型真的看懂了
視覺任務的錯誤特別隱蔽,因為輸出看起來永遠很合理。
2026-08-08
9 分鐘
語意快取:相似問題直接回舊答案,可以嗎
免費 部署與推理優化 進階
語意快取:相似問題直接回舊答案,可以嗎
語意快取能省下大量成本,但誤命中的代價很高。要有明確的適用邊界。
2026-08-08
8 分鐘
讓模型承認自己不知道:降低幻覺的提示設計
免費 提示工程 進階
讓模型承認自己不知道:降低幻覺的提示設計
模型預設會傾向給出答案。要它回「不知道」,必須明確給出這條路,而且讓這條路夠好走。
2026-08-08
7 分鐘
上下文塞多少片段最好:k 值的實測方法
免費 RAG 檢索增強 進階
上下文塞多少片段最好:k 值的實測方法
塞越多不一定越準。片段數對準確率的曲線通常在中段就見頂,之後反而下滑。
2026-08-07
7 分鐘
監控模型輸出漂移:使用者沒抱怨不代表沒問題
免費 資料處理與評測 進階
監控模型輸出漂移:使用者沒抱怨不代表沒問題
模型行為可能悄悄改變。這幾個不需要標註的指標可以當早期警訊。
2026-08-05
8 分鐘
串接外部 API 當工具:認證、重試與冪等
免費 Agent 開發 進階
串接外部 API 當工具:認證、重試與冪等
把既有 API 包成工具看似簡單,但認證、逾時與重複執行三個問題一定會遇到。
2026-08-04
8 分鐘
多語言提示:中文任務要用中文提示嗎
免費 提示工程 進階
多語言提示:中文任務要用中文提示嗎
提示語言、輸入語言與輸出語言可以是三種不同的選擇。這篇整理各種組合的實際差異。
2026-08-02
8 分鐘
RAG 的快取設計:哪些能快取,哪些不能
免費 RAG 檢索增強 進階
RAG 的快取設計:哪些能快取,哪些不能
RAG 有三個可快取的層次,用對了能省下大半成本,用錯了會回傳過期答案。
2026-08-01
8 分鐘
把一個大提示拆成多次呼叫:什麼時候值得
免費 提示工程 進階
把一個大提示拆成多次呼叫:什麼時候值得
一次做完所有事的提示很難調。拆成多步後好維護,但延遲與成本會上升,要拆得有道理。
2026-07-31
9 分鐘