一組公開的 Claude Code 技能可將一盤棋轉成附註 PGN 與 HTML 分析棋盤。作者也提供製作旁白影片的流程。Stockfish 負責評估局面;Claude Code 則提出後續問題,並為棋手撰寫說明。專案程式庫提供一盤完整示範對局,以及支撐這套流程的腳本。BIG CHANGE 檢視了文件與程式碼,所用版本為提交46919038,日期為 2026 年 9 月 26 日;我們沒有實際執行流程,也未自行評估棋局建議。

重大變化

  • 有哪些改變:這個小型公開專案記錄了一套流程,把引擎對局面所做的檢查,連結到針對棋手本人對局所撰寫的說明;若有提供棋手的思考紀錄,也會一併納入。
  • 為何重要:棋手可分別檢視 PGN、引擎掃描結果、儲存的查詢棋路與註解,因此更容易針對說明所指的具體局面提出質疑。但本文未衡量這套方法是否能幫助棋手進步。
  • 接下來觀察什麼:模型仍負責選擇問題、解讀引擎棋路並撰寫教學內容。以提示詞驅動的驗證器會檢查這些結果,但有驗證器不代表內容必然正確。若要用輸出進行棋藝訓練,讀者應自行檢視所引用的局面與棋路。

從對局紀錄找出可能的失誤

輸入是一盤 PGN 對局,可直接提供,也可透過棋局連結取得。chess-analysis技能首先設定讀者的棋力程度,讓註解能配合該棋手的需要,也可加入文字筆記。若有錄下邊想邊說的音訊,文件所述流程會使用本機 whisper.cpp 轉錄,再利用 PGN 中的時鐘註記將語音對齊到棋步。這種對齊仰賴可用的時鐘資料,也要能將語音提到的內容對應到棋步;單靠 PGN 無法還原棋手當時的想法。

第一輪機械化檢查見於sweep.py。它會使用 Stockfish 評估每步棋下之前與之後的局面,記錄候選著法與分數;若測得的失分達到腳本預設的 30 個厘兵,就會標記該步棋。文件記載的預設搜尋深度為 22。這些評估能找出值得深入檢視的局面,但分數本身並不能解釋失誤原因。

接著,技能會指示 Claude Code 的調查代理檢視每個遭標記的局面。query.py它可以詢問 Stockfish 其他走法,包括限定搜尋特定候選著法,並將結果棋路存成 JSON。另一組指示會要求調查代理檢視棋盤影像,解釋某步棋或替代走法為何有效。只有與特定棋步相符的棋手筆記,才可用來輔助說明。從這一步開始,引擎輸出會轉化為模型撰寫的西洋棋說明,判斷與潛在錯誤也隨之進入結果。

這些檢查與輸出能證明什麼

程式庫中的chess-analysis技能要求另一個驗證代理,使用引擎掃描結果與棋手筆記檢查完成的註解。檢查清單涵蓋遭標記的失誤、合法變例、評估說法及對棋手想法的描述;評估主張應與掃描結果或儲存的引擎查詢相符。build_annotated.py腳本也會重新解析 PGN,並回報解析錯誤。這是兩種不同的檢查:解析成功代表棋譜著法可被讀取;驗證器則是另一輪由模型指示、針對說明內容所做的審查。兩者都無法證明每一種解讀必然正確。作者表示,自己使用時很少遇到錯誤,但沒有提供獨立的錯誤率研究。

儲存後的附註 PGN 與build_viewer.py會產生獨立的 HTML 棋盤,包含註解、評估圖表與快取的引擎棋路。另一個可選的chess-video技能會從附註 PGN 與引擎掃描結果開始,要求 Claude Code 撰寫分鏡,再由腳本算繪棋盤、合成旁白,並製作含字幕的 MP4。程式庫提供一個作者自己的快棋示範,包含逐字稿、引擎掃描、註解及一段 6 分 49 秒的影片。這個案例展示預期產物,並非對多位棋手或多盤棋局進行的成效測量。

前置條件、時間與限制

該專案的README指出,將技能資料夾複製到 Claude Code 的個人或專案技能目錄後,再提供棋局連結或 PGN 即可。Claude Code 官方文件也確認了這些技能目錄位置。分析需要安裝 Python 與python-chess及cairosvg,另需 Stockfish 執行檔。程式庫的下載腳本會先使用已安裝的執行檔,否則便下載 Linux x86-64 版 Stockfish 17.1。Stockfish 目前的下載頁面列出第 19 版,因此程式庫的備援下載固定使用較舊版本。選用音訊功能需要 whisper.cpp 與模型;其文件說明如何將音訊轉成 16 位元 WAV,供whisper-cli使用。影片階段還需要 Pillow、Piper 文字轉語音或 espeak,以及 FFmpeg。這些流程與相依套件是文件所述內容;本文不是安裝測試,也不保證能在特定電腦上相容。

作者估計,完成整套復盤與影片約需一小時處理時間。程式庫未提供該次執行的費用明細。Anthropic 目前的方案表將 Claude Code 列於 Pro 方案,而非免費方案;按月計費時 Pro 每月 20 美元,並設有用量限制。本機運算時間、訂閱或 API 用量,以及選用的轉錄與影片設定,都會讓實際成本因使用者環境而異。示範所需時間與作者對準確度的看法,都應視為單一使用者的經驗。