讓機器自己寫故事:在本地跑一個語言模型
從語言模型的基本原理講起,說明為什麼要在自己的機器上跑 LLM、一個本地服務長什麼樣,最後用 Docker 把 Ollama 架起來並發出第一次生成請求。
文章 › 技術筆記
網站、部署與工具實作的過程記錄,寫給日後要再做一次的自己。
從語言模型的基本原理講起,說明為什麼要在自己的機器上跑 LLM、一個本地服務長什麼樣,最後用 Docker 把 Ollama 架起來並發出第一次生成請求。
從擴散模型的原理談起,說明一張 AI 插畫是由底模、LoRA、VAE 疊出來的,為什麼用 ComfyUI,最後用 Docker 把模型掛好並透過 API 送出一份 workflow。
從 TTS 的運作原理談起,說明零樣本語音克隆為什麼只要幾秒參考音就能複製聲線,如何把一個 TTS 專案包成容器服務,以及中文合成實際會踩到的幾個坑。
從「影片其實就是影格加音軌」談起,說明繪本影片的合成流程怎麼拆解,FFmpeg 在這條線裡扮演什麼角色,以及語速、頁間停頓、字幕這些實際加工怎麼做。
整理從 Cloudflare Pages、Workers、Resend 到 Tunnel 的實際部署流程,聚焦在靜態站、表單寄信與內部 API 對外提供時的設定重點與常見問題。