文件名稱
輸入技能、工具或專案名稱,尋找使用手冊與實作範例。
搜尋
搜尋標題、章節、標籤與內文,直接前往相關章節。
進階路徑 把 html-video 接進你的內容流程。 studio 適合互動式產製,CLI 與套件則讓你把它接進自動化流程。以下是幾條官方文件支持的延伸方向。 延伸方向 1. 用 search-templates 做選範本路由。search-templates --intent "..." --top N 以自然語意搜尋範本庫,可在腳本裡先選定範本,再交給 agent 填內容。 **2. 文章與 repo 一鍵成片。**studio 在伺服器端抓取 URL 或 repo,適
FROM THE EDITOR · APRIL 2026 browser-use 對付網頁的那招,現在搬到影片上了。 編者手記 編者按 編者手記 EDITOR'S NOTE browser-use 當年讓 LLM 看 DOM 而不是截圖 — 速度與精度都暴增。video-use 套用同一個直覺:別讓 Claude 看影片畫面,改餵它 ElevenLabs Scribe 產的 word-level transcript + 音訊事件標記。LLM 只在檔案層級規劃剪接點,ffmp
這到底是什麼 不是轉檔工具, 是給 LLM 的一雙眼睛。 大部分 AI 工具其實沒有真的「看」影片。把 YouTube 連結貼給 ChatGPT,它讀的是逐字稿,不是畫面。Claude 直接不收影片檔案。連原生支援影片的 Gemini,也得先把整支片傳上 Google 的伺服器,並以固定的 1fps 頻率取樣——快速剪接的鏡頭照樣會漏看。 claude-real-video(CLI 指令 crv)換一種做法,而且全部在本機執行:給它一個網址或本機檔案,它抓的是真正發生場景變化
這到底是什麼 把影片,變成 Claude 能讀懂的畫面與字幕。 大型語言模型不能直接「看」影片,但它能讀圖、能讀文字。claude-video 就是補上中間這一層:把一支影片拆成畫面幀(frames)加上帶時間戳的逐字稿,交給 Claude 平行處理。指令名稱是 /watch,作者是 Brad Bonanno。它建立在既有工具上——yt-dlp 負責下載、ffmpeg 負責抽格、Whisper 負責補字幕——本身只封裝成一個 Claude Skill。 流程分七步:你給一段影
架構概觀 確定性時間函數與生成式排版 pdoom-video 將整首歌曲的時間軸轉化為純數學函數,將視覺畫面定義為時間點 t 的確定性輸出。專案為歌曲《I'm Upping My P(doom)》製作,全程由 Claude(Opus 5.5)於 Claude Code 環境協同生成,涵蓋視覺概念、音訊對齊分析、引擎核心與 17 個場景模組。 架構分為兩個獨立層級:Python 音訊分析管線(使用 uv 管理 Demucs 音軌分離與 CTC 強制對齊),以及前端渲染引擎(Bu
搜尋方式
以文件名稱尋找工具,或描述你要完成的工作。
輸入技能、工具或專案名稱,尋找使用手冊與實作範例。
搜尋安裝、設定或整合方式,直接開啟文件中的相關章節。
輸入客服自動化、社群行銷或投資分析,以任務概念尋找相關文件。