給 Codex 加上影片 Skill:從文字構想、動效到真人素材剪輯的流程拆解 › ◷ 2026-08-08 1,839 字 約 4 分鐘 #AI #AI Agent #Agent Skills #Codex #影片筆記 +2 這支短片展示四類可供 Codex 調用的影片相關 Skill:由文字構想產生影片、以描述建立動態視覺、整理真人素材,以及為影片模型補足鏡頭語言。本文按音訊轉錄梳理其流程,並說明需... ›
Book-to-Skill 深度拆解:把書轉成可執行 Agent 技能,再用它協作開發塔防遊戲 › ◷ 2026-08-08 2,302 字 約 5 分鐘 #AI #AI Agent #Agent Skills #Book-to-Skill #Claude Code +3 以 MojoAI 的 Bilibili 示範為起點,拆解如何把技術書或文件蒸餾成 Agent 可調用的 Skill,並用遊戲設計技能帶領需求澄清、架構生成、實作與除錯;同時核對相關開源 book-to-ski... ›
SkillOpt:把 Agent 的自然語言技能當成可訓練參數 › ◷ 2026-08-07 1,719 字 約 4 分鐘 #AI #AI Agent #LLM #Microsoft #Prompt Engineering +2 Microsoft 開源的 SkillOpt 把 Markdown 技能文件視為凍結式 LLM Agent 的可優化狀態,透過執行軌跡、反思、受限文字修改與驗證集閘門,持續產生可部署的 best_skill.md,而不改... ›
查證短片:所謂 Microsoft「Skill Recorder」是否官方開源工具? › ◷ 2026-08-07 1,379 字 約 3 分鐘 #AI Agent #GitHub #Microsoft #事實查核 #工作流自動化 +1 針對一支宣稱 Microsoft 開源「Skill Recorder」的 Bilibili 短片,本文核對公開影片資料與 GitHub 倉庫歸屬;目前未找到足以支持其為 Microsoft 官方專案的證據。 ›
影片整理:Qwen3.6「無審查」本地模型與 Agent 部署展示(含查核限制) › ◷ 2026-08-07 1,444 字 約 3 分鐘 #Agent #Qwen3.6 #llama.cpp #影片整理 #本地部署 +2 整理零度解说對一個標示為 Qwen3.6-35B-A3B「無審查」版本的本地部署展示。本文區分影片作者主張、可從影片流程觀察到的內容,以及因自動轉錄和未獨立查核而不能視為結論的部分... ›
ComfyUI 免費雲端部署深度拆解:騰訊 CNB、H20 額度、公開 URL 與本機 3090 Ti 如何分工? › ◷ 2026-08-06 3,334 字 約 7 分鐘 #AI #ComfyUI #GPU #H20 #資訊安全 +2 從影片的騰訊 CNB ComfyUI 教學出發,深度分析月度 GPU 額度的時效性、雲端部署架構、H20 的實際意義、公開 URL 與密鑰風險、模型供應鏈、成本控制,以及如何與本機 RTX 3090 Ti... ›
WanGP 深度拆解:本地 AI 影片工作台如何整合文生影片、圖生影片、音訊對口型與低顯存部署? › ◷ 2026-08-06 3,551 字 約 8 分鐘 #AI #ComfyUI #Wan2GP #WanGP #圖生影片 +2 深度整理 WanGP(Wan2GP):它不是單一模型,而是整合 Wan、MiniMax H3、LTX、Hunyuan、圖片與 TTS 模型的本地工作台;拆解文生影片、圖生影片、音訊對口型、量化低顯存策略、Co... ›
MiniMax H3「越獄模型」與 8GB 本地部署深度拆解:官方開源、第三方權重與 ComfyUI 風險 › ◷ 2026-08-06 3,111 字 約 7 分鐘 #AI #ComfyUI #MiniMax H3 #Qwen3-VL #模型安全 +2 拆解 MiniMax H3 正式開放、ComfyUI 本地部署與「越獄模型」說法:核對官方 15 秒/24FPS/2K 流程,說明 8GB 量化限制、第三方 uncensored Qwen3-VL encoder 的非官方定位、授... ›
MiniMax H3 ComfyUI 深度拆解:8GB 顯存、15 秒、2K、24FPS 與全能參考模式到底如何實現? › ◷ 2026-08-06 3,962 字 約 8 分鐘 #AI #ComfyUI #I2V #MiniMax H3 #Ref2VA +2 深度整理 MiniMax H3 ComfyUI 整合包:核對 8GB 顯存、15 秒、2K、24FPS、FL2VA、Ref2VA、模型目錄、量化配置、RTX 30/40/50 相容性,以及官方 2K 流程和授權限制。 ›
NVIDIA LocateAnything-3B 深度拆解:3B 參數如何用平行框解碼定位圖片中的任何目標? › ◷ 2026-08-06 3,354 字 約 7 分鐘 #AI #GGUF #LocateAnything #NVIDIA #Visual Grounding +3 從影片介紹出發,深度拆解 NVIDIA LocateAnything-3B:它如何把自然語言轉成物件框與點座標、Parallel Box Decoding 為何提高效率、3B 與 32B 戰力說法應如何理解,以及筆電本地... ›
Codex 審美 Skill 深度拆解:14,693 條提示詞與 24,684 張圖片如何改善 AI 生圖流程 › ◷ 2026-08-05 1,959 字 約 4 分鐘 #AI #AI Agent #Codex #Prompt工程 #Skill +3 根據 Bilibili 公開頁面整理 Codex 審美 Skill 的工作流:先定構圖、光線、配色與視覺方向,再從真實提示詞與圖片資料庫尋找案例;同時分析開源資料、授權、重現性與使用限制。 ›
JZSub:用一個 Skill 自動下載影片、翻譯並製作雙語字幕 › ◷ 2026-08-05 2,065 字 約 5 分鐘 #AI Agent #Codex Skill #FFmpeg #JZSub #yt-dlp +3 深度整理 JZSub Skill:從影片網址自動下載影音、取得字幕、用大模型翻譯、輸出雙語 SRT/ASS、燒錄 MP4 及取得封面,並核實其平台支援、Codex 安裝、交付模式、依賴與安全限制... ›