装完 Codex 不知道干什么?这 6 个 GitHub Skills 让你做视频搞钱
文章介绍了 6 个适用于 Codex 的 GitHub Skills,涵盖动效生成、视频剪辑、批量制作、AI 生成及中文剪辑等工具,帮助用户构建自动化视频工作流以提升效率。
文章介绍了 6 个适用于 Codex 的 GitHub Skills,涵盖动效生成、视频剪辑、批量制作、AI 生成及中文剪辑等工具,帮助用户构建自动化视频工作流以提升效率。
作者体验了纳米Work产品,通过两个真实任务测试其Agent能力。该产品成功调用多家大模型完成了产品宣传片剪辑及文案落地页制作。产品具有全过程透明、支持多模型切换及移动端接管等特点,展示了AI作为工作伙伴的巨大潜力。
文章深入剖析了 Jason Liu 关于 Codex 的实战 workshop,指出 AI 并发提升了效率,但也带来记忆负担。真正的分界线在于构建可持续、可审阅的工作闭环:利用长线程、文件化记忆、Heartbeat 与 Goal 机制,以及明确的权限边界,让 Agent 从单纯的工具转变为可靠的长期工作搭档。
本文分享了作者在制作AI视频过程中,从使用MiniMax云端API转向本地部署IndexTTS2的实践经验。作者详细对比了两者在中英混排发音、音频格式、离线能力、声线一致性及成本等方面的优缺点,最终选择了IndexTTS2以保障视频工作流的可控性与稳定性。
本文介绍如何超越个人知识库,构建一个“公司大脑”。通过将文件系统与 AI 智能体结合,设定文件夹作用域、定时任务和自动汇报,让智能体自动处理营销、文件归档等工作,实现无需人工干预的全自动企业级知识管理。
文章深入解析了 Matt Pocock 的 AI 工具 /grill-me 的核心逻辑。该工具并非让 AI 直接执行任务,而是通过一套追问协议,强迫 AI 先理清需求再行动,解决了 AI 瞎猜和抢跑的问题。文章进一步阐述了完整的 AI 协作五步法:质疑、规格化、拆票、TDD 和架构评审,旨在通过纪律约束防止 AI 失控,提升人机协作质量。
文章详细记录了作者构建个人 AI 视频生产线的全过程。包括从 MiniMax 云端声音克隆迁移到本地 IndexTTS2 以降低成本和延迟,解决参考音频漂移问题;接入 HeyGen 数字人实现虚拟分身,并通过脚本自动化视频合成与人脸裁切。文章分享了具体的代码配置、生产流程(脚本、配音、字幕、合成)以及避坑指南,适合高频视频创作者参考。
作者将 TikTok 运营工作流封装成 Codex Agent Skill,结合达人精灵 MCP 数据,实现选品、账号诊断、类目研究和增长规划的自动化。文章详细介绍了四个核心技能的安装、配置及具体 Prompt 使用方法,解决了 AI 运营中的幻觉与流程混乱问题。
作者讲述侄子利用暑假开发两个健康类 Agent Skill 的经历。从“养生谣言粉碎机”到“体检行动助手”,解决了大模型幻觉、信息检索权威性及流程设计等难点。文章重点介绍了如何利用豆包搜索 API 的结构化数据与权威过滤功能来增强 Agent 能力,并分享了 Skill 开发优于独立 Agent 的实践经验和建议。
本文介绍了 Codex 与 Figma 结合的 AI 产品开发工作流。通过 Figma MCP 连接两者,实现了从需求梳理、设计生成到代码开发及浏览器验证的闭环。文章详细讲解了如何利用 Codex 进行需求分析和代码编写,以及如何在 Figma 中进行双向协作与设计评审,大幅降低了产品原型开发的门槛。
作者分享了利用 Codex、Hyperframes、HeyGen 和 IndexTTS2 等工具构建的自动化视频工作流,实现了零基础、低成本的短视频制作与变现。文章详细介绍了各工具的选型理由、工作流架构及成本账单,旨在帮助读者通过 AI 技术解决内容生产的效率问题。
本文是对腾讯 AI 设计平台 Miora 的实测体验。作者通过生成带货视频和制作小红书封面的真实任务,评估了其功能与交互。文章认为,Miora 通过封装工作流降低了门槛,适合小白快速出初稿,但在人物一致性、状态反馈和交互细节上仍有待完善,目前更适合作为初稿加速器。
作者开源了 55 个用于视频生产的 AI Skill,涵盖选题、洗稿、配音、剪辑、动效及质检等全流程。通过 Skill 的自动串联,实现了“一句提示词出一条视频”的高效工作流,大幅降低了内容创作的时间成本。
文章介绍了开源文件传输工具 LocalSend,通过限定同一网络等边界,实现了极简、高效的设备间文件传输。作者进一步引申这种“用边界换轻松”的产品思维,并演示如何利用 Codex 快速构建一个轻量级的活动资料领取页,主张用小工具解决具体问题而非构建复杂系统。
作者开源了自媒体内容生产全流程,包含9个Skill和27份模板,涵盖选题、账号分析、多平台文案、短视频、数据复盘等环节,强调人机协作而非一键生成。
文章分析了自动化工具 n8n 的本质与应用场景。作者指出 n8n 并非自动赚钱的工具,而是通过连接不同节点解决重复性“脏活”的流程助理。文章详细列举了内容生产、销售跟进、客服分流、报表自动化、知识管理及 AI Agent 底座六大落地场景,强调核心价值在于业务流程理解而非单纯的技术操作。
本文深入解析了Codex进行自动化剪辑的底层逻辑,主要涵盖三部分:通过建立分类素材库解决画面问题;利用AI配音或TTS技术解决声音问题;借助参考视频和FFmpeg等工具实现画面与声音的合理编排。文章旨在帮助读者搭建专属的自动化视频剪辑工作流。
文章介绍了 Graph Engineering,一种通过流程图协调多个 AI 协作完成复杂任务的方法。它将复杂任务拆解为节点、边和状态,解决了单 Loop 应对复杂任务时的局限性。文章详细解析了 Graph 的核心概念、与 Loop 的关系、四个核心模块及具体实践模板,并提供了新手学习路径。
本文介绍了 Anthropic 的 Claude Design 工具如何与 HyperFrames 结合,通过 HTML/CSS 直接将设计转化为视频。文章详细阐述了工作流程、品牌系统集成及实际案例,展示了从设计到渲染的无缝衔接。
作者分享了如何利用 Codex 构建个人 IP 生图工作流的经验。通过借鉴优秀项目,将思路从拼图改为拼提示词,开发了封面图和段落图两个 Skill。文章详细介绍了风格确定、人物特征锚定、内容总结及安全区适配等优化过程,强调了 AI、代码与人在工作流中的职责分工。
本文深入解析Agent工程中常被混淆的三个架构层级:Harness工程构建模型运行环境与基础能力;Loop工程设计工作反馈循环,通过验证与迭代提升质量;Graph工程则显式定义工作流拓扑,控制节点分支与状态转换。文章强调理清环境、反馈与流的关系对构建生产级Agent至关重要。
文章介绍了 Kanvis Article to Video v0.3.0 的更新,该工具通过建立“三模一核”模型,支持真人增强、无脸视觉和数字人三种模式,帮助知识IP和文字创作者高效将文章转化为视频,解决了制作门槛高、流程繁琐等痛点。
文章指出,模型只是可随时替换的引擎,真正的价值在于构建围绕模型的系统。作者介绍了利用 Hermes 工具从简单的问答、一次性任务,进化到生成可共享的产物、封装可复用的技能,最终形成自动化运行的循环系统,以实现 AI 效用的复利增长。
本文介绍了如何利用AI工具制作动画电影并参加电影节的完整流程。作者列举了六个关键工具(Claude、Runway、Midjourney等),详细说明了从剧本创作、角色设计到后期制作的步骤,并分析了该领域的变现潜力和参赛注意事项。
本文详细介绍了腾讯推出的智能体创意工作室Miora,涵盖其核心功能、界面操作及画布编辑等基础使用方法。文章重点解析了独特的“记忆功能”,指导用户如何通过设定和沉淀个人审美与设计规范,让AI越用越懂你,从而实现从随机生图到专业设计的高效转变。
文章阐述了如何利用图结构而非简单的循环来管理 AI 代理团队。核心在于“钻石模式”:任务并行分发、执行、独立验证与汇总。这种模式通过分散推理过程,提升了效率和准确性,并强调了人工检查节点的重要性。
作者通过制作视频的实践发现,分镜管理比剪辑技巧更关键。文章分享了如何利用飞书多维表格进行结构化分镜管理,通过时间轴、画面描述、音频等字段规划,解决了创作混乱、易被打断等问题,提升了效率和复用性。
文章回顾了 2023 至 2026 年 AI 商业模式的演变,指出市场已从卖「会用」、卖「接起来」转向卖「结果」。AI 能力日益廉价,对具体业务结果负责则愈发昂贵。无论是企业服务还是自媒体,真正的机会在于深入具体业务,解决昂贵且可测量的问题,而非单纯贩卖工具或流量。
文章作者分享了从单纯使用 AI 到让 AI 系统持续运行的转变。他通过编码代理管理目标、习惯和日志,利用 Plaud NotePin 记录日常想法,并使用 OBS 录像提高专注度。这种系统化方式不仅保留了工作状态,还显著提升了生活与工作的效率。
文章探讨了超越传统提示词的多模态交互技术,提出“任务”概念,通过结合语音、屏幕、文本等多种信息源,让代理更高效地完成复杂工作。该方法减少交互循环,提升并行工作能力,并通过存储执行痕迹逐步转化为可重用的技能,为未来全模型交互奠定基础。
作者分享了如何构建一个能自动制作爆款视频的AI Agent。该代理通过分析数据寻找热门格式,利用Kimi、Seedance等工具自动完成脚本、剪辑和分发,并根据反馈自我优化。月成本仅111美元,收入达14700美元,实现了全自动化的内容生产闭环。
文章介绍了 HyperFrames 的新功能 Storyboard,通过模仿电影制作中的分镜流程,让 AI 在生成视频前先制定计划、草图和布局,允许用户在低成本阶段进行修改和指导,从而提高视频生成的可控性和效率。
文章回顾了 LangGraph 三年来的发展,探讨了将智能体系统建模为图(Graph)的实践与价值。作者分析了何时使用图结构以平衡确定性与自主性,并指出生产级智能体通常需要循环和动态转换。最后,文章强调图工程并非全新概念,但随着节点的进化,现在的图更多是在编排智能体而非单一的 LLM 调用。
文章详细拆解了如何利用 Agent 团队搭建 Reddit 冷启动获客系统。通过定义社区研究、需求情报、互动、线索运营和复盘五个专业角色,结合 Integrations 连接和 OKR 目标管理,实现从社区筛选到用户转化的自动化闭环,解决产品冷启动阶段的持续获客难题。
文章分享了作者使用LLM代理管理和维护个人知识库(Obsidian Vault)的3个月实践经验。通过分离原始资料与生成内容、定义单一知识流向、统一页面模板以及基于情境的文件夹组织,作者成功将维护工作委托给代理,解决了传统第二脑因维护成本高而失效的问题。
文章详细记录了作者利用 Codex 和 grill-me 从零打造个人 IP 形象的全过程。核心在于通过设计访谈将模糊需求转化为契约,由 Codex 自动执行生图、迭代、归档,并最终沉淀为可复用的 repo-only 配图 skill,构建了一套可持续的内容生产系统。
本文介绍了AI Agent工程从Prompt到Loop再到Graph的演进。Graph Engineering通过图结构重新规划任务关系,实现并行处理、明确依赖、隔离失败,从而解决线性流程在复杂任务中效率低、易失控的问题。
本文介绍了如何利用一张 IP 设定图,在 Codex 中快速生成动态桌宠。文章详细讲解了从角色准备、生成包含多种状态和视角的动画图集,到最终打包安装的全流程,探讨了将 AI 工具个人化、使其成为工作伙伴的意义。
本文介绍了如何使用 Claude 构建图结构的 Agent,替代传统的线性执行模式。文章详细阐述了节点与边的定义、契约设计、并行化执行等核心概念,通过动态工作流实现任务的分发、验证与聚合,从而提升效率与系统的鲁棒性。
文章介绍了科技领域最热门的角色 Forward Deployed Engineer (FDE),其年薪可达15万至100万美元。FDE 负责在企业内部部署 AI,连接业务流程与模型。文章提供了30天行动计划,涵盖流程理解、判断、构建部署及人际应对,强调实战经验的重要性。
文章介绍了如何利用 Codex、AI 图片、AI 配音和 HyperFrames 制作 60-90 秒的中文图书解读短视频。作者以《活着》为例,详细分享了选书、脚本写作、图片生成约束、声音选择、字幕对齐及剪辑转场等全流程,并将经验封装成 Skill,为想做自媒体的人提供了一条不露脸、低门槛的内容创作路径。
本文总结了作者 4 个月使用 Hermes AI 作为分析师的经验,精选了 12 篇文章。内容涵盖从环境搭建、工作流设计到工具配置的全过程,特别是数据分析和投资研究场景的实践,适合新手定制 AI Agent。
文章介绍了 tldraw 作为一个可编程的 React 无限画布 SDK 的强大功能。除了基础的白板功能,它支持将 React 组件转化为画布形状、构建可视化的工作流自动化、集成 AI 视觉交互、实现多人实时协作以及作为持久化应用数据存储。tldraw 适用于构建各种空间软件,从架构图到 AI Agent 管道。
作者分享了使用Linear工具管理编程Agent的实战经验。他将任务按结果层级组织,利用分流箱收集问题,并通过分批处理工作流来提高效率。文章重点强调了制定清晰的Ticket契约(目标、原因、结果)、确保Agent完整完成任务以及实现无监督并行工作,从而打造个人“软件工厂”以提升生活质量。
本文推荐了10个Codex Skill,覆盖自媒体创作全流程:选题、素材、创作、设计、发布及复盘。这套工具链能帮助新手将重复性工作自动化,构建高效的内容生产流水线,但账号成功仍需依赖个人选题判断与持续输出。
文章探讨了在 MacBook Pro 上运行 ComfyUI 进行本地 AI 生图的实战经验。作者详细解析了潜空间扩散、提示词机制及模型工作原理,对比了 SDXL Turbo、FLUX 和 Qwen Image 等模型的优劣。文章提出了一套利用本地模型配合云端 API 的混合工作流,旨在低成本实现高质量出图,并介绍了商品场景图、封面配图等商业变现路径。
本文探讨了在 MacBook Pro 上使用 ComfyUI 进行本地 AI 生图的经验。文章解析了 Stable Diffusion 的原理,指出模型决定上限、提示词指导方向、工作流保障稳定性。作者对比了本地模型(如 FLUX、Qwen Image)与云端 ChatGPT Images 2.0 的差异,并提出了混合工作流策略,最后分享了商品场景图、封面配图等变现路径。
文章介绍了 Hermes Agent Blender MCP 工具,它能将文字描述直接转化为可编辑的 Blender 3D 场景。用户无需深入学习 Blender 的复杂节点和参数,只需描述想法,Agent 即可自动完成建模、材质、灯光和渲染。这种方式大大降低了 3D 创作门槛,特别适合产品模型快速制作。
作者分享了如何利用 Claude 结合 Vidfield MCP、GPT Image 2.0 和 Seedance 2.0,通过简单的对话流程生成完整的动漫短片。文章详细介绍了从角色设计、故事板创建到最终动画生成的完整步骤和具体提示词。
文章指出,AI 交互方式正在从单一的“提示词”转向“循环”。顶级工程师不再手动编写 Prompt,而是设计自动化循环,让智能体自我迭代直至任务完成。以 Slate 工具为例,介绍了如何通过编写 JavaScript“程序”来掌控循环逻辑,实现多模型并行处理和真实世界交互,从而构建更强大的智能系统。