想用 Codex 做科研,可以先从这 9 个 Skills 开始
文章评测了九个用于科研的 Codex Skills,按功能分为引用验证、文献管理、数据分析、英文润色等。作者将它们按质量分级,推荐了如 Academic Research Skills、Claude Scholar、Auto Empirical 等顶级工具,并认为这些由科研人员开发的工具能大幅提升效率。
文章评测了九个用于科研的 Codex Skills,按功能分为引用验证、文献管理、数据分析、英文润色等。作者将它们按质量分级,推荐了如 Academic Research Skills、Claude Scholar、Auto Empirical 等顶级工具,并认为这些由科研人员开发的工具能大幅提升效率。
文章通过实测 7 个不同的设计 Skill 与 Kimi K3 模型的搭配效果,评估其在网页设计、动效和交互方面的表现。测试发现,design-taste-frontend 和 Impeccable 表现最佳,而 Kimi K3 自身的审美能力已相当出色。Skill 的作用更像是更换创意总监,而非简单的加分升级,优秀的 Skill 应为模型提供指引而非限制。
作者分享了三年使用 AI 进行知识管理和代办的经验,并开源了基于 LLM 的「阿福 TODO」Skill。该工具通过自动扫描 Markdown 文件识别待办任务,支持 AI 分组合并素材、日历同步及归档管理,帮助用户高效处理碎片化信息并避免遗漏。
作者发现并体验了开源项目 Tutti,一个被称为 Agent OS 的统一管理工作台。它整合了 Codex、Claude Code 等多个 Agent,支持实时共享上下文、文件和任务。Tutti 提供 BYO Subscriptions 机制,利用现有订阅无需额外付费,并具备 Goal to Tasks 自动拆解和多 Agent 协作功能,极大提升了使用 Agent 进行创作和开发的效率。
本文深度评测了腾讯推出的 Marvis Agent,并对比了 WorkBuddy 和 CodeX。作者指出 Marvis 定位为“AI 电脑管家”,具备手机远程操控电脑(带键盘鼠标)、系统级文件自检与清理、跨 App 资料收集整理、视觉化 PPT 制作以及基于本地素材的小说续写等能力。文章强调了 Marvis 在打通手机与电脑同步干活、深度调用系统设置方面的独特优势。
本文实测了美团发布的基于 5 万张国产算力芯片训练的万亿参数大模型 LongCat-2.0。文章指出,该模型在预训练到大规模部署的全流程中实现了国产算力闭环,具有里程碑意义。虽然通用推理能力与顶级闭源模型仍有差距,但在 Terminal-Bench 和 SWE-bench Pro 等 Agent 与编程任务中表现强劲。作者实测了将其接入 Claude Code 和 Codex 进行工作流处理,结果显示其在长上下文处理和任务拆解上表现稳定,为开发者提供了一个可行的非国产替代方案。
文章介绍了作者对其 AI 新闻聚合 Skill(ai-news-radar)的版本大更新。新版本解决了信息过载问题,通过 Top 推荐、时间轴切换和多维度分类,整合了包括 GitHub、HackerNews 及国内外社媒(如小红书、抖音、X平台)在内的海量信息源。该项目旨在提供去噪后的高质量 AI 资讯,并支持个性化定制与移动端访问。
文章介绍了使用 KroWork 将 AI Skill 工作流打包成本地桌面 App 的新方法。作者指出单纯依赖对话框使用 Skill 存在重复输入和消耗额度的问题,通过 KroWork 可以将常用的 AI 技能组合(如提示词优化、AI 资讯阅读)封装成独立 App,支持定时任务和一键启动,从而实现自动化工具的沉淀与本地化复用。
文章详细记录了将阶跃星辰(Step)等国产大模型 API 接入 Codex App 的全过程与测试结果。作者验证了在 API 模式下,Codex 的手机调用、锁屏截图、浏览器自动化及电脑控制等核心功能依然可用。同时,文章对比了不同模型的性价比,探讨了 API 模式在记忆管理和多设备联动上的局限性,并分享了 Codex 在自动化、长期目标设定及与其他 Agent 工具协作中的最佳实践。
文章介绍了 AI 视频编辑工具 Buzzy,它被称为“视频版 Photoshop”。作者详细测评了 Buzzy 的多种功能,包括精准口播修正、消除剪辑特效、后期重打光、添加运镜、路人消除、无痕换装、视频尺寸转换及风格迁移等。Buzzy 通过 Agent 对话形式操作,能最大程度保持视频一致性,将传统的线性剪辑流程转变为“先整体后局部”的迭代式工作流,极大地提升了视频创作者的效率。
本文详细横评了 GPT 5.5、MiniMax M2.7、DeepSeek V4 Pro 和小米 Mimo-V2.5-Pro 四款大模型在 Hermes Agent 场景下的表现。通过 Skill 打包、网页开发、PPT 制作、知识库整理及浏览器自动化五项任务,测试了各模型的逻辑推理、审美迁移、长文本处理及 API 消耗能力。最终结果显示,不同模型在 Agent 任务中各具特色,需根据具体场景选择最优解。
本文详细介绍了 GPT Image 2 全量发布后的新特性,重点展示了其强大的批量生图能力和多文字信息处理稳定性。作者通过 Lovart 平台实测了 MBTI 图鉴、历史分析图、IP 形象设计、平面海报、UI 界面及游戏原画等 22 个真实场景。配合 TouchEdit、Agent 及 Mockup 样机功能,Image 2 在设计与创意领域的表现被誉为“夯爆”,极大降低了设计与内容生成的门槛。
文章介绍了腾讯推出的 WorkBuddy Claw(“鹅版”OpenClaw),内置大模型并支持飞书、企微、QQ 等接入。作者实测了五种组合玩法:技能安装审查、长视频学习、个人知识库构建、想法验证以及自我迭代复盘,强调了其在降低配置门槛和整合多 Agent 方面的优势,适合 AI 新手。
本文提供了Clawdbot的详细安装与配置教程。鉴于该AI Bot权限较高,作者推荐在Parallels Desktop虚拟机中安装macOS环境以规避风险。文章涵盖了从环境检测、模型选择(推荐MiniMax/Qwen以节省成本)、技能安装,到接入飞书作为聊天入口的全过程,并分享了常用的控制指令及如何注册AI专属社区Moltbook。