浪费20亿Token之后,我做了一个帮自己定义目标的Skill
作者分享了一个名为Leader.skill的开源工具,旨在解决Agent交互中目标定义模糊的问题。该工具基于“目标七问”方法论,将模糊需求转化为清晰的目标任务书,支持多模型组合(如Claude规划、GPT执行),显著提升长程任务的完成率与Token利用率。
作者分享了一个名为Leader.skill的开源工具,旨在解决Agent交互中目标定义模糊的问题。该工具基于“目标七问”方法论,将模糊需求转化为清晰的目标任务书,支持多模型组合(如Claude规划、GPT执行),显著提升长程任务的完成率与Token利用率。
文章详细解读了北京市发布的《关于加快智能体引领发展的若干措施》,涵盖提升基础模型能力、Harness Engineering、原生应用、智能终端融合、OPC新模式及Token经济等10条重磅内容,描绘了未来智能体经济的宏伟蓝图。
腾讯正式推出设计Agent平台Miora,由WorkBuddy团队打造。该平台支持品牌设计、UI设计等五大场景,具备模型切换、技能市场和项目记忆功能。作者实测了品牌VI全案生成,展示了其在设计工作流中的潜力,标志着设计Agent进入白热化竞争阶段。
本文介绍了如何利用国产大模型和Agent编程工具,让不懂代码的人也能从零开始开发并上线一个完整产品。文章详细涵盖了购买模型套餐、准备服务器与域名、ICP备案、使用Agent进行开发、Git版本管理、CI测试流程及运维知识等20个步骤,旨在帮助非技术人员抓住AI时代的创业黄金期。
作者分享了在Claude Fable 5和GPT-5.6时代的AI开发流程,通过优化测试流程和Agent协同,实现高效自动化的开发模式。核心流程包括用Claude出方案、GPT纠错、Codex目标模式执行,极大提升了开发效率和创造力。
作者分享了朋友海辛和阿文使用Seedance制作视频的实用经验。指出网上流行的提示词大多无效,建议从主体、场景、音乐、镜头四部分构建有效提示词。强调不要依赖故事板、避免冗长提示词、不追求过高清晰度,并指出最重要的还是构思分镜和故事。
文章盘点了今年上半年加入Anthropic的9位行业巨佬,包括Andrej Karpathy、诺贝尔奖得主John Jumper等。他们放弃了顶尖职位押注Anthropic,展示了AI成为各学科公共地基的趋势,被视为人类黄金时代的前夜。
本文作者受斯坦福课程《人生设计课》启发,设计了一套Prompt(提示词),利用Claude等AI模型辅助进行人生规划。该Prompt将书中“看清现状”、“找到指南针”、“寻路”、“奥德赛计划”等设计思维转化为四个阶段的AI对话流程。作者通过实测发现,AI的持续追问能有效帮助用户梳理内心潜藏的价值观与焦虑,最终生成包含人生蓝图、原型行动和失败免疫在内的深度分析报告。
文章盘点了瑞幸、麦当劳、飞猪、滴滴等16款国民级应用,这些产品正通过封装Skill、MCP或CLI接口,向Agent开放点咖啡、订票、打车、办公等核心能力。作者指出这标志着Agent化时代的到来,并对比了当前支付环节的“信任”壁垒,认为该趋势类似于2017年小程序爆发的前夜,未来Agent将成为人们在数字世界的另一个“贾维斯”。
文章详细介绍了微信“小微”的内测体验,涵盖了其功能架构、底层模型、交互逻辑及与微信原生能力的打通情况。作者指出,虽然受限于算力成本和安全风控,目前的Agent策略偏向“只读不动”且需频繁确认,但在小程序调度、聊天记录上下文理解及AI生成工具方面表现出色。作者认为这是微信有史以来最大的更新,标志着平台级AI应用的正式落地。
本文是一篇WorkBuddy的从0到1新手教程。文章指出WorkBuddy是国内口碑不错的通用Agent产品,相比Claude Code和Codex更对国内用户友好。内容涵盖安装登录、界面模式介绍(Ask/Plan/Craft)、专家与技能市场、腾讯生态连接及个性化配置,并演示了日常办公报告生成和网页开发两个实战案例。
Anthropic 正式发布了 Claude Fable 5 模型,该模型是此前仅限合作伙伴使用的“神话级”网络安全模型 Mythos 的公开版本,新增了安全分类器。文章详细介绍了 Fable 5 的技术定位、昂贵的 API 定价(显著高于 DeepSeek V4 和 GPT 5.5)、以及在代码生成、视觉游戏通关(如宝可梦、异星工厂)、生命科学(蛋白质设计)等方面展现出的惊人能力。作者在亲测后,对其“究极水桶”般的智能水平表示震撼,同时也因昂贵的费用和 AI 进步速度超越人类认知而产生的虚无感进行了深度思考。
文章记录了一次关于12个顶级AI模型的高考模拟测评。测试选取了Claude、GPT-5.5、DeepSeek等国内外主流模型,针对高考语文和数学试卷进行考核,并邀请真人老师进行盲审阅卷。结果显示,头部模型之间的分差极小,部分模型存在“偏科”现象(如DeepSeek数学强但作文弱)。文章详细回顾了测试的公平性设计、评分过程及最终排名,并回顾了过去几年AI模型在考试能力上的巨大进步。
文章基于Anthropic的最新研究及内部数据,深入探讨了AI系统在软件开发与研究领域的自我进化能力。通过分析SWE-bench、CORE-Bench等基准测试及2021-2026年的生产数据,揭示了AI代码编写量占比超80%、工程师效率提升8倍等趋势。文章讨论了递归自我改进的加速效应及其对人类掌控力、安全防护和职场关系的深远影响。
本文是一份关于OpenAI Codex的详细保姆级教程。作者介绍了Codex的安装、界面设置、模型选择、AGENTS.md配置以及Skills插件系统的使用。通过实战演示,文章手把手教你如何使用Codex从零开发网页和App,展示了其作为顶级Agent产品的强大自动化开发能力和批注修改功能。
作者基于招聘经验提出,在AI时代,技能的重要性被特质取代。最核心的6种特质为:好奇心(持续学习的燃料)、靠谱(稀缺的真实信任)、事实洁癖(批判性思维)、多元化思维(AI欠缺的跨度)、能忍受不确定性(雾中行走的能力)以及低ego高自驱。这些难以被AI替代的底层素质,构成了人才真正的护城河。
文章介绍了一种利用AI生成寓言故事来理解和学习抽象概念的方法。作者基于Anthropic专家Amanda Askell的思路,优化了一套Prompt,通过让AI编写不带术语的“暗语”故事,帮助读者直观掌握陌生化等复杂概念的本质。该方法不仅提升了学习乐趣,还通过隐喻加深记忆,适用于Claude、GPT等多种大模型,被视为一种回归人性的高效学习路径。
文章详细总结了 Google I/O 2026 大会的核心发布。技术层面推出了 Gemini 3.5 Flash 和 Omni Flash 模型,并升级了 Antigravity 2.0 Agent 系统。产品端发布了 Gemini Spark 个人 Agent 和 Android Halo。同时,Google 搜索整合 Agent Coding 并升级 AI Mode,视觉生成领域推出 Pics 和 Stitch。全场强调 AI Agent 的落地应用与生态整合。
本文作者分享了其在AI领域三年的内容创作经验,总结了一套包含“获取信息、找角度、创作”三步走的实战方法论。文章强调内容的本质是“讲故事”而非简单的“信息搬运”,提倡跨领域的信息摄入(美第奇效应),并详细阐述了如何通过“反差”和“陌生化”寻找独特视角,以及如何利用喜剧和电影的节奏理论优化内容结构。文末还分享了公众号运营的四个核心数据指标,强调正向价值观的重要性。
文章基于对大量AI用户的观察,从可控性、广度、形态和角色四个维度出发,构建了一套AI使用能力的10级金字塔模型(Lv.0旁观者至Lv.10一人军团)。作者详细描绘了每个等级用户的行为特征与心智模式,指出从Lv.3的“驯化师”到Lv.4的“越境者”以及从ChatBot到Agent的跨越是关键分水岭,旨在帮助读者定位自身阶段并指明进阶路径。
作者宣布其 AI 热点监控网站 AIHOT 开放 Skill、RSS 和 API 三种接入方式,旨在解决用户在 AI 时代高效获取信息的痛点。重点介绍了 AIHOT Skill,支持 Claude Code、OpenClaw 等 Agent,具备日报、精选、分类查询及关键词搜索四大功能,实现了只需一句话即可掌握行业动态。文章还提供了详细的安装方法和使用场景,并保持对所有用户免费开放。
作者正式开放了其内部开发的AI热点监控网站“AIHOT”,旨在通过精选信源和智能评分策略解决AI时代的信息过载问题。文章详细介绍了产品的信源分级、多维度评分机制(迭代了11版)以及利用代码而非AI主导的架构设计思路。该工具能对海量信息进行降噪、聚类和精选,提供AI日报等功能,以保护用户的注意力。
文章介绍了一款名为“洁癖.Skill”的开源工具,旨在解决Agent长期使用后因上下文和文档混乱导致的“越用越笨”问题。该Skill通过自动审查和迭代项目的文档、记忆及配置文件(如CLAUDE.md),确保知识库的准确性,适用于Claude Code、Codex等多个平台。作者提出“合并优于追加,删除优于保留”的原则,强调在AI协作中保持信息纯净比信息海量更重要,这能让开发者通过“存档”机制实现Agent的持续进化。
文章详细介绍了一款名为CC Switch的GitHub开源工具,该工具拥有51K星标。它允许用户通过桌面应用(支持Win/Mac/Linux)为Claude Code、OpenClaw、Hermes等Agent工具一键切换和管理后端模型。文章分析了手动修改配置文件的痛点,并展示了CC Switch如何通过内置供应商预设、用量追踪、自动故障转移等功能,极大地简化了模型管理和成本控制流程。
文章讲述了二本毕业生陈雨欣利用免费AI工具(如DeepSeek)辅助学习,成功跨专业考上北京大学社会工作硕士的故事。文章不仅详细介绍了她如何将AI作为导师进行概念理解和模拟面试,更强调了她在“人机协作”中保持独立思考、将AI与人工辅导结合的智慧。故事揭示了AI时代的“经济差”,并指出工具并非决定性因素,人的核心能力与选择才是关键。
文章详细评测了 DeepSeek V4 模型。V4 采用混合架构,参数量达 1.6T,虽未集成多模态能力,但在推理和代码领域表现优异。作者指出该版本通过 MXFP4、TileLang 和 MegaMoE 等技术,深度适配华为昇腾等国产芯片,旨在解决算力卡脖子问题。实测中,V4 在写作和长文本处理上表现出色,但在 Agent 意图识别和复杂开发约束遵守方面仍存在瑕疵。
OpenAI 正式上线 GPT-image-2,其在文字渲染、世界知识、修改精准度及审美方面实现了质的飞跃。文章通过大量实测样例展示了其逼近真实的效果,指出 AI 绘图已步入普通人无法分辨真假的年代。作者认为这标志着“画图员”时代的终结,但强调设计的核心在于思考与解决问题,真正的设计师时代才刚刚开始。
本文是一份针对国内用户的 Claude Code 安装与配置保姆级教程。文章详细介绍了在 Mac 和 Windows 系统下,无论是否有网络代理,如何安装 Claude Code 框架。同时,为了解决国内访问 Claude 官方模型的困难,作者提供了使用国产模型(如 GLM-5.1)的接入方案。教程涵盖了从环境配置、工具安装(如 Homebrew、Git)、模型切换工具 CC Switch 的使用,到配置 CLAUDE.md 规范文件的完整流程,旨在帮助新手用户无障碍地使用这一 Agent 框架。
本文深入解析了AI工程领域的三次范式跃迁:从Prompt Engineering到Context Engineering,再到当前的Harness Engineering。文章用生动的游戏比喻和OpenAI的实际案例,阐述了Harness Engineering的本质——通过建立约束系统来驾驭强大的AI Agent。
本文提出了使用 Agent 时最重要的原则——“约束先行”。作者通过个人实践总结出,在使用 Claude Code 等 Agent 时,应建立类似“宪法”的约束体系:包括全局原则、项目级规范和具体设计文档。通过构建从上至下的规则系统,可以避免文件管理混乱,显著提升 Agent 的工作效率和智能水平。这不仅是 Prompt 技巧,更是类似于公司治理和城市规划的系统工程方法论。