跟 Opus 4.8 打的有来有回?!Kimi K3 首测
本文评测了全新上线的 Kimi K3 模型。作者选取了 3D 玻璃折射、WebGL Shader、视差滚动及家具网页动效四个高难度前端场景,与 Claude Opus 4.8 进行对比。结果显示,K3 在多模态理解和自检修正上表现优异,能以 Sonnet 级价格提供接近 Opus 的性能,整体表现惊艳。
本文评测了全新上线的 Kimi K3 模型。作者选取了 3D 玻璃折射、WebGL Shader、视差滚动及家具网页动效四个高难度前端场景,与 Claude Opus 4.8 进行对比。结果显示,K3 在多模态理解和自检修正上表现优异,能以 Sonnet 级价格提供接近 Opus 的性能,整体表现惊艳。
作者开源了一款名为“歸藏材质插画”的 Skill,旨在解决文章、汇报及教学中概念解释难的问题。该工具通过调用 GPT-Image 2.0,能将文本转化为风格统一、带中文标签的 3D 材质解释图。文章详细介绍了其在处理冷门概念检索、图表数据重绘以及防止 AI 乱写标签等方面的技术优化。
文章介绍了 Claude 官方提出的 Loop Engineer 概念,该概念将现有的 Agent 工作流程进行了系统化梳理。文中详细讲解了四种 Loop 类型:回合制循环、基于目标的循环(GOAL 模式)、基于时间的循环以及主动循环。此外,作者还分享了关于代码库质量维护和 Token 消耗管理的优化建议,并提及了 Codex、Skills 和 Hooks 等相关工具。
文章介绍了作者开发的 guizang-social-card-skill 的重大更新,新增了 Live Photo 动态卡片生成与编辑功能。该功能支持将产品录屏、网页 Demo、游戏片段及生活素材转化为适配小红书或公众号的动态卡片。文章详细阐述了单视频、拼图、三连等多种模式,并分享了关于首帧检查、时长适配及 AI 素材判断等实现细节与最佳实践。
本文通过作者制作多个爆款 Skill(如 PPT、社交媒体卡片、Logo 生成等)的实战经验,深入探讨了 Skill 在 AI 时代的本质与价值。作者指出,Skill 不仅是提示词,更是封装专家经验、工作流和审美判断的“能力商品”,能有效弥合 Agent 使用中的认知差距。文章详细阐述了 Skill 的设计哲学(中心短、辐射厚)、像代码一样的维护流程,以及如何通过“把品味变成约束”来保证高质量输出。
本文介绍了一款名为 guizang-social-card-skill 的开源工具,旨在解决图文创作者的配图难题。该工具通过区分不同内容品类(如旅行、职场、影评等)自动匹配杂志风或网格风版式,集成免费商用图库并智能避让图片主体。作者强调将其视为“产品”而非简单的 Prompt,通过严格的规则和设计系统,生成具有高级感的图文卡片,避免流水线式的“AI 感”。
作者分享了一个开源项目 AI Desk Card,这是一块连接到 AI Agent(如 Claude Code)的墨水屏。它通过 AI 动态管理日程、待办、GitHub 动态及天气,替代静态的便利贴。文章探讨了 AI 主动决策显示内容的交互模式,以及硬件与 Agent 结合的新设计思路,旨在实现“低头干活,抬头看一眼”的无缝信息流。
作者歸藏介绍了其开源项目 guizang-ppt-skill 的重大更新。本次更新新增了基于瑞士国际主义设计的“瑞士风”视觉风格,并接入了 Codex 的 GPT-Image 2.0 功能,实现了自动生成符合调性的配图(如胶片质感人像、流程图)。此外,Skill 现已支持一键生成小红书、公众号等多平台封面,进一步打通了从大纲到 PPT 生成再到跨平台发布的全流程。
作者利用 Codex 在一下午时间内,仅通过自然语言交互,完成了一款名为《夜巡录:荒庙篇》的志怪题材 Roguelike 卡牌游戏。文章详细记录了 AI 如何自动生成绿幕素材、编写爬虫获取资源、通过图片拼贴解决视觉检索瓶颈,以及整合 GPT-Image 和 Seedance 2.0 完成音视频素材的全过程。作者认为这种从“配工具”到“定目标”的交互模式转变,已接近 AGI 雏形。
本文是对 AI 产品 Moxt 的深度评测。作者指出当前 AI 工作存在“上下文散”和“格式脏”两大痛点,而 Moxt 通过构建基于本地文件系统和 Markdown 格式的工作空间有效解决了这些问题。文章详细介绍了 Moxt 的核心功能:包括基于 AGENTS.md 的个人 AI 分身、支持 Skill 自动化的工作流、以及生成可视化的 HTML 报告。作者认为 Moxt 将 AI 从单纯的对话工具转变为具备记忆和执行能力的“同事”,非常适合处理复杂的组织协作任务。
作者开源了一款名为 guizang-ppt-skill 的 PPT 生成工具,该工具将其 10 年的设计经验封装为 AI Skill。产品采用“电子杂志 × 电子墨水”的设计风格,提供 10 种页面布局、5 套主题色及完整的交互逻辑,旨在通过人机协作接口,利用 AI 规范化生成高质量的演示文稿。
作者受 Anthropic 官方项目启发,基于 M5Paper 墨水屏开发了一款名为 M5 Paper Buddy 的物理设备。该设备通过蓝牙连接电脑,能够监控多个 Claude Code 会话状态(上下文、项目分支等),并支持通过物理按键进行远程审批(如 Bash 命令、文件修改),解决了多窗口切换不便的问题。文章探讨了“手机小组件物理化”的交互趋势,认为低门槛的模块化硬件结合 AI 辅助开发,让个人开发者能比大公司更快验证 AI 与物理世界交互的新形态。
本文详细测评并解析了 Seedance 2.0 视频生成模型的强大功能。作者通过 13 个跨行业实战案例,展示了该模型在餐饮广告、品牌营销、健身教学、UI 设计、服装电商、房产展示、自媒体 Vlog 及影视特效等领域的应用。Seedance 2.0 具备“导演思维”和全模态参考能力,能理解世界知识、编排分镜并保持人物动作一致性,被视为视频领域的 ChatGPT 时刻。文章还附带了具体的提示词策略与工作流指导,旨在帮助从业者提高内容制作效率并实现商业变现。
本文介绍了作者开发的一个名为 Logo Generator 的 Skill,旨在解决开发者和开源项目缺乏专业 Logo 的痛点。该 Skill 利用 Gemini 强大的 SVG 生成能力,通过信息收集、生成设计变体、制作高级展示图三步流程,快速生成“够用的好 Logo”。文章详细阐述了其工作原理、12种静态背景与6种动态 WebGL 背景的展示方案,以及 SVG 相比图片生成在精度和可编辑性上的优势。
本文介绍了开源 Agent 客户端 Codepilot 的保姆级入门攻略。文章详细讲解了软件在 Mac、Windows、Linux 平台的安装过程,以及如何配置国产模型(如智谱)、Anthropic 三方 API、Claude Code、OpenAI 和 Ollama 本地模型等服务商。此外,还涵盖了项目制聊天、Skills 与 MCP 插件安装、CLI 工具管理等特色功能的使用方法。
作者在 Claude 发布生成式 UI 后,利用 Code Pilot 复刻并优化了该功能。文章详细介绍了如何通过代码围栏、sandbox iframe、流式渲染等技术,实现 AI 在聊天中实时绘制交互式图表、架构图和小工具。内容涵盖了多种实用玩法及解决流式体验、视觉闪烁等技术细节的实现方案。
本文介绍了如何利用 Claude Code 的 Skills 功能创建一个 PPT 生成助手。作者以“Nano Banana PPT”为例,详细演示了从环境准备、资料梳理、需求规划到利用 Plan 模式自动构建 Skills 的全过程。此外,文章还涵盖了如何使用 Git 进行版本控制以及编写 README 的技巧,强调了将复杂流程拆解为独立工具的重要性。
文章介绍了如何利用 Youware 最新上线的 Coview 和 YouBase 能力,通过 Vibe Coding 构建全平台可分发的应用。作者以开发的 AI 日记软件 Vibe Diary 为例,详细讲解了从数据库构建、API 密钥管理、UI 快速修改到 PWA 打包、域名绑定及 Stripe 支付集成等全流程,展示了 AI Coding 时代降低开发成本与构建产品壁垒的完整路径。
文章介绍了 Coze 2.0 的重大更新,重点在于降低了 AI Skills 的开发与变现门槛。通过 Coze 编程平台,用户无需复杂的 CLI 配置,仅用自然语言即可快速创建、调试并部署技能。文章详细演示了如何利用 Vibe Coding 构建 PPT 生成技能,并上架至技能商店实现付费订阅。此外,还介绍了辅助执行的“长期计划”功能及新年实体福利活动。
本文介绍了如何利用 Claude Code 的 Skills 功能,从零开始构建一个用于生成 PPT 的定制化 Agent。文章详细讲解了通过提示词自动安装技能、准备 Markdown 上下文资料、使用 Plan 模式进行规划开发,以及利用 Git 进行版本管理和迭代的全过程。