📚 Wiki 知识库

🏷️ AI评测

3 篇

都说 Kimi 审美好,实测 7 个 Skills 来找出它的最佳搭配

文章通过实测 7 个不同的设计 Skill 与 Kimi K3 模型的搭配效果,评估其在网页设计、动效和交互方面的表现。测试发现,design-taste-frontend 和 Impeccable 表现最佳,而 Kimi K3 自身的审美能力已相当出色。Skill 的作用更像是更换创意总监,而非简单的加分升级,优秀的 Skill 应为模型提供指引而非限制。

技术LLM ✍ 卡尔的AI沃茨🕐 2026-07-19

Moxt 实测:把你的组织,折叠进一堆文件夹

本文是对 AI 产品 Moxt 的深度评测。作者指出当前 AI 工作存在“上下文散”和“格式脏”两大痛点,而 Moxt 通过构建基于本地文件系统和 Markdown 格式的工作空间有效解决了这些问题。文章详细介绍了 Moxt 的核心功能:包括基于 AGENTS.md 的个人 AI 分身、支持 Skill 自动化的工作流、以及生成可视化的 HTML 报告。作者认为 Moxt 将 AI 从单纯的对话工具转变为具备记忆和执行能力的“同事”,非常适合处理复杂的组织协作任务。

技术Agent ✍ 歸藏🕐 2026-04-29

当LLM能运行生信流程,你敢信任结果吗?

文章评测了Genentech关于Agent端到端执行生物信息学工作流的预印本。测试涵盖基因组学等领域,Codex CLI和Claude Code表现良好,但存在运行间的不稳定性。作者指出,这虽然证明了Agent在处理依赖和调用工具方面的“操作员”能力,但目前仍缺乏对生物学判断和科学决策可靠性的验证。

技术LLM ✍ Kyle Tretina, Ph.D.🕐 2026-04-19