📚 Wiki 知识库

全部文档

13 篇
清除

Kimi K3 技术报告拆解:全球首个开源 3T 级模型

本文拆解了 Kimi K3 的技术报告,这是一个全球首个开源的 2.8 万亿参数模型。文章详细解析了其混合注意力架构、注意力残差机制、MoE 设计以及在长文本训练和推理优化上的创新。报告指出 K3 性能虽略逊于顶级闭源模型,但在多项任务中表现优异,且具有极高的成本效率,甚至已能辅助团队进行内核优化和芯片设计。

技术LLM ✍ Berryxia.AI🕐 2026-07-2920.0 KB

不用花钱仅需10分钟在笔记本搭好本地OCR工作流(实测PP-OCRv6)

文章实测了百度开源的PP-OCRv6(Tiny、Small、Medium三档)本地部署方案。作者演示了如何用10分钟在笔记本上搭建OCR工作流,并对比了这三档模型与Apple Vision、Qwen3-VL等在手写、名片、轮胎压印等场景下的表现。结论指出,专用轻量模型在“逐字还原”的抄写员场景下远超大模型(VLM),且具备离线、隐私保护的优势。

技术工具与效率 ✍ Berryxia.AI🕐 2026-06-1715.9 KB

用 Claude 开发 3D 实时语音游戏的实战复盘

作者记录了利用 Claude AI 辅助,花费两周时间和 800 美金开发“大唐长安” 3D 实时语音互动游戏的全过程。文章详细拆解了从 Three.js 场景搭建、游戏化交互设计、NPC 系统构建,到核心的 Agora 实时语音接入与 Agent 调试的实战经验,为普通开发者和创作者提供了一套可复用的 AI 辅助开发 Web3D 游戏的教程。

技术LLM ✍ Berryxia.AI🕐 2026-06-0120.9 KB

Adam's Law:为何高频表达能解锁 LLM 的最强性能

文章介绍了 FaceMind 团队提出的 Adam's Law(文本频率定律),即在语义不变前提下,使用预训练语料中频率更高的表达方式能显著提升 LLM 表现。该发现通过 100 种语言和四大核心任务得到验证,并指出当前数据工程忽视了“频率”这一关键维度。Anthropic 的 Claude Opus 4.7 更新间接验证了这一理论。

技术LLM ✍ Berryxia.AI🕐 2026-05-3018.7 KB

从「帮我做」到「做完记住」:Agent 记忆升级实录

本文记录了作者将 MemOS 2.0 本地插件集成到 Bloome Agent 的实战过程。通过引入「执行即学习」的记忆操作系统,解决了传统 Agent 仅依赖上下文窗口导致记忆丢失和经验无法积累的痛点。文章详细解析了 MemOS 的四层认知资产架构、云端沙箱的部署踩坑解决方案(如 ngrok 内网穿透)、历史记忆的迁移方法,以及跨 Agent 记忆共享的配置,展示了 AI 助手如何从被动工具进化为具备主动记忆能力的智能体。

技术Agent ✍ Berryxia.AI🕐 2026-05-2817.1 KB

企业 AI 的真相:从列表记忆到图谱记忆

文章通过资深员工离职导致“组织记忆”流失的案例,剖析了当前企业 AI 协作工具的痛点。作者指出,主流的列表式记忆和密集注意力机制难以承载企业的核心决策上下文,而 Tanka 采用的图谱式记忆和稀疏注意力机制,通过构建实体关系网络,实现了真正的“组织记忆”沉淀。文章从技术架构、成本模型及适用场景三个维度,论证了为何这一路径是解决企业知识管理的未来方向。

技术Agent ✍ Berryxia.AI🕐 2026-05-1510.6 KB

AI时代最大的笑话:我居然还在用邮箱疯狂搞钱!别卷Prompt了,会发邮件就能让AI帮你干活!

作者分享了如何利用“龙虾(Claude)+ ClawEmail + XCrawl”的组合,将 AI 接入实际工作流。通过赋予 AI 邮箱身份和网页抓取能力,实现了教育行业招投标信息的自动化监控与飞书自动更新。文章强调,传统的电子邮件正成为调用 AI Agent 最稳定、最低门槛的接口。

技术Agent ✍ Berryxia.AI🕐 2026-05-0720.5 KB

AI开发工具新突破:Unsloth与Google Code Wiki

文章介绍了两项针对开发者的重磅AI工具更新。首先是Unsloth发布了指南,允许使用Gemma 4和Qwen3.6等开源模型,在24GB显存的本地机器上运行Claude Code的Agentic Coding工作流,实现了隐私、成本与交互体验的兼顾。其次是Google推出了Code Wiki,利用Gemini自动扫描GitHub仓库生成实时更新的智能Wiki,支持架构图生成和代码溯源,旨在解决软件开发中“读代码”的昂贵瓶颈。

技术DevOps ✍ Berryxia.AI🕐 2026-05-063.0 KB

别特么再给国内同事安利 Claude 了

作者通过帮同事使用 AI 工具自动处理 Excel 数据的经历,反思了技术传播的本质。虽然 Claude 等海外模型强大,但在国内网络环境下难以落地。相比之下,国内可用的 AI 编程工具(如 Trae Solo)虽然门槛不同,却更能真正解决普通人的实际问题。文章强调工具应降低门槛、给人选择权,而非制造认知负担。

技术工具与效率 ✍ Berryxia.AI🕐 2026-04-2110.0 KB

Creao:开源电商产品视觉设计系统完整提示词

文章详细介绍了名为 Creao 的开源电商产品视觉设计系统。该系统通过定义品牌策略、视觉设计、产品摄影、文案策划等六大核心角色,利用 AI 协同工作流,为不同类别的产品自动生成包含主海报、卖点卡片、场景应用及规格说明在内的完整电商视觉设计包,旨在提升设计效率与标准化水平。

技术Agent ✍ Berryxia.AI🕐 2026-04-1823.9 KB

为什么程序员钟爱Codex,Vibe Coding的人却离不开Claude?一文弄懂它!

文章深入探讨了 AI 辅助编程领域中 Codex 与 Claude 的差异化定位。Codex 采用 MoE 架构,以模块化和高精准度成为传统程序员修复 Bug 和重构代码的利器;而 Claude 基于 Dense 架构,凭借全脑激活的细腻逻辑和对自然语言的深度理解,成为“Vibe Coding”用户进行创意原型开发的首选。文章最后建议在实际工作流中混合使用,取长补短。

技术LLM ✍ Berryxia.AI🕐 2026-03-318.8 KB

按头学习| 让 AI 真正做好复杂任务,需要一套什么样的系统?

本文基于 Anthropic 工程师的实战指南,探讨了如何通过多智能体系统(Multi-Agent System)解决单一 AI 模型在处理长时复杂任务时的上下文退化和自我评估偏差问题。文章通过对比单智能体($9/20分钟)与三智能体系统($200/6小时)在游戏开发中的表现,引入了类似 GAN 的“生成-评估”协作机制。详细介绍了包含规划者、实现者和评估者的全栈开发架构,并提出了系统设计应随任务复杂度和模型能力演化的核心原则。

技术Harness Engineering ✍ Berryxia.AI🕐 2026-03-2511.5 KB