做了上千个 AI 图像视频之后,我发现 90% 的新手都在犯同一个错误(附完整学习路径总结) ✍ Adam也叫吉米🕐 2026-05-18📦 9.7 KB 🟢 已读 𝕏 文章列表 作者基于自身创作上千个作品的实战经验,总结了新手学习 AIGC 图像与视频时常犯的三大误区:死磕参数、只看教程不动手、盲目追逐新工具。他提出了先跑通全流程、以 Prompt 工程为核心、带着项目学习的三大思路。此外,文章还展示了利用蚂蚁百灵 Ring-2.6-1T 模型规划并生成的一个完整 AIGC 学习路径网站,该路径分为认知启蒙、工具上手、Prompt 工程等六个阶段。 AIGC学习路径Prompt工程图像生成视频生成AI绘画MidjourneyStable Diffusion实战经验方法总结 # 做了上千个 AI 图像视频之后,我发现 90% 的新手都在犯同一个错误(附完整学习路径总结) **作者**: Adam也叫吉米 **日期**: 2026-05-18T10:18:02.000Z **来源**: [https://x.com/Adam38363368936/status/2056318384317620663](https://x.com/Adam38363368936/status/2056318384317620663) ---  这半年我密集做了几百上千个 AI 图像和视频作品,Midjourney、Nano Banana、GPT Image、Grok image、Veo、即梦、可灵……主流工具基本都深度用过一轮。 身边越来越多朋友问同一个问题:我也想学 AIGC,到底从哪开始? 说实话,这个问题比看起来难回答得多。不是因为没有教程,恰恰是教程太多了,零散、碎片、互相矛盾,很多新手一上来就掉进了"看了很多但什么也没学会"的坑里。 从一开始什么都不会,到现在逐步找到思路和感觉,也积累了千万级的浏览量和上万的粉丝,我看见太多朋友走了太多弯路了。  所以这篇文章,我想认真聊聊,新手学 AIGC 图像视频,最常踩的坑是什么,应该用什么思路学,以及具体的学习路径应该怎么走。 ## 一、新手最常犯的三个错误 这是我观察身边学 AIGC 的朋友,以及我自己早期走过的弯路: 误区一:一上来就死磕参数 很多人第一天就开始研究 CFG 值设多少、采样器选哪个、步数调几步。问题是,你连想要生成什么、Prompt 怎么写都还没搞清楚,调参数就是在碰运气。参数是用来精细控制结果的,前提是你已经知道自己想要什么结果。 误区二:只看教程不动手 AIGC 是一个极度依赖实践的领域。看 100 篇 Midjourney 教程,不如自己生成 100 张图。每一次出图都是在建立"输入 → 输出"的直觉,这个直觉没有捷径。 误区三:追工具不追能力 今天学 Midjourney,明天看到 Stable Diffusion 火了又去学 SD,后天 Sora 出来了又跑去试。工具会一直变,但核心能力是通用的:Prompt 思维、构图意识、风格理解、工作流设计。把精力花在能力上,工具切换就是一两天的事。 ## 二、我认为真正有效的三个学习思路 思路一:先跑通全流程,再追求质量 新手最重要的第一步不是做出一张好图,而是完整走通从想法到最终作品的全流程。哪怕结果很粗糙也没关系,关键是你理解了每个环节在做什么。有了全局感之后,再去针对性地提升某个环节,效率会高很多。 思路二:从 Prompt 工程开始建立核心能力 如果只能选一个东西深入学,我会选 Prompt。它是所有 AI 生成工具的底层语言——你和 AI 沟通的质量直接决定输出的质量。语法结构、权重控制、风格描述、负向提示词的逻辑……这些东西学一次,在所有工具上都能用。 思路三:带着项目学,不要漫无目的地"练习" 给自己定一个具体目标:做一组某个风格的头像、做一段 15 秒的短视频、做一套 AI 插画……有目标的学习,效率是漫无目的刷教程的十倍。你会在项目中遇到真实问题,解决这些问题的过程就是最有效的学习。 ## 三、那具体的学习路径是什么? 误区和思路讲完了,下一个问题自然是:具体应该按什么顺序学?每个阶段学什么? 这个问题我一直想好好梳理,但自己整理的时候发现,我知道每个环节怎么做,却很难把它变成一条清晰的学习路线。知道怎么做和知道怎么教,是两件事。 正好最近蚂蚁百灵开源了一个万亿参数的推理模型 Ring-2.6-1T,我之前用过它做一些任务规划类的事情,发现它有个特点:不会急着给答案,会先把问题拆清楚,做完调研再动手。 于是我做了一个实验:让它帮我系统性地规划一份 AIGC 新手学习路径,并且直接做成一个可交互的学习网站。 我的提示词是这样写的: ``` 我想做一个新手入门 AIGC 图像和视频的学习站点,目标是帮新手打牢核心知识点。 第一步:请先不要直接写代码,先帮我: 1)调研这个领域新手有哪些常见痛点和核心需求 2)规划网站的功能板块和信息架构 3)确认页面展示方式 第二步:确认方案后再写代码。 ``` 关键点:我明确要求它先调研再动手。  Ring-2.6-1T 确实没有直接写代码,而是先去搜索了互联网上新手学 AIGC 的常见问题、主流学习资源和社区讨论,然后整理出了一套完整的学习路径框架和网站架构方案。 它梳理出来的学习路径分成 6 个阶段,我看完之后觉得确实和我自己的实践经验高度吻合: Level 0 · 认知启蒙 — 先理解 AIGC 是什么、扩散模型的基本原理、AI 生成和传统创作的区别。消除陌生感,不需要懂数学,但要有整体认知。 Level 1 · 工具上手 — 选 1-2 个主流工具跑通全流程。MJ 适合零基础快速出图,SD 适合想要更多控制力,视频方向先试 Runway 和 Pika。目标是能独立走完从输入到输出。 Level 2 · Prompt 工程 — 这是大部分人真正卡住的地方。核心语法、权重控制、中英文差异、负向提示词逻辑。掌握之后出图质量会有质的飞跃。这也是我自己进步最快的阶段,认真学了两周 Prompt,出图成功率直接翻了几倍。 Level 3 · 原理与参数 — 采样器、步数、CFG、种子值、模型选择,这些参数到底在控制什么。从「碰运气」进化到「有意识地控制结果」。 Level 4 · 进阶技巧 — 局部重绘、风格迁移、角色一致性、图转视频、ComfyUI 工作流。从「能看」到「好看」。 Level 5 · 商业应用 — AI 辅助设计工作流、内容商业化路径、把技能转化为实际生产力。   说实话,这个框架比我之前自己在脑子里零散想的要清楚得多。尤其是把 Prompt 工程单独放在 Level 2(在参数调节之前),这跟我前面说的"先学 Prompt 再学参数"的观点完全一致。并且按照我的要求,对网站核心功能和板块进行了详细设计。   ## 四、从规划到落地:网站是怎么做出来的 最让我意外的是,整个网站从规划到生成代码,我全程没有写过一行代码,甚至没有修改过它的方案,它第一版规划出来的架构,我直接确认就让它执行了。  说实话我本来只是想试试,结果它生成的网站比我见过的很多人工做的 AIGC 教程站点还完整。一个 Prompt 智能生成器、一个工具对比库、6 个阶段的结构化路径……这些功能加起来,如果外包给开发做,至少要几千块。 因为前面的调研和架构规划做得足够充分,代码生成的完成度相当高。最终的网站包含这几部分: ``` 1.结构化学习路径:6 个阶段,每个阶段有对应的教程、工具和实战项目 2.教程中心:MJ 入门、SD 本地部署、Runway 视频生成、Prompt 技巧、ComfyUI 工作流、ControlNet 指南等 3.AI 工具大全:主流图像视频工具的横向对比,含评分、标签和费用标注 4.Prompt 宝典:模板库 + 一个 Prompt 智能生成器,选主体/风格/场景/光照,自动组装 Prompt(这个太实用了) 5.行业资讯:追踪最新工具更新和行业动态 6.新手 FAQ:覆盖"我不会画画能学吗""AI 生成有版权吗""电脑配置不够怎么办"等高频问题 ```  整个过程我最大的感受是,Ring-2.6-1T 做复杂任务的方式和其他模型确实不太一样,它会先把需求拆解成结构化的方案,规划好再执行。这种"plan → execute"的模式,在做有一定复杂度的项目时效果明显比"一句话直接出"好很多。 另外它有 high和xhigh两档推理强度,调研和规划阶段用 xhigh 让它想得更深,后面代码细节的修复用 high 就够了,速度也更快。 写在最后 这篇文章的重点其实不是模型也不是网站,而是分享我对 AIGC 入门这件事的理解,三个误区、三个思路、以及一条可执行的学习路径。 如果你也想入门 AIGC 但不知道从哪开始,收藏起来可能比推荐十个教程更有用 学习网站我后续会继续完善内容。Ring-2.6-1T 已经开源,想试的朋友在这里: https://huggingface.co/inclusionAI/Ring-2.6-1T https://ling.tbox.cn/chat ## 相关链接 - [Adam也叫吉米](https://x.com/Adam38363368936) - [@Adam38363368936](https://x.com/Adam38363368936) - [1.1K](https://x.com/Adam38363368936/status/2056318384317620663/analytics) - [https://huggingface.co/inclusionAI/Ring-2.6-1T](https://huggingface.co/inclusionAI/Ring-2.6-1T) - [https://ling.tbox.cn/chat](https://ling.tbox.cn/chat) - [Upgrade to Premium](https://x.com/i/premium_sign_up) - [6:18 PM · May 18, 2026](https://x.com/Adam38363368936/status/2056318384317620663) - [1,120 Views](https://x.com/Adam38363368936/status/2056318384317620663/analytics) - [View quotes](https://x.com/Adam38363368936/status/2056318384317620663/quotes) --- *导出时间: 2026/5/18 20:26:48*
打 打造睡眠中自动运行的动漫工厂:月入8000美元的AI全链路实践 本文详细拆解了如何利用 Claude、Midjourney、Runway、ElevenLabs、Suno 和 Make 六款工具,构建一个全自动化的AI动漫内容生产流水线。该系统通过自动生成剧本、角色、动画、配音和音乐,并在 YouTube 等平台发布,实现了月入超过 8000 美元的被动收入。 技术 › Agent ✍ fokki🕐 2026-05-19 AI自动化内容变现视频生成AIGC工作流MidjourneyRunwayYouTube被动收入Prompt工程
A AI人像写真总出图不像本人?12个提示词模块实战拆解 文章深入探讨了AI人像写真中常见的“不像本人”及风格固化问题,作者通过实战经验总结出一套包含12个核心模块的摄影企划式提示词结构。该系统涵盖身份锚点拆解、发型变量控制、妆容风格统一、镜头节奏设计及双人互动约束等细节,旨在通过精细化的指令将AI从随机生成转变为按拍摄计划执行,从而产出具有真实摄影感和灵魂的高质量人像写真。 技术 › AI ✍ 麻酱AI实验室🕐 2026-05-08 AI绘画提示词AIGC人像摄影Stable Diffusion摄影技巧Prompt工程
拒 拒绝平庸画质!用提示词逆向工程 Skill 给 Prompt 注入灵魂 文章探讨了在 GPT-image 2.0 时代,提示词工程在生图领域的重要性。作者借鉴了博主@小小东的设计师思维链(语义分析、概念转译、视觉决策、执行规范),开发了一套“提示词逆向工程 Skill”。该工具能通过分析参考图或专家案例,逆向提取出结构化、多维度(含双语)的生图指令,帮助非专业用户通过定义“成功标准”和“防退化原则”,生成具有大师级质感和审美逻辑的图片。 技术 › Agent ✍ 冰河🕐 2026-04-28 Prompt工程提示词逆向工程Claude SkillAI绘画MidjourneyAIGC视觉设计提示词优化多模态模型工作流
从 从0到1制作AI短片/短剧基础SOP 本文详细介绍了从0到1制作AI短片/短剧的完整工作流,涵盖剧本大纲生成、资产物料准备、分镜脚本制作、视频生成及后期剪辑五大环节。作者分享了使用Seedance 2.0等工具保持人物场景一致性、处理打斗画面及节省积分的实操技巧,适合AI视频制作新手入门。 技术 › AI短剧 ✍ 探路AI🕐 2026-07-03 AIGC短剧制作视频生成Seedance工作流Midjourney分镜后期剪辑提示词
宫 宫崎骏风格封面提示词 本文介绍了一套用于生成宫崎骏吉卜力风格封面图的 AI 提示词。该提示词通过将抽象主题实体化为世界元素、构建真实运转的动画场景以及自然融入文字,创造出具有强故事感和传播力的封面作品,非常适合社交媒体使用。 技术 › 工具与效率 ✍ 小树🕐 2026-06-03 提示词AI绘画吉卜力封面设计视觉设计MidjourneyStable Diffusion创意宫崎骏
1 1260位全球绘图艺术家名单大放送 文章分享了一份包含1260位全球绘图艺术家的名单,旨在帮助AI绘画爱好者通过艺术家名字作为Prompt来激活特定的艺术风格。作者指出,在AI逻辑中,艺术家名字即为高压缩指令,使用者可利用这些名字进行组合混搭,以解决画风单一和灵感枯竭的问题。文章仅展示了部分名单,并附带了GitHub仓库链接以供下载完整文件。 技术 › AI绘画 ✍ 神奇小喷菇AIGC🕐 2026-05-17 AI绘画提示词艺术家名单风格迁移资源分享Stable DiffusionMidjourney
P Prompt as Code:提示词小子的九阴真经 文章提出将提示词视为代码而非自然语言的理念,强调结构化、模块化和版本控制的重要性。通过对比散文式与结构化提示词的差异,展示了如何利用组件化思维、单变量调试法和工程化管理来提升AI图像生成的可控性与效率,旨在帮助创作者建立可复用、可迭代的Prompt体系。 技术 › LLM ✍ block0🕐 2026-05-15 Prompt工程AIGC工程化思维方法论图像生成结构化提示词组件化版本控制效率技巧
破 破屏穿越风格 AI 绘画分享 作者分享了一种极具视觉冲击力的“破屏穿越”风格 AI 绘图效果,人物仿佛从社交媒体界面中突破屏幕进入现实世界。文中详细解析了实现该效果的完整提示词,涵盖了人物姿势、社交媒体 UI 拟真、玻璃碎裂特效、电影级光影渲染以及 9:16 构图等技术要点。 技术 › LLM ✍ serein🕐 2026-05-06 AI绘画提示词视觉效果UI设计3D透视Stable DiffusionMidjourney设计灵感
G GPT-Image2 国风穿搭灵感与提示词分享 作者展示了使用 GPT-Image2 将中国国宝文物(如商青铜饕餮、元青花等)转化为现代时尚穿搭灵感的案例,生成了高级感拉满的造型方案。文章详细分享了用于生成此类高完成度“AI服装灵感提案板”的系统化提示词(Prompt),涵盖了灵感提取、视觉转译、三套Look设计(主视觉/上班/约会)及版式布局等全流程指令。 技术 › LLM ✍ Larus Canus🕐 2026-05-06 GPT-Image2AI绘画提示词穿搭设计AIGC国风时尚灵感Stable Diffusion视觉设计
G GPT2: 清冷油墨风与孤独患者情绪壁纸创作指南 文章分享了一种结合清冷油墨质感与孤独情绪的AI壁纸创作风格。灵感源于陈奕迅歌曲与电影《星际穿越》,通过强调“留白”与“克制”的提示词,生成具有艺术呼吸感的高审美图像。文中提供了完整的提示词逻辑,详细阐述了如何通过构图、配色与笔触处理,将普通图片转换为具有艺术家气质的壁纸作品。 技术 › LLM ✍ 小小东🕐 2026-05-04 提示词AI绘画壁纸设计Midjourney艺术审美留白风格化图像生成工具与效率
G GPT-2 案例:可视化提示词解剖模板 文章介绍了一个名为“Visual Prompt Anatomy Template”的模板,旨在通过可视化的方式拆解提示词的结构。文章详细列出了构建高质量提示词的各个功能模块(如角色、任务、上下文、输出格式等),并提供了产品包装设计、落地页文案、研究报告和电影图像生成等四个具体案例的模板应用,帮助用户理解如何编写结构严谨、意图明确的提示词。 技术 › LLM ✍ @pixio_ai🕐 2026-05-03 Prompt EngineeringAIGC提示词模板可视化教程MidjourneyAI绘画设计辅助
G GPT2 抽象头像风潮:多风格 Prompt 指南 文章介绍了一款源自韩国、在全球火爆的抽象头像生成玩法。作者提供了原图及多组详细的提示词(Prompt),展示如何将普通图片转换为抽象线条、简笔画、撕纸拼贴、意面平铺、圆珠笔涂鸦及童趣手绘绘本等多种创意风格。文章持续更新中,旨在帮助用户玩转 AI 图像生成的各种趣味风格。 技术 › LLM ✍ 小小东🕐 2026-05-01 AI绘画Stable Diffusion提示词抽象头像图像生成创意设计趣玩视觉风格