教程指南
从入门到进阶的 AI 学习教程,带你系统掌握大模型开发。
精选教程
大语言模型入门:LLM 是如何工作的
用通俗的方式讲清楚大语言模型(LLM)的工作原理:token、下一个词预测、上下文窗口与幻觉。
提示词工程实战:写出高质量的 AI 提示词
掌握提示词工程的核心技巧:清晰指令、上下文与示例、分步思考、角色设定,以及常见误区。
用 OpenAI API 构建你的第一个 AI 应用
从获取 API Key 到发送第一个对话请求、处理流式输出与错误,带你跑通 OpenAI API 的完整流程。
用 RAG 打造基于知识库的问答系统
理解检索增强生成(RAG)的完整流程:文档切分、Embedding、向量检索与上下文拼接,让大模型基于你的知识库回答。
大模型微调入门:LoRA 与 QLoRA
搞清楚什么时候需要微调,以及高效微调方法 LoRA、QLoRA 的核心思想与实践建议。
本地部署开源大模型:Ollama 实战
用 Ollama 在本地一键运行开源大模型,涵盖安装、运行、API 调用与模型选择。
2026 年构建 AI Agent:从聊天机器人到自主系统
Agentic AI(自主智能体)是 2026 年的标志性趋势。学习 AI Agent 如何规划、调用工具并自主行动——Agent 循环、函数调用、MCP、框架与安全护栏。
2026 最佳 AI 编程 Agent:Claude Code vs Cursor vs Copilot vs Codex
对 2026 年顶级 AI 编程工具的实用对比——GitHub Copilot、Cursor、Claude Code、OpenAI Codex:它们如何工作、各自优势以及如何选择。
MCP 协议入门:AI 工具集成的通用标准
了解 Model Context Protocol(MCP)是什么、为什么在 2026 年重要,以及如何通过这个开放标准将 AI 模型连接到外部工具与数据源。
Vibe Coding 实战:通过描述需求来构建应用
Vibe Coding 实战指南——2026 年的新工作流:用自然语言描述应用,让 AI 编程 Agent 来构建、迭代和调试。
多模态 AI 实战:使用视觉、音频与视频模型构建应用
学习如何将视觉、音频与视频 AI 模型组合到真实应用中——从图像理解、语音合成到视频生成。
AI 工作流自动化:连接模型、工具与数据流水线
使用低代码平台(Dify、n8n、Flowise)和编排框架(LangChain、LangGraph、CrewAI)构建自动化 AI 工作流的实战指南。
更多学习资源
OpenAI API 完全指南
一份面向 OpenAI API 生态的系统性入门指南,深入覆盖 GPT、DALL·E、Whisper 三大模型系列。从账号注册、密钥管理到首次 API 调用、提示词设计模式和成本优化策略均有详细讲解,适合初次接触 OpenAI 平台的开发者按图索骥。
LangChain 框架教程
一份深入 LangChain 框架的实战教程,系统讲解其架构与核心模块——Chains、Agents、Memory,并配合大量代码示例。还涵盖 RAG 集成、自定义工具开发和调试策略,适合已不满足于简单提示词、希望构建生产级 LLM 应用的开发者。
Prompt Engineering 指南
一份广受认可的社区驱动型提示词工程学习资源,系统讲授从零样本、少样本提示到链式思维推理等进阶技巧。内容包含多语言示例、不依赖特定模型的设计原则以及可直接落地的实战建议,帮助各层次从业者结构化地提升 AI 输出质量。
Whisper 语音识别教程
OpenAI 的开源语音识别模型 Whisper,在大规模多样化多语言数据集上训练而成。它支持约 99 种语言的语音转录,并能将任意语言直接翻译为英语,且完全可在本地运行,无需外部服务。适合需要高精度、注重隐私的语音转文字、字幕生成或语音搜索索引场景。
大模型微调实战
一份面向大语言模型微调的实战指南,涵盖 LoRA、QLoRA 等参数高效方法以及传统全量微调。从数据集准备、超参数调优到评估指标均有详细代码示例,适合希望将基础模型适配到特定领域、又不想承担从零训练成本的 ML 工程师。
OpenAI Whisper 语音识别指南
OpenAI Whisper 官方文档——在多样化多语言音频上训练的开源语音识别模型。涵盖安装、模型规格选择和转录 API 使用,支持约 99 种语言及直接翻译为英语。适合需要高精度、可本地运行的语音转文字方案(字幕生成、会议纪要或语音搜索索引)的开发者。
Midjourney 完全指南
一份面向 Midjourney V6 的全面指南,从提示词结构到 stylize、chaos、quality 等参数使用,完整讲解图像生成工作流。涵盖图像混合、风格引用和 remix 功能等进阶技巧,并配有大量实战示例。适合希望利用最新模型能力获得稳定、高质量成果的中级创作者。
Python AI/ML 库大全
一份精选的 Python AI/机器学习常用库汇总,涵盖深度学习框架 TensorFlow 和 PyTorch、经典机器学习库 Scikit-learn、数据处理工具 NumPy 与 Pandas,以及新兴的 LLM 集成工具。每个条目包含简介、典型使用场景和安装命令,是从业者构建 ML 工具箱的实用参考。
Stable Diffusion 入门教程
一份面向初学者的 Stable Diffusion 开源文生图模型指南。从环境搭建、模型选择到核心生成工作流逐一讲解,并解释采样步数、CFG 值和种子控制等关键概念。配有实用技巧和常见问题排查建议,适合对 AI 图像生成感兴趣但不知从何入手的新手。
Replicate API 使用指南
一份使用 Replicate API 运行数千个开源 AI 模型(涵盖图像、视频、音频与文本任务)的分步教程。从账号注册、首次预测调用到定价理解和冷启动优化均有详细讲解。适合想尝试多种模型、又不想投入 GPU 基础设施的开发者。
Hugging Face Transformers 教程
Hugging Face Transformers 官方教程——NLP 与计算机视觉领域的行业标准库。涵盖文本分类、分词、翻译、图像分割等任务,提供 PyTorch 和 TensorFlow 双后端代码示例。适合希望利用预训练模型或在自定义数据集上微调以投入生产使用的从业者。
LlamaIndex 框架教程
LlamaIndex 实战教程——专为构建 RAG 应用而设计的框架,将 LLM 连接到自定义数据源。涵盖数据摄入管线、索引策略、查询引擎和基于 Agent 的检索,并提供 PDF、网页和数据库连接器的实战示例。适合希望构建基于自有文档的领域专属 AI 助手的开发者。
Flux 图像生成模型指南
FLUX 是一系列开源图像生成模型,以出色的提示词遵循度和高视觉质量著称。本指南介绍各 FLUX 变体的区别、提升出图效果的提示词技巧,以及如何在本地消费级显卡或托管 API 服务上运行。
DeepSeek API 使用指南
DeepSeek 以极低成本提供高性能对话与推理模型,API 兼容 OpenAI 格式,迁移几乎零门槛。本指南涵盖接入配置、核心端点用法,以及如何充分发挥 DeepSeek 在编程和数学方面的出色能力。
ComfyUI 工作流指南
ComfyUI 采用基于节点的可视化工作流系统,让你精确控制图像生成的每一步。本指南从零开始搭建工作流、使用可复用可分享的节点图,以及局部重绘和放大等进阶技巧,帮你产出专业级作品。
Suno AI 音乐创作指南
Suno 是一个 AI 音乐生成平台,可通过文本提示生成含人声与乐器的完整歌曲。本指南涵盖风格、情绪和歌曲结构的提示技巧、自定义歌词的用法,以及提升人声质量和混音效果的实用建议。
Cursor IDE 使用指南
Cursor 是一款 AI 原生代码编辑器,基于 VS Code 分支,具备深度代码库感知、Composer 多文件编辑、上下文对话和智能补全等能力。本指南涵盖安装配置、核心工作流和技巧,帮你充分利用 Cursor 流畅的 AI 编辑体验。
Runway 视频生成指南
Runway 是领先的 AI 视频生成平台,提供文生视频和图生视频工作流,并支持运动与镜头控制。本指南介绍创建高质量片段、优化运动效果的实用技巧,以及如何将 AI 生成的短片段拼接为更长的精修序列。
Learn Prompting 教程
Learn Prompting 是一门免费开源课程,系统教授提示词工程——从基础技巧到思维链、少样本学习等进阶策略。内容涵盖文本、图像和代码生成提示,是希望从 AI 模型获得更好结果的综合学习资源。
fast.ai 实用深度学习课程
fast.ai 提供免费的实战深度学习课程,采用自上而下的教学方式——先构建可运行模型,再深入理论。内容涵盖计算机视觉、NLP 和表格数据,配套实操笔记本让开发者从第一天起就能训练真实模型。
OpenAI Cookbook
OpenAI Cookbook 是官方示例代码与实用指南集合,专注于 OpenAI API 的实际开发。内容涵盖嵌入、RAG、函数调用到微调等真实场景模式,提供可直接运行的笔记本,开发者可将其直接改造用于生产应用。
Google 机器学习速成课程
Google 机器学习速成课程是免费的实战入门课程,包含视频课程、交互式可视化和基于真实数据集的编程练习。内容从线性回归讲到神经网络,覆盖核心概念,是 ML 新手开发者的理想起点。