API 文档
主流 AI API 的文档、SDK、定价与使用指南 — 涵盖 OpenAI、Anthropic、Google Gemini、Mistral 等主流模型厂商。
OpenAI API 完全指南
一份面向 OpenAI API 生态的系统性入门指南,深入覆盖 GPT、DALL·E、Whisper 三大模型系列。从账号注册、密钥管理到首次 API 调用、提示词设计模式和成本优化策略均有详细讲解,适合初次接触 OpenAI 平台的开发者按图索骥。
Anthropic Claude API
Anthropic Claude 系列模型的 API 接口,以出色的推理能力、编程水平和长文档稳定处理而广受好评。核心能力包括扩展上下文窗口、面向 Agent 工作流的工具调用与函数调用、结构化输出以及提示缓存。安全性与可靠性是其核心设计原则,适合需要 AI 行为审慎可信的开发者。
Replicate API
一个云平台,让你通过简单的 API 调用即可运行数千个开源 AI 模型,涵盖图像生成、视频、音频与文本。无需管理显卡或任何基础设施——发送请求后 Replicate 全权处理。采用按用量付费模式,适合想快速原型验证、不想投入硬件成本的开发者。
Anthropic Claude API 文档
Anthropic Claude API 官方文档,提供认证、请求格式和模型能力的全面指南。涵盖 Claude 在推理、编程和长文档分析方面的优势,以及定价详情、速率限制和生产环境最佳实践。适合将 Claude 集成到需要审慎、可靠 AI 行为的应用中的开发者。
Google Gemini API 文档
Google Gemini API 官方文档,在统一的多模态接口中涵盖文本、图像、音频和视频理解。包含认证、函数调用、上下文缓存和代码执行的指南,并提供慷慨的免费额度供实验使用。适合需要在单次请求中处理多种内容类型的应用开发者。
Replicate API 使用指南
一份使用 Replicate API 运行数千个开源 AI 模型(涵盖图像、视频、音频与文本任务)的分步教程。从账号注册、首次预测调用到定价理解和冷启动优化均有详细讲解。适合想尝试多种模型、又不想投入 GPU 基础设施的开发者。
DeepSeek API 使用指南
DeepSeek 以极低成本提供高性能对话与推理模型,API 兼容 OpenAI 格式,迁移几乎零门槛。本指南涵盖接入配置、核心端点用法,以及如何充分发挥 DeepSeek 在编程和数学方面的出色能力。
Mistral AI API
Mistral AI 提供高性能 LLM API,涵盖开源与商用模型,多语言能力出色。API 支持函数调用、JSON 模式和长上下文处理,为构建对话、编程和推理应用的开发者提供灵活且高性价比的选择。
Groq 高速推理 API
Groq 通过自研 LPU 硬件实现超快 LLM 推理,以极低延迟提供热门开源模型的 API 调用。它非常适合聊天机器人和代码助手等对速度有要求的实时应用,按 token 用量计费。
Cohere API
Cohere 提供企业级 API,涵盖文本生成、语义搜索、嵌入和重排序,专为构建高质量搜索与 RAG 管线优化。其模型擅长理解业务语境,平台可与主流向量数据库和编排框架轻松集成。
OpenRouter API
OpenRouter 提供统一 API,通过单一 OpenAI 兼容端点将请求路由到众多厂商的数百个大语言模型。它简化了模型切换,提供透明定价并自动处理故障转移——适合需要灵活性但不想管理多个 API key 的开发者。
Together AI API
Together AI 是一个云平台和 API,可运行、微调和部署开源 AI 模型,提供快速且高性价比的推理。它拥有丰富的社区模型目录、无服务器端点和专属容量选项,让你无需管理 GPU 基础设施即可构建生产级应用。
Perplexity Sonar API
Perplexity Sonar 是一个提供基于全网搜索、附带行内引用的实时可靠答案的 API。它专为构建 AI 搜索体验、聊天机器人和研究工具的开发者设计,提供最新、可验证的信息,而非仅依赖模型的训练数据。
通义千问 Qwen API
Qwen(通义千问)是阿里巴巴的大语言模型 API,在对话、编程和视觉模型上具备出色的中文与多语言能力。许多 Qwen 模型同时发布开放权重,让开发者能以有竞争力的价格在托管 API 便利性与自部署可控性之间自由选择。
文心一言 ERNIE API
ERNIE(文心一言)是百度的大模型 API,中文理解能力尤为突出,支持多模态,并与百度生态深度企业集成。它适合面向中国市场、需要可靠语言处理、知识增强推理和符合本地合规要求的企业。
智谱 GLM API
智谱 AI 的 GLM 系列是具竞争力的中文大模型家族,可通过 API 调用,推理、编程与 Agent 能力突出。GLM 源自清华大学研究成果,同时提供托管 API 和开放权重版本,在中文应用和 Agent 开发中广受欢迎。
xAI Grok API
Grok 是 xAI 的大模型 API,通过与 X 平台集成获得实时知识,具备超大上下文窗口和强推理性能。它为开发者提供了主流厂商之外的选择,在时事感知和个性化对话风格上独具优势。
Kimi(月之暗面)
Kimi 是月之暗面(Moonshot AI)旗下的 AI 助手与 API,以超长上下文处理和强推理性能著称,是中文模型生态的领先选择之一。它擅长处理长文档和复杂分析,API 定价对构建中文应用的开发者颇具竞争力。
Azure OpenAI 服务
Azure OpenAI 服务在微软 Azure 上提供 OpenAI 模型,具备企业级安全、专网接入、区域化部署选项和合规控制。它适合需要在现有 Azure 治理体系、数据驻留要求和微软生态集成中使用 GPT 级能力的组织。
Amazon Bedrock
Amazon Bedrock 是 AWS 托管服务,通过统一 API 提供 Anthropic、Meta、Amazon 等多家厂商的基础模型。它内置 Agent、护栏和知识库能力,可依托 AWS 的安全与监控体系构建生产级 AI 应用,按用量付费。
Google Vertex AI
Vertex AI 是 Google Cloud 的一体化 AI 平台,汇集 Gemini 与伙伴模型、训练微调流水线、Agent 构建工具和 MLOps。它面向希望完全在 Google Cloud 生态内开发、部署和治理 AI 应用的企业。
腾讯混元
混元是腾讯的基础模型家族,覆盖对话、图像、视频和 3D 生成,多个模型开源权重发布,同时通过腾讯云提供 API。其视频与 3D 模型在开源社区尤为瞩目,是面向中国市场多模态应用的多面手选择。
MiniMax
MiniMax 是中国前沿 AI 公司,通过统一 API 提供文本、语音、音乐和视频模型,尤以长上下文语言模型和高质量语音合成著称。它以有竞争力的价格为开发者提供多模态工具箱,在语音 Agent 和创意应用领域颇受欢迎。
讯飞星火
星火(Spark)是科大讯飞基于数十年语音技术积累打造的基础模型,中文语音识别与合成能力行业领先,并具备通用语言能力。它广泛部署于中国的教育、医疗和企业场景,通过讯飞开放平台提供 API。
HyperCLOVA X
HyperCLOVA X 是 Naver 面向韩语优先的基础模型,支撑 CLOVA 系列服务,提供对话、嵌入和韩语优化应用的 API。它以深厚的韩语语言与文化理解训练而成,在韩语任务上优于全球模型——是面向韩国市场服务的自然之选。
AI21 Jamba
Jamba 是 AI21 Labs 的 Mamba-Transformer 混合架构模型家族,将状态空间模型的高效与注意力机制的质量相结合,以更低成本处理超长上下文。它提供开放权重和企业 API,适合合同分析、长文摘要等文档密集型工作负载。