先从协议和现有技术栈开始选择
已经使用 OpenAI SDK 或兼容客户端的项目,通常可先验证 OpenAI 兼容接口;依赖 Claude Messages 或 Gemini GenerateContent 特有字段时,应选择对应原生协议。协议选择会影响请求结构、流式事件、工具调用和错误处理方式。
不要仅凭模型名称决定接入方式。上线前应使用真实业务请求验证输入类型、最大输出、流式响应、工具调用以及超时行为。
- OpenAI Chat Completions 与 Responses
- Claude Messages
- Gemini GenerateContent
- 流式响应与工具调用
按任务而不是按热度选择模型
聊天、代码生成、长文档分析、结构化抽取和低延迟分类对模型的要求不同。建议准备一组真实样本,同时比较回答质量、首字延迟、完整耗时和单次成本。
同一应用也可以按任务分级:高价值复杂请求使用能力更强的模型,简单分类或改写使用更轻量的模型。应用端只保留稳定的业务接口,模型切换由配置管理。
生产环境必须验证的边界
为每个环境创建独立 API Key,限制模型范围、额度和并发。对 429、5xx 和网络超时使用有限次数的指数退避,并保存不含敏感内容的请求标识、状态码和耗时。
模型列表和价格可能变化,最终以 Modb API 模型广场的实时信息为准。不要把未经验证的模型标识、价格或上下文长度写死在业务说明中。
常见问题
关于AI 模型 API 接入与选择的常见问题
已有 OpenAI SDK 应该从哪里开始?
先阅读 OpenAI API 接入指南,替换 Base URL、API Key 和模型名称后完成最小请求。
可以在同一个项目中使用多个模型吗?
可以。建议按任务质量、延迟和成本要求选择模型,并记录各类请求的实际表现。
原生协议和兼容协议有什么区别?
请求字段、流式事件和高级能力可能不同,依赖特有功能时应使用对应原生协议。
在哪里查看当前可用模型?
请以 Modb API 模型广场展示的实时模型标识和价格为准。