内容提要
该文章介绍了多个AI模型的API配置,包括Kimi、DeepSeek和小米MiMo。Kimi提供K3和K2.7代码模型,支持工具调用、视觉和长上下文;DeepSeek提供V4系列,支持长输入输出;小米MiMo提供V2.5系列,涵盖文本、视觉、语音识别和语音合成等功能。
延伸解读
API兼容性:OpenAI与Anthropic双协议
三家服务商均同时提供OpenAI和Anthropic两种API协议,方便开发者复用现有代码。Kimi和DeepSeek还额外提供OpenAI的chat/completions或responses端点,小米MiMo则仅提供标准OpenAI和Anthropic接口。选择时需注意不同协议在请求格式和功能支持上的细微差异,建议根据现有技术栈和文档示例进行适配。
模型能力差异:视觉与工具调用
Kimi的K3系列和K2.7代码模型均支持视觉和工具调用,DeepSeek的V4 Pro和Flash不支持视觉,仅实验版支持,而小米MiMo的Pro版不支持视觉,标准版支持。工具调用方面,小米的语音相关模型(ASR、TTS等)均不支持。开发者应根据应用场景(如多模态输入或语音交互)选择合适模型。
上下文长度与输出限制
Kimi的K3(1M)和DeepSeek的V4系列均支持高达1M的输入上下文,但输出限制不同:Kimi最大输出32K,DeepSeek可达393K,小米MiMo输出上限为131K。对于需要长输出(如代码生成或长文档)的任务,DeepSeek更具优势;而语音模型输入输出限制较小,适合短文本处理。
Q&A
如何配置Kimi API?
Kimi API支持OpenAI和Anthropic两种兼容格式,baseUrl分别为https://api.kimi.com/coding/v1和https://api.kimi.com/coding/。可用的模型包括K3(1M)、K3(256K)、K2.7 Code和K2.7 Code HighSpeed,均支持工具调用、视觉和流式输出。
DeepSeek API支持哪些接口格式?
DeepSeek API支持OpenAI、OpenAI Chat Completions、OpenAI Responses和Anthropic四种格式,对应的baseUrl分别为https://api.deepseek.com、https://api.deepseek.com/chat/completions、https://api.deepseek.com/responses和https://api.deepseek.com/anthropic。
小米MiMo V2.5系列有哪些模型?
小米MiMo V2.5系列包括MiMo V2.5 Pro(文本)、MiMo V2.5(视觉)、MiMo V2.5 ASR(语音识别)、MiMo V2.5 TTS(语音合成)、MiMo V2.5 TTS VoiceClone(声音克隆)和MiMo V2.5 TTS VoiceDesign(声音设计)。
Kimi K3模型的最大输入和输出token是多少?
Kimi K3(1M)的最大输入token为1,048,576,最大输出token为32,000;Kimi K3(256K)的最大输入token为256,000,最大输出token为32,000。
DeepSeek V4系列模型支持视觉吗?
DeepSeek V4 Pro和V4 Flash不支持视觉,但DeepSeek V4 Flash Vision (Exp)支持视觉。
小米MiMo的ASR和TTS模型支持工具调用吗?
小米MiMo的ASR和TTS模型(包括TTS VoiceClone和TTS VoiceDesign)不支持工具调用,但支持流式输出。