
DeepInfra
通过OpenAI兼容和原生API提供文本、Embedding、图像、语音和视觉模型Serverless推理及Dedicated Endpoints的平台。
开源本地AI运行时,通过统一兼容API运行语言、语音、视觉、图片、视频、RAG、Agent和MCP能力。
直接结论:LocalAI适合希望用统一本地API运行文字、语音、视觉、图片、视频和Agent能力的团队;不同后端、模型和硬件组合需要单独验证。
资料说明:本文根据该产品截至2026年8月5日的官方页面、官方文档与官方代码仓库整理,不包含虚构的统一条件实测。功能、版本、API、价格和授权规则可能调整,使用前请再次核验官网。
LocalAI是一套开源本地AI运行时,通过单一服务提供OpenAI、Anthropic、Ollama和部分其他兼容接口,并可按模型选择llama.cpp、vLLM、SGLang、MLX等后端。平台还覆盖语音、视觉、图片、视频、RAG、Agent、MCP和分布式运行。
| 功能 | 说明 |
|---|---|
| 统一兼容API | 以相近接口服务不同模型、引擎和应用客户端。 |
| 多后端运行 | 按模型配置选择llama.cpp、vLLM、SGLang、MLX等引擎。 |
| 多模态能力 | 处理文字、视觉、图片、视频、音乐和3D相关任务。 |
| 实时语音 | 提供转录、说话人区分、TTS和WebRTC语音流程。 |
| Agents与MCP | 构建工具调用、RAG、Skills和MCP应用。 |
| 本地与分布式 | 支持CPU路径、GPU加速和多节点路由。 |
官方提供CPU运行路径,GPU可提高部分模型和任务速度。
不是。它还覆盖语音、视觉、图片、视频、Agent、RAG和MCP等能力。
资料核验日期:2026年8月5日




