
vLLM
开源高吞吐模型推理引擎,提供PagedAttention、连续批处理、OpenAI兼容Server、分布式推理、量化和多硬件支持。
通过统一AWS服务访问多家基础模型,并提供Converse API、Knowledge Bases、Guardrails、评估、模型定制和企业安全。
直接结论:Amazon Bedrock适合已经使用AWS数据和安全体系的企业;Bedrock Agents旧产品已进入Classic维护阶段,新Agent应评估AgentCore。
资料说明:本文根据该产品截至2026年8月4日的官方页面与官方文档整理,不包含虚构的统一条件实测。功能、模型、GPU、套餐、地区和品牌命名可能调整,发布前请再次核验官网。
Amazon Bedrock面向希望在AWS上使用多家商业与开放模型的企业开发团队。模型可通过统一API调用,并与IAM、VPC、CloudWatch、Knowledge Bases和Guardrails结合。
| 功能 | 说明 |
|---|---|
| 模型目录 | 访问Amazon、Anthropic、Meta、Mistral、Cohere及其他提供商模型。 |
| Converse与InvokeModel | 以统一接口调用不同文本和多模态模型。 |
| Knowledge Bases | 连接企业资料,提供托管RAG、Agentic Retrieval和引用。 |
| Guardrails | 对输入和输出执行内容、敏感信息、主题和图像策略。 |
| 模型定制 | 对支持模型进行微调、持续预训练或导入自定义模型。 |
| 评估与监控 | 比较模型质量、成本、安全和业务任务表现。 |
| AWS治理 | 使用IAM、KMS、VPC、CloudTrail和区域数据控制。 |
旧Bedrock Agents已进入Classic维护阶段,新客户应使用AgentCore等现行能力。
可将检索结果用于回答并返回指向原始资料的引用。
资料核验日期:2026年8月4日





