VoltAgent 接入 Deep Infra:使用 `deepinfra/<model>` 模型路由打通低成本高性能推理

发布时间:2026/9/25 3:31:48
VoltAgent 接入 Deep Infra:使用 `deepinfra/<model>` 模型路由打通低成本高性能推理 人工智能AI AgentAgent 框架后端多智能体RAG工具调用Agent 记忆【免费下载链接】voltagentAI Agent Engineering Platform built on an Open Source TypeScript AI Agent Framework项目地址https://gitcode.com/gh_mirrors/vo/voltagent点击查看免费下载Deep Infra 是 VoltAgent 内置模型注册表Model Provider Registry中直接支持的一家推理服务提供商你只需以deepinfra/model的模型字符串配置 Agent即可通过 VoltAgent 的模型路由器完成鉴权、路由与调用。本文以 deepinfra.md 为骨架结合仓库中注册表生成逻辑与源码适配器实现完整讲解快速接入步骤、环境变量要求、Provider 底层适配原理以及当前注册表快照收录的 9 个模型帮助你直接在项目中落地。Deep Infra 在 VoltAgent 模型体系中的定位VoltAgent 的模型能力围绕Provider Model统一抽象展开每个外部模型服务在providerId前缀下注册调用时以provider/model的字符串形式传入 Agent 的model配置项。Deep Infra 对应的 providerId 为deepinfra注册表实体定义在 model-provider-registry.generated.tsdeepinfra: { id: deepinfra, name: Deep Infra, npm: ai-sdk/deepinfra, env: [DEEPINFRA_API_KEY], doc: https://deepinfra.com/models, },从该实体可以看到三项关键信息npm 包ai-sdk/deepinfra即 VoltAgent 复用的 AI SDK 官方 Provider 实现必需环境变量DEEPINFRA_API_KEY文档字段注册表记录了官方模型文档地址用于生成 Provider 文档页对应 deepinfra.md 中的 Provider docs 小节。值得一提的是website/models-docs/providers/下的所有 Provider 文档均由 generate-model-docs.js 依据注册表与模型类型定义自动生成文件头部标注了AUTO-GENERATED声明因此 deepinfra.md 中的结构快速开始、环境变量、Provider 包、Base URL、模型清单与其他 80 个 Provider 页面完全一致你可以在 overview.md 中横向对比各 Provider 的接入差异。快速开始三条代码接入 Deep Infra在 deepinfra.md 给出的最小示例中创建 Agent 时只需把model指定为deepinfra/modelimport { Agent } from voltagent/core; const agent new Agent({ name: deepinfra-agent, instructions: You are a helpful assistant, model: deepinfra/MiniMaxAI/MiniMax-M2, });要点拆解Agent来自voltagent/coremodel字段接受provider/model形式的模型字符串示例选用注册表快照中的第一个模型MiniMaxAI/MiniMax-M2作为演示实际可替换为下文模型清单中的任意 ID无需手动导入ai-sdk/deepinfra或自行构造 Provider 实例——VoltAgent 会根据前缀deepinfra在运行时自动解析对应的 Provider 适配器并完成构建。环境变量DEEPINFRA_API_KEY与运行时校验使用 Deep Infra 前必须配置 API Key环境变量名为DEEPINFRA_API_KEY对应 model-provider-registry.generated.ts 的env字段export DEEPINFRA_API_KEYyour-deepinfra-api-key从源码结构看Provider 的 API Key 校验逻辑在 model-provider-registry.ts 中实现requireApiKey会从注册表的env字段中筛选包含KEY/TOKEN/SECRET的环境变量名并逐一解析若缺失则抛出明确错误Missing API key for deepinfra. Set DEEPINFRA_API_KEY.也就是说漏配环境变量时 VoltAgent 会直接给出缺哪个变量的可读错误信息而不是在远端 API 返回 401 时才暴露问题这与其他 Provider 的错误提示策略保持一致。Provider 底层ai-sdk/deepinfra与适配器注入deepinfra.md 明确指出其 Provider 包为ai-sdk/deepinfra。在 VoltAgent 的注册表适配层model-provider-registry.ts中ai-sdk/deepinfra被映射到通用的 API Key 型适配器ai-sdk/deepinfra: buildApiKeyProvider(createDeepInfra, deepinfra),buildApiKeyProvider实现见 model-provider-registry.ts L581-L597的工作流程如下调用requireApiKey(config)解析DEEPINFRA_API_KEY从ai-sdk/deepinfra模块导出中寻找createDeepInfra工厂函数并以{ apiKey }调用若工厂函数不可用则回退到模块的deepinfra命名导出或default导出通过resolveProviderExport兜底最终返回可用的ModelProviderEntryLanguageModel 工厂或 ModelProvider 对象。这意味着你完全不需要在业务代码里手动createDeepInfra({ apiKey })——VoltAgent 的注册表会在首次使用deepinfra/model时按需完成 Provider 构建并缓存注册表快照构建结果会 best-effort 写入dist/registries下的缓存文件见 model-provider-registry.ts L500-L508。默认 Base URL 与DEEPINFRA_BASE_URL覆盖deepinfra.md 的 Default base URL 一节标注为Not listed.注册表中未声明api字段但文档同时说明可以通过设置DEEPINFRA_BASE_URL覆盖默认地址export DEEPINFRA_BASE_URLhttps://your-custom-endpoint.example.com适用场景包括公司内部网关、代理出口、或自建兼容 Deep Infra API 的中转服务。需要说明的是当前注册表对ai-sdk/deepinfra使用的是纯 API Key 适配器只传入apiKey因此如果你需要精细控制 Base URL 或自定义请求头更直接的方式是绕过模型字符串、直接向model传入由ai-sdk/deepinfra构造的LanguageModel实例AI SDK 的createDeepInfra({ apiKey, baseURL })支持这类扩展参数。模型清单注册表快照中的 9 个模型deepinfra.md 的模型列表来自 model-provider-types.generated.ts 的deepinfra类型定义当前快照共收录 9 个模型#模型 IDdeepinfra/model模型组织/系列1MiniMaxAI/MiniMax-M2MiniMaxAI2MiniMaxAI/MiniMax-M2.1MiniMaxAI3Qwen/Qwen3-Coder-480B-A35B-InstructQwen通义千问4Qwen/Qwen3-Coder-480B-A35B-Instruct-TurboQwen通义千问5moonshotai/Kimi-K2-Instructmoonshotai月之暗面6moonshotai/Kimi-K2-Thinkingmoonshotai月之暗面7openai/gpt-oss-120bopenai8openai/gpt-oss-20bopenai9zai-org/GLM-4.7zai-org智谱这些模型 ID 保留了 Deep Infra 平台托管的原始命名组织/模型 两级使用时需保持与上表完全一致的大小写。从模型构成可以推断Deep Infra 主要托管开源及开放权重模型的推理服务覆盖编码Qwen3-Coder 系列、推理Kimi-K2-Thinking、gpt-oss、通用对话MiniMax、GLM等场景。值得注意的是模型列表属于注册表快照其生成逻辑见 generate-model-docs.js脚本用正则从model-provider-types.generated.ts中解析每个 Provider 的模型数组再渲染进文档details折叠块。若后续 Deep Infra 新增模型会随注册表快照更新同步反映到文档中。结合模型路由器的进阶用法deepinfra.md 是 Provider 维度文档配合 overview.md 中描述的模型路由器能力可以进一步把 Deep Infra 用出深度类型安全的模型 ID使用ModelRouterModelId类型可以获得 IDE 自动补全与编译期校验import type { ModelRouterModelId } from voltagent/core; const modelId: ModelRouterModelId deepinfra/openai/gpt-oss-120b;按请求动态选模型model支持函数形式可在运行时根据context决定是否走 Deep Infra例如低成本任务走 Deep Infra、关键分析走旗舰模型const agent new Agent({ name: runtime-router, model: ({ context }) { const tier (context.get(tier) as string) || fast; return tier fast ? deepinfra/openai/gpt-oss-20b : deepinfra/MiniMaxAI/MiniMax-M2; }, });多 Agent 分工把吞吐型任务实体抽取、摘要分配给 Deep Infra 等低成本模型把质量敏感任务分配给更强的模型这是官方 overview 推荐的负载拆分模式。按请求传入 Provider 专属选项在generateText的第二个参数中可通过providerOptions透传 AI SDK Provider 的专属参数const response await agent.generateText(Explain how RAG works., { providerOptions: { deepinfra: { /* ai-sdk/deepinfra 支持的选项 */ }, }, });具体可选参数以ai-sdk/deepinfra当前版本导出的类型为准建议结合该包的类型定义确认。相关仓库资源Provider 文档源文件deepinfra.mdProvider 注册表实体env/npm/doc 字段model-provider-registry.generated.tsDeep Infra 模型类型清单model-provider-types.generated.tsProvider 适配器与 API Key 校验实现model-provider-registry.tsProvider 文档自动生成脚本generate-model-docs.js模型路由总览与进阶用法overview.md快速上手指南中的 Provider 对照表providers-models.md按照以上配置你可以直接复制 Quick start 代码、设置DEEPINFRA_API_KEY用deepinfra/model在几分钟内把 Deep Infra 的低成本推理接入 VoltAgent Agent需要路由到其他 Provider 时替换前缀即可无需改动任何调用代码。赞分享人工智能AI AgentAgent 框架后端多智能体RAG工具调用Agent 记忆【免费下载链接】voltagentAI Agent Engineering Platform built on an Open Source TypeScript AI Agent Framework项目地址https://gitcode.com/gh_mirrors/vo/voltagent点击查看免费下载相关推荐VoltAgent 接入 Venice AI通过 OpenAI 兼容适配器使用 venice/model 模型路由VoltAgent 接入 Venice AI通过 OpenAI 兼容适配器使用 venice/model 模型路由 Venice AI 是一个提供多厂商模型人工智能AI AgentAgent 框架后端多智能体RAG工具调用Agent 记忆Agent 工作流AI 评测MCP 服务MCP Clients语音在 VoltAgent 中使用 GitHub Copilot 模型github-copilot/model 模型路由接入指南在 VoltAgent 中使用 GitHub Copilot 模型github copilot/model 模型路由接入指南 本篇基于 VoltAgent人工智能AI AgentAgent 框架后端多智能体RAG工具调用Agent 记忆Agent 工作流AI 评测MCP 服务MCP Clients语音VoltAgent 模型路由实战用 perplexity/model 接入 Perplexity sonar 系列模型VoltAgent 模型路由实战用 perplexity/model 接入 Perplexity sonar 系列模型 本篇指南围绕 VoltAgent 内人工智能AI AgentAgent 框架后端多智能体RAG工具调用Agent 记忆Agent 工作流AI 评测MCP 服务MCP Clients语音上一篇Homebrew数据分析与自动化测试系统构建高效包管理的核心技术架构下一篇Fillinger 智能填充脚本一文掌握让 Illustrator 元素随机排布不再费手创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

关于本文作者

来自尧图内容编辑团队

尧图内容编辑团队 内容团队

尧图内容编辑团队

本文由尧图网络内容编辑团队执笔。团队由资深项目经理、前端工程师与设计师组成,所有内容均来自亲手交付的真实项目,先讲清问题、再给出可落地的解法。尧图深耕北京网站建设十年,服务过京华建材集团、智造科技等各行业客户,把一线经验沉淀为可复用的行业观察。

  • 十年建站经验,覆盖建材、制造、服务、文创等
  • 项目经理把关选题与事实准确性
  • 工程师与设计师联合撰写专业细节
  • 统一编辑规范,保证文风与排版一致
  • 每月复盘转化数据,迭代选题方向

延伸阅读

相关资讯与近期热门内容

深度阅读推荐

建站决策前值得细读的三篇

网站改版的5个关键决策
2024-08-12

网站改版的5个关键决策

什么时候该改版、改到什么程度、如何避免流量掉光,京华建材集团改版复盘给出答案。

获取专属建站方案

看完文章,把您的行业与预算告诉我们,免费获取一份量身定制的官网建设方案与报价。

立即免费咨询