Deepgram Self-Hosted Helm Chart 版本演进全解:以 nova-2 的 0.1.0-alpha 到 0.10.0 CHANGELOG 为线索

发布时间:2026/9/15 14:46:13
Deepgram Self-Hosted Helm Chart 版本演进全解:以 nova-2 的 0.1.0-alpha 到 0.10.0 CHANGELOG 为线索 Deepgram Self-Hosted Helm Chart 版本演进全解以 nova-2 的 0.1.0-alpha 到 0.10.0 CHANGELOG 为线索【免费下载链接】FriendAI that sees your screen, listens to your conversations and tells you what to do项目地址: https://gitcode.com/GitHub_Trending/fr/Friend本文以仓库中 backend/charts/deepgram-self-hosted/nova-2/CHANGELOG.md 为骨架结合 nova-2 目录下的Chart.yaml、values.yaml、samples/样例与templates/模板实现梳理 Deepgram 自托管 Helm Chart 从 2024 年 5 月首个 alpha 版本到 2025 年 1 月 0.10.0 稳定版的完整演进路径。读完本文你将理解该 Chart 的组件拓扑API / Engine / License Proxy、scaling静态与自动两种伸缩模型、模型管理字段的迁移links→add/remove、以及 License Proxy 与 Kubernetes Secret 配置等关键操作背后的版本来由。一、CHANGELOG 与 Chart 元信息的对应关系CHANGELOG 声称遵循 Keep a Changelog 恰好以version: 0.10.0、appVersion: release-250130印证了最新一条## [0.10.0] - 2025-01-30条目。两者共同说明Chart 版本与容器镜像 tag是解耦的appVersion: release-250130对应 2025 年 1 月 30 日发布而 CHANGELOG 中 0.9.02024-12-26、0.8.02024-11-21等版本分别绑定各自的月度镜像 tag。Chart 声明kubeVersion: 1.28.0-0即要求 Kubernetes 1.28 及以上这与 0.2.0-beta 引入、后续逐步完善的自动伸缩与节点伸缩能力相配套。Chart.yaml 还声明了三个可选依赖它们与 CHANGELOG 中提到的功能一一对应依赖版本约束对应 CHANGELOG 条目gpu-operator^24.3.00.7.0 EKS accelerated AMIs 自带 NVIDIA 驱动与 toolkitcluster-autoscaler^9.37.00.2.0-beta 支持 cluster-autoscaler 管理节点自动伸缩kube-prometheus-stack^69.3.10.8.1 Prometheus Adapter 默认 ratio 指标修正prometheus-adapter^4.10.00.8.1 同条修正二、版本时间线与关键主题归纳将 CHANGELOG 按时间轴压缩可以得到该 Chart 的两条主发展线2.1 月度镜像发布节奏Added 主线Chart 保持月度更新默认容器 tag的节奏这是 CHANGELOG 中出现频率最高的条目类型0.10.02025-01-30容器 tag 更新至release-250130。0.9.02024-12-26容器 tag 更新至 2024 年 12 月发布。0.8.02024-11-21容器 tag 更新至 2024 年 11 月发布同时修复 Engine Deployment 的 tolerations 未传递给模型下载 Job 的问题。0.7.02024-10-24容器 tag 更新至 2024 年 10 月发布亮点是新的 streaming WebSocket TTS且是纯软件特性、无需新增 TTS 模型同时 AWS 样例切换到自带 NVIDIA 驱动的 EKS accelerated AMI。0.6.02024-09-27容器 tag 更新至 2024 年 9 月发布亮点是 Engine 容器在运行期对模型自动加载/卸载的扩展支持包括nfs/csi这类不支持inotify的文件系统。0.5.02024-08-27容器 tag 更新至 2024 年 8 月发布亮点是预录音频实体检测与改进版 redaction 的 GA。0.4.02024-07-25容器 tag 更新至 2024 年 7 月发布引入英西多语 code-switching 模型、实体检测 Beta、redaction Beta。0.2.2-beta2024-06-27增加音频内容长度的详细日志。2.2 运维与伸缩能力演进Changed/Fixed 主线0.2.0-beta2024-06-20一次扩容新增 cluster-autoscaler 节点伸缩、Pod 自动伸缩、License Proxy 备份支持同时将初始副本数配置从scaling.static.{api,engine}.replicas迁移到scaling.replicas.{api,engine}——当前 values.yaml 中scaling.replicas.api: 1、scaling.replicas.engine: 1正是这一迁移后的形态。0.2.1-beta2024-06-24ConfigMap 变更后自动重启 Deepgram 容器。这对应模板实现中的配置校验和在 engine.deployment.yaml 中Pod template 上带有checksum/config注解ConfigMap 内容变化会触发 Deployment 滚动更新。0.2.32024-07-15新增本地自管 Kubernetes 集群的样例values.yaml修复 PVC 与 SC 前缀命名不一致、自定义 ServiceAccount 名称报错的问题将imagePullSecrets改为可选。0.3.02024-07-18允许为 Deployment 指定自定义 annotations。0.4.02024-07-25为 API 容器引入实体检测 feature flag默认false移除api.features与engine.features下部分嵌套项改为有主见的默认值。0.5.02024-08-27修正03-basic-setup-onprem.yaml中误导性注释——engine.modelManager.volumes.customVolumeClaim.name应指向 PersistentVolumeClaim 而非 PersistentVolume产品命名从 onprem 统一为 self-hostedQuay 镜像仓库名同步更新。0.6.02024-09-27AWS 自动模型管理支持模型删除见engine.modelManager.models.remove自动模型下载从models.links迁移到models.add旧字段仍受支持但推荐迁移新增容器编排器环境变量以改善支持。0.8.12024-12-17修正 Prometheus Adapter Chart values 中默认 ratio 指标从 0.0~1.0 比例尺以匹配自动伸缩文档。三、核心组件与配置API / Engine / License ProxyCHANGELOG 中反复出现的三个组件在模板与 values 中有完整的落地。以 0.10.0 的默认值看3.1 API 容器values.yaml 中api段定义了镜像默认quay.io/deepgram/self-hosted-api:release-250130pullPolicy: IfNotPresent资源请求/限制默认4Gi/2000m→8Gi/4000m样例中常把 limits 内存调大到 12Gi见 dev_omi_values.yaml服务监听0.0.0.0:8080baseUrl: /v1回调与拉取超时callbackConnTimeout: 1s、callbackTimeout: 10s、fetchConnTimeout: 1s、fetchTimeout: 60s均为 humantime 时长可选 DNS resolvernameservers格式为{IP} {PORT} {PROTOCOL}如127.0.0.1 53 udp实体检测/实体 redaction feature flag默认关闭对应 0.4.0 引入的开关driverPool引擎池退避参数timeoutBackoff: 1.2、retrySleep: 2s、retryBackoff: 1.6、maxResponseSize: 10737418241GB。3.2 Engine 容器Engine 是 GPU 密集组件values.yaml 中镜像默认quay.io/deepgram/self-hosted-engine:release-250130资源默认请求30Gi/4000m/1 GPU、限制40Gi/8000m/1 GPU其中gpu字段映射到nvidia.com/gpustartupProbe默认periodSeconds: 10、failureThreshold: 60即最多等待 10 分钟加载模型——CHANGELOG 0.2.1-beta 的自动重启机制需要与探针配合避免加载超时被误杀并发限制engine.concurrencyLimit.activeRequestsnil 默认不设限超出时 API 会尝试其他 Engine pod全部不可用则返回 HTTP 429指标服务0.0.0.0:9991供 Prometheus 抓取驱动自动伸缩。模板中 Engine 以command: [impeller]、args: [-v, serve, /etc/config/engine.toml]启动配置来自 engine.config.yaml 生成的engine.toml其中[license]段根据licenseProxy.enabled与keepUpstreamServerAsBackup决定server_url列表[model_manager]的search_paths在/models基础上拼接customVolumeClaim.modelsDirectory[features]默认启用multichannel与language_detection[chunking]的 batch/streaming 最小最大时长由 values 驱动。3.3 License Proxy 与 0.2.0-beta 的备份语义CHANGELOG 0.2.0-beta 提到即使部署了 License Proxy也保留上游 Deepgram License server 作为备份。当前实现中 values.yaml 的licenseProxy段enabled: false生产强烈建议开启deploySecondReplica: false高可用环境可翻转为 true 部署第二个副本keepUpstreamServerAsBackup: true为安全限制 API/Engine Pod 出网时可设为 false仅让 License Proxy 访问上游许可服务器服务监听0.0.0.0:8443statusPort: 8080资源请求1Gi/1000m、限制8Gi/2000m。engine.toml的[license].server_url列表会同时写入 License Proxy 内部地址与https://license.deepgram.com当保留备份时license-proxy.config.yaml 则为 Proxy 本身生成license-proxy.toml。四、Scaling 演进从静态副本到 Prometheus 指标自动伸缩0.2.0-beta 引入的伸缩能力在 0.8.1 得到修正是理解当前 values.yamlscaling段的关键背景静态模式scaling.replicas.{api,engine}直接作为 Deployment 的replicas见 engine.deployment.yaml。自动模式scaling.auto.enabled: true时api.hpa.yaml 与 engine.hpa.yaml 会创建HorizontalPodAutoscaler。API HPA 使用外部指标engine_to_api_pod_ratiominReplicas/maxReplicas由 Engine 的 min/max 除以engineToApiRatio计算而来Engine HPA 支持requestCapacityRatio需配合concurrencyLimit.activeRequests、STT batch/streaming 的requestsPerPod、TTS batch 的requestsPerPod与自定义指标。指标链路kube-prometheus-stack默认抓取*-metrics服务的metrics端口Engine 的 9991prometheus-adapter通过 external rules如engine_active_requests_stt_streaming、engine_estimated_stream_capacity、engine_requests_active_to_max_ratio将 PromQL 暴露为 HPA 可用的 ExternalMetric。0.8.1 修正的0.0~1.0 比例尺正是指requestCapacityRatio这类 ratio 指标的取值范围语义。项目中 dev_omi_values.yaml 与 prod_omi_values.yaml 已实际启用自动伸缩enabled: true、engineToApiRatio: 1、minReplicas: 1/3、maxReplicas: 10、speechToText.streaming.requestsPerPod: 30并自定义behavior.scaleUp.stabilizationWindowSeconds: 120延后扩容窗口。五、模型管理links→add/remove的迁移0.6.00.6.0 是本 Chart 影响最大的模型管理变更自动模型下载字段从engine.modelManager.models.links迁移到engine.modelManager.models.add旧字段仍受支持但推荐迁移新增engine.modelManager.models.remove用于把 EFS 中已存在的模型移除可用完整链接或模型名指定以减少 Engine 启动时加载的模型数量自动模型管理目前仅支持 AWS EFS 卷。当前 values.yaml 中三者并列links标注为 Deprecatedadd/remove为推荐用法。模型存储支持三种卷后端values.yaml后端开关关键参数自定义 PVCengine.modelManager.volumes.customVolumeClaim.enablednamePVC 名注意 0.5.0 修正的语义、modelsDirectory默认/要求 PV/PVC accessMode 为readWriteMany或readOnlyManyAWS EFSengine.modelManager.volumes.aws.efs.enabledfileSystemId、forceDownload: false仅限 EKSGCP GPDengine.modelManager.volumes.gcp.gpd.enabledstorageClassName: standard-rwo、storageCapacity: 40G、volumeHandle格式projects/{project}/zones/{zone}/disks/{disk}、fsType: ext4仅限 GKEAWS 场景下01-basic-setup-aws.values.yaml 演示了如何开启 EFS 并填写add/remove模型链接本地自管集群则参考 03-basic-setup-onprem.yaml 使用customVolumeClaim。六、部署前置两个 Secret 与 0.2.3 的可选化0.2.3 将imagePullSecrets变为可选配合两个global级 Secret 引用构成安装前的必需准备样例与 dev/prod values 均如此声明# 1. 镜像拉取凭证访问 quay.io 私有镜像仓库 docker login quay.io kubectl create secret docker-registry dg-regcred \ --docker-serverquay.io \ --docker-usernameQUAY_DG_USER \ --docker-passwordQUAY_DG_PASSWORD # 2. Deepgram 自托管 API Key kubectl create secret generic dg-self-hosted-api-key \ --from-literalDEEPGRAM_API_KEYid然后在 values 中通过global.pullSecretRef: dg-regcred与global.deepgramSecretRef: dg-self-hosted-api-key引用。模板中deepgramSecretRef是必填项required校验缺失会报错pullSecretRef则仅在非空时注入imagePullSecrets。0.6.0 还修复了样例中创建 Quay 凭证 Secret 的命令问题此前用--from-file指向用户 Docker 配置文件而 Apple Keychain 等本地密钥管理器会清洗该文件中的敏感信息导致创建出空 Secret。七、在 Friend 项目中的实际运用该 Chart 并非孤立存在Friend 后端已在真实环境中使用它承载自托管语音识别服务。仓库证据包括backend/charts/deepgram-self-hosted/how_to_deploy_deepgram_self_hosted_on_gke.md 提供了 GKE 部署手册GPU 硬件要求、Quay 拉取、镜像推送至私有仓库等dev_omi_values.yaml 与 prod_omi_values.yaml 将镜像指向项目私有 Artifact Registryus-central1-docker.pkg.dev/...并配置了 GCE Ingress、节点亲和k8s.deepgram.com/node-type: api|engine与自动伸缩后端侧backend/config/stt_provider_policy.py 将deepgram_self_hosted定义为独立 STT provider仅服务STREAMING表面并把dg-nova-3列为 streaming 默认模型之一需运行时显式配置自托管端点才可用——与 Chart 部署形态互为印证。结语如何阅读这份 CHANGELOG对运维与二次开发者而言nova-2 CHANGELOG 的价值不在于逐条追读而在于三条判断依据镜像 tag 决定功能月度条目中Updated default container tags意味着容器内软件如 0.7.0 的 streaming WebSocket TTS无需换 Chart 即可获得升级 Chart 只是同步默认值。字段迁移优先响应links→add/remove0.6.0、scaling.static.*→scaling.replicas.*0.2.0-beta、api.concurrencyLimit→engine.concurrencyLimit0.2.0-beta是三类必须跟着改的 breaking 变更。样例与模板是最终解释任何 CHANGELOG 条目都可回到 samples/ 与 templates/ 验证其落地形态0.5.0 的 PVC 注释修正就是文档与模板必须一致的典型例证。【免费下载链接】FriendAI that sees your screen, listens to your conversations and tells you what to do项目地址: https://gitcode.com/GitHub_Trending/fr/Friend创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

关于本文作者

来自尧图内容编辑团队

尧图内容编辑团队 内容团队

尧图内容编辑团队

本文由尧图网络内容编辑团队执笔。团队由资深项目经理、前端工程师与设计师组成,所有内容均来自亲手交付的真实项目,先讲清问题、再给出可落地的解法。尧图深耕北京网站建设十年,服务过京华建材集团、智造科技等各行业客户,把一线经验沉淀为可复用的行业观察。

  • 十年建站经验,覆盖建材、制造、服务、文创等
  • 项目经理把关选题与事实准确性
  • 工程师与设计师联合撰写专业细节
  • 统一编辑规范,保证文风与排版一致
  • 每月复盘转化数据,迭代选题方向

延伸阅读

相关资讯与近期热门内容

深度阅读推荐

建站决策前值得细读的三篇

网站改版的5个关键决策
2024-08-12

网站改版的5个关键决策

什么时候该改版、改到什么程度、如何避免流量掉光,京华建材集团改版复盘给出答案。

获取专属建站方案

看完文章,把您的行业与预算告诉我们,免费获取一份量身定制的官网建设方案与报价。

立即免费咨询