新闻详情

新闻详情

首页 / 资讯中心 / 详情

Deepgram Self-Hosted Helm Chart 版本演进全解:以 nova-2 的 0.1.0-alpha 到 0.10.0 CHANGELOG 为线索

发布时间:2026/9/15 14:46:09来源:尧图网络
Deepgram Self-Hosted Helm Chart 版本演进全解:以 nova-2 的 0.1.0-alpha 到 0.10.0 CHANGELOG 为线索
Deepgram Self-Hosted Helm Chart 版本演进全解以 nova-2 的 0.1.0-alpha 到 0.10.0 CHANGELOG 为线索【免费下载链接】FriendAI that sees your screen, listens to your conversations and tells you what to do项目地址: https://gitcode.com/GitHub_Trending/fr/Friend本文以仓库中 backend/charts/deepgram-self-hosted/nova-2/CHANGELOG.md 为骨架结合 nova-2 目录下的Chart.yaml、values.yaml、samples/样例与templates/模板实现梳理 Deepgram 自托管 Helm Chart 从 2024 年 5 月首个 alpha 版本到 2025 年 1 月 0.10.0 稳定版的完整演进路径。读完本文你将理解该 Chart 的组件拓扑API / Engine / License Proxy、scaling静态与自动两种伸缩模型、模型管理字段的迁移links→add/remove、以及 License Proxy 与 Kubernetes Secret 配置等关键操作背后的版本来由。一、CHANGELOG 与 Chart 元信息的对应关系CHANGELOG 声称遵循 Keep a Changelog 恰好以version: 0.10.0、appVersion: release-250130印证了最新一条## [0.10.0] - 2025-01-30条目。两者共同说明Chart 版本与容器镜像 tag是解耦的appVersion: release-250130对应 2025 年 1 月 30 日发布而 CHANGELOG 中 0.9.02024-12-26、0.8.02024-11-21等版本分别绑定各自的月度镜像 tag。Chart 声明kubeVersion: 1.28.0-0即要求 Kubernetes 1.28 及以上这与 0.2.0-beta 引入、后续逐步完善的自动伸缩与节点伸缩能力相配套。Chart.yaml 还声明了三个可选依赖它们与 CHANGELOG 中提到的功能一一对应依赖版本约束对应 CHANGELOG 条目gpu-operator^24.3.00.7.0 EKS accelerated AMIs 自带 NVIDIA 驱动与 toolkitcluster-autoscaler^9.37.00.2.0-beta 支持 cluster-autoscaler 管理节点自动伸缩kube-prometheus-stack^69.3.10.8.1 Prometheus Adapter 默认 ratio 指标修正prometheus-adapter^4.10.00.8.1 同条修正二、版本时间线与关键主题归纳将 CHANGELOG 按时间轴压缩可以得到该 Chart 的两条主发展线2.1 月度镜像发布节奏Added 主线Chart 保持月度更新默认容器 tag的节奏这是 CHANGELOG 中出现频率最高的条目类型0.10.02025-01-30容器 tag 更新至release-250130。0.9.02024-12-26容器 tag 更新至 2024 年 12 月发布。0.8.02024-11-21容器 tag 更新至 2024 年 11 月发布同时修复 Engine Deployment 的 tolerations 未传递给模型下载 Job 的问题。0.7.02024-10-24容器 tag 更新至 2024 年 10 月发布亮点是新的 streaming WebSocket TTS且是纯软件特性、无需新增 TTS 模型同时 AWS 样例切换到自带 NVIDIA 驱动的 EKS accelerated AMI。0.6.02024-09-27容器 tag 更新至 2024 年 9 月发布亮点是 Engine 容器在运行期对模型自动加载/卸载的扩展支持包括nfs/csi这类不支持inotify的文件系统。0.5.02024-08-27容器 tag 更新至 2024 年 8 月发布亮点是预录音频实体检测与改进版 redaction 的 GA。0.4.02024-07-25容器 tag 更新至 2024 年 7 月发布引入英西多语 code-switching 模型、实体检测 Beta、redaction Beta。0.2.2-beta2024-06-27增加音频内容长度的详细日志。2.2 运维与伸缩能力演进Changed/Fixed 主线0.2.0-beta2024-06-20一次扩容新增 cluster-autoscaler 节点伸缩、Pod 自动伸缩、License Proxy 备份支持同时将初始副本数配置从scaling.static.{api,engine}.replicas迁移到scaling.replicas.{api,engine}——当前 values.yaml 中scaling.replicas.api: 1、scaling.replicas.engine: 1正是这一迁移后的形态。0.2.1-beta2024-06-24ConfigMap 变更后自动重启 Deepgram 容器。这对应模板实现中的配置校验和在 engine.deployment.yaml 中Pod template 上带有checksum/config注解ConfigMap 内容变化会触发 Deployment 滚动更新。0.2.32024-07-15新增本地自管 Kubernetes 集群的样例values.yaml修复 PVC 与 SC 前缀命名不一致、自定义 ServiceAccount 名称报错的问题将imagePullSecrets改为可选。0.3.02024-07-18允许为 Deployment 指定自定义 annotations。0.4.02024-07-25为 API 容器引入实体检测 feature flag默认false移除api.features与engine.features下部分嵌套项改为有主见的默认值。0.5.02024-08-27修正03-basic-setup-onprem.yaml中误导性注释——engine.modelManager.volumes.customVolumeClaim.name应指向 PersistentVolumeClaim 而非 PersistentVolume产品命名从 onprem 统一为 self-hostedQuay 镜像仓库名同步更新。0.6.02024-09-27AWS 自动模型管理支持模型删除见engine.modelManager.models.remove自动模型下载从models.links迁移到models.add旧字段仍受支持但推荐迁移新增容器编排器环境变量以改善支持。0.8.12024-12-17修正 Prometheus Adapter Chart values 中默认 ratio 指标从 0.0~1.0 比例尺以匹配自动伸缩文档。三、核心组件与配置API / Engine / License ProxyCHANGELOG 中反复出现的三个组件在模板与 values 中有完整的落地。以 0.10.0 的默认值看3.1 API 容器values.yaml 中api段定义了镜像默认quay.io/deepgram/self-hosted-api:release-250130pullPolicy: IfNotPresent资源请求/限制默认4Gi/2000m→8Gi/4000m样例中常把 limits 内存调大到 12Gi见 dev_omi_values.yaml服务监听0.0.0.0:8080baseUrl: /v1回调与拉取超时callbackConnTimeout: 1s、callbackTimeout: 10s、fetchConnTimeout: 1s、fetchTimeout: 60s均为 humantime 时长可选 DNS resolvernameservers格式为{IP} {PORT} {PROTOCOL}如127.0.0.1 53 udp实体检测/实体 redaction feature flag默认关闭对应 0.4.0 引入的开关driverPool引擎池退避参数timeoutBackoff: 1.2、retrySleep: 2s、retryBackoff: 1.6、maxResponseSize: 10737418241GB。3.2 Engine 容器Engine 是 GPU 密集组件values.yaml 中镜像默认quay.io/deepgram/self-hosted-engine:release-250130资源默认请求30Gi/4000m/1 GPU、限制40Gi/8000m/1 GPU其中gpu字段映射到nvidia.com/gpustartupProbe默认periodSeconds: 10、failureThreshold: 60即最多等待 10 分钟加载模型——CHANGELOG 0.2.1-beta 的自动重启机制需要与探针配合避免加载超时被误杀并发限制engine.concurrencyLimit.activeRequestsnil 默认不设限超出时 API 会尝试其他 Engine pod全部不可用则返回 HTTP 429指标服务0.0.0.0:9991供 Prometheus 抓取驱动自动伸缩。模板中 Engine 以command: [impeller]、args: [-v, serve, /etc/config/engine.toml]启动配置来自 engine.config.yaml 生成的engine.toml其中[license]段根据licenseProxy.enabled与keepUpstreamServerAsBackup决定server_url列表[model_manager]的search_paths在/models基础上拼接customVolumeClaim.modelsDirectory[features]默认启用multichannel与language_detection[chunking]的 batch/streaming 最小最大时长由 values 驱动。3.3 License Proxy 与 0.2.0-beta 的备份语义CHANGELOG 0.2.0-beta 提到即使部署了 License Proxy也保留上游 Deepgram License server 作为备份。当前实现中 values.yaml 的licenseProxy段enabled: false生产强烈建议开启deploySecondReplica: false高可用环境可翻转为 true 部署第二个副本keepUpstreamServerAsBackup: true为安全限制 API/Engine Pod 出网时可设为 false仅让 License Proxy 访问上游许可服务器服务监听0.0.0.0:8443statusPort: 8080资源请求1Gi/1000m、限制8Gi/2000m。engine.toml的[license].server_url列表会同时写入 License Proxy 内部地址与https://license.deepgram.com当保留备份时license-proxy.config.yaml 则为 Proxy 本身生成license-proxy.toml。四、Scaling 演进从静态副本到 Prometheus 指标自动伸缩0.2.0-beta 引入的伸缩能力在 0.8.1 得到修正是理解当前 values.yamlscaling段的关键背景静态模式scaling.replicas.{api,engine}直接作为 Deployment 的replicas见 engine.deployment.yaml。自动模式scaling.auto.enabled: true时api.hpa.yaml 与 engine.hpa.yaml 会创建HorizontalPodAutoscaler。API HPA 使用外部指标engine_to_api_pod_ratiominReplicas/maxReplicas由 Engine 的 min/max 除以engineToApiRatio计算而来Engine HPA 支持requestCapacityRatio需配合concurrencyLimit.activeRequests、STT batch/streaming 的requestsPerPod、TTS batch 的requestsPerPod与自定义指标。指标链路kube-prometheus-stack默认抓取*-metrics服务的metrics端口Engine 的 9991prometheus-adapter通过 external rules如engine_active_requests_stt_streaming、engine_estimated_stream_capacity、engine_requests_active_to_max_ratio将 PromQL 暴露为 HPA 可用的 ExternalMetric。0.8.1 修正的0.0~1.0 比例尺正是指requestCapacityRatio这类 ratio 指标的取值范围语义。项目中 dev_omi_values.yaml 与 prod_omi_values.yaml 已实际启用自动伸缩enabled: true、engineToApiRatio: 1、minReplicas: 1/3、maxReplicas: 10、speechToText.streaming.requestsPerPod: 30并自定义behavior.scaleUp.stabilizationWindowSeconds: 120延后扩容窗口。五、模型管理links→add/remove的迁移0.6.00.6.0 是本 Chart 影响最大的模型管理变更自动模型下载字段从engine.modelManager.models.links迁移到engine.modelManager.models.add旧字段仍受支持但推荐迁移新增engine.modelManager.models.remove用于把 EFS 中已存在的模型移除可用完整链接或模型名指定以减少 Engine 启动时加载的模型数量自动模型管理目前仅支持 AWS EFS 卷。当前 values.yaml 中三者并列links标注为 Deprecatedadd/remove为推荐用法。模型存储支持三种卷后端values.yaml后端开关关键参数自定义 PVCengine.modelManager.volumes.customVolumeClaim.enablednamePVC 名注意 0.5.0 修正的语义、modelsDirectory默认/要求 PV/PVC accessMode 为readWriteMany或readOnlyManyAWS EFSengine.modelManager.volumes.aws.efs.enabledfileSystemId、forceDownload: false仅限 EKSGCP GPDengine.modelManager.volumes.gcp.gpd.enabledstorageClassName: standard-rwo、storageCapacity: 40G、volumeHandle格式projects/{project}/zones/{zone}/disks/{disk}、fsType: ext4仅限 GKEAWS 场景下01-basic-setup-aws.values.yaml 演示了如何开启 EFS 并填写add/remove模型链接本地自管集群则参考 03-basic-setup-onprem.yaml 使用customVolumeClaim。六、部署前置两个 Secret 与 0.2.3 的可选化0.2.3 将imagePullSecrets变为可选配合两个global级 Secret 引用构成安装前的必需准备样例与 dev/prod values 均如此声明# 1. 镜像拉取凭证访问 quay.io 私有镜像仓库 docker login quay.io kubectl create secret docker-registry dg-regcred \ --docker-serverquay.io \ --docker-usernameQUAY_DG_USER \ --docker-passwordQUAY_DG_PASSWORD # 2. Deepgram 自托管 API Key kubectl create secret generic dg-self-hosted-api-key \ --from-literalDEEPGRAM_API_KEYid然后在 values 中通过global.pullSecretRef: dg-regcred与global.deepgramSecretRef: dg-self-hosted-api-key引用。模板中deepgramSecretRef是必填项required校验缺失会报错pullSecretRef则仅在非空时注入imagePullSecrets。0.6.0 还修复了样例中创建 Quay 凭证 Secret 的命令问题此前用--from-file指向用户 Docker 配置文件而 Apple Keychain 等本地密钥管理器会清洗该文件中的敏感信息导致创建出空 Secret。七、在 Friend 项目中的实际运用该 Chart 并非孤立存在Friend 后端已在真实环境中使用它承载自托管语音识别服务。仓库证据包括backend/charts/deepgram-self-hosted/how_to_deploy_deepgram_self_hosted_on_gke.md 提供了 GKE 部署手册GPU 硬件要求、Quay 拉取、镜像推送至私有仓库等dev_omi_values.yaml 与 prod_omi_values.yaml 将镜像指向项目私有 Artifact Registryus-central1-docker.pkg.dev/...并配置了 GCE Ingress、节点亲和k8s.deepgram.com/node-type: api|engine与自动伸缩后端侧backend/config/stt_provider_policy.py 将deepgram_self_hosted定义为独立 STT provider仅服务STREAMING表面并把dg-nova-3列为 streaming 默认模型之一需运行时显式配置自托管端点才可用——与 Chart 部署形态互为印证。结语如何阅读这份 CHANGELOG对运维与二次开发者而言nova-2 CHANGELOG 的价值不在于逐条追读而在于三条判断依据镜像 tag 决定功能月度条目中Updated default container tags意味着容器内软件如 0.7.0 的 streaming WebSocket TTS无需换 Chart 即可获得升级 Chart 只是同步默认值。字段迁移优先响应links→add/remove0.6.0、scaling.static.*→scaling.replicas.*0.2.0-beta、api.concurrencyLimit→engine.concurrencyLimit0.2.0-beta是三类必须跟着改的 breaking 变更。样例与模板是最终解释任何 CHANGELOG 条目都可回到 samples/ 与 templates/ 验证其落地形态0.5.0 的 PVC 注释修正就是文档与模板必须一致的典型例证。【免费下载链接】FriendAI that sees your screen, listens to your conversations and tells you what to do项目地址: https://gitcode.com/GitHub_Trending/fr/Friend创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

分布式事务从2PC到TCC:六种方案对比与选型指南 2026/9/15 15:37:24

分布式事务从2PC到TCC:六种方案对比与选型指南

先聊个真实场景。你在电商系统里下一笔订单,订单服务要写订单表,库存服务要扣库存,积分服务还要加积分。如果这三个服务共用同一个数据库,那好办,一个本地事务、几条SQL全部搞定。但一旦拆成微服务、拆成独立库&#x…

阅读更多 →
MCP Toolbox for Databases 的 postgres-list-stored-procedure 工具:存储过程元数据清单查询实战指南 2026/9/15 15:37:24

MCP Toolbox for Databases 的 postgres-list-stored-procedure 工具:存储过程元数据清单查询实战指南

MCP Toolbox for Databases 的 postgres-list-stored-procedure 工具:存储过程元数据清单查询实战指南 【免费下载链接】mcp-toolbox MCP Toolbox for Databases is an open source MCP server for databases. 项目地址: https://gitcode.com/GitHub_Trending/ge/…

阅读更多 →
SAP HANA 内部过程调用详解,从 CALL 到参数绑定与执行计划 2026/9/15 15:37:24

SAP HANA 内部过程调用详解,从 CALL 到参数绑定与执行计划

在 SAP HANA 的 SQLScript 开发中,有一行代码看起来简单得几乎没有什么可以解释。 CALL addDiscount (:lt_expensive_books, lt_on_sale);可真正理解这行代码之后,会发现它正好触碰到了 SQLScript 存储过程设计里非常重要的一层机制,调用方与被调用方之间究竟如何传递数据,…

阅读更多 →
机试Day2训练全攻略:高频题型与调试实战 2026/9/15 15:37:24

机试Day2训练全攻略:高频题型与调试实战

1. 机试Day2到底该练什么:先想清楚再动手最近在准备机试的同学不少,不管是考研复试的机房上机考试,还是校招笔试里的编程环节,“机试”这两个字总能让人心里一紧。今天这篇是机试训练第二天的复盘记录,主要讲我在这一天…

阅读更多 →
从 CALL 到 Plan Cache 深入理解 SAP HANA Procedure Calls 的执行机制与性能优化 2026/9/15 15:37:24

从 CALL 到 Plan Cache 深入理解 SAP HANA Procedure Calls 的执行机制与性能优化

在 SAP HANA 的项目里,存储过程真正进入运行阶段时,开发人员最终都会碰到同一个动作,CALL。 表面上看,调用一个 Procedure 很简单。数据库里已经存在一个存储过程,我们给它传入参数,HANA 执行过程体,再把标量结果或者表结果返回出来。可一旦系统进入高并发生产环境,CA…

阅读更多 →
FiftyOne 数据集动物园之 RoboLab-EgoX:机器人操作策略回放的 .mcap 多模态数据集实战指南 2026/9/15 15:34:23

FiftyOne 数据集动物园之 RoboLab-EgoX:机器人操作策略回放的 .mcap 多模态数据集实战指南

FiftyOne 数据集动物园之 RoboLab-EgoX:机器人操作策略回放的 .mcap 多模态数据集实战指南 【免费下载链接】fiftyone Refine high-quality datasets and visual AI models 项目地址: https://gitcode.com/GitHub_Trending/fi/fiftyone 导读 本文围绕 Fifty…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞