新闻详情

新闻详情

首页 / 资讯中心 / 详情

DeepSeek Harness + OpenRouter :接入超多免费大模型,告别 Token 焦虑

发布时间:2026/9/26 16:25:01来源:尧图网络
DeepSeek Harness + OpenRouter :接入超多免费大模型,告别 Token 焦虑
DeepSeek Harness OpenRouter 接入超多免费大模型告别 Token 焦虑一句话速览DeepSeek Harness 是 DeepSeek 开源的 Agent 智能体框架自带 Web UI接入 OpenRouter 后即可一键调用 13 款完全免费的大模型零成本构建你的私人 AI 工作站。目录背景免费模型总览免费使用指南方案一Web UI 配置推荐方案二settings.yaml 配置文件方案三对话式无脑接入最简单局限性总结参考链接背景DeepSeek Harness命令行dsh是由 DeepSeek AI 开发的开源 Agent Harness智能体框架基于一切皆插件的架构理念由 Cordis 插件内核驱动。模型、工具、技能、会话、沙箱、存储、循环、调度乃至 UI——所有 Agent 能力均由插件组合而成可自由替换、灵活重组。项目目前处于开发者预览阶段采用 MIT 协议开源。一条命令即可启动npx deepseek-ai/dsh web该命令默认在http://127.0.0.1:3080启动 Web UI本机启动时还会自动用默认浏览器打开页面。Harness 本身只是模型之外的控制中心负责环境交互、工具契约、上下文流转与沙箱隔离而模型则可以来自任意提供方——这就为接入 OpenRouter 这类聚合网关提供了天然条件。免费模型总览OpenRouter 是一个 LLM 聚合路由平台统一了多家提供方的 API 接入。其中标注:free的模型 prompt 与 completion 定价均为 $0非常适合原型开发、学习实验和跑个人项目。以下为截至2026 年 9 月 23 日查询到的 13 款免费模型按平台使用量排序#模型名称模型 ID提供方上下文参数规模适用场景1Nemotron 3 Ultranvidia/nemotron-3-ultra-550b-a55b:freeNVIDIA1M55B/550B MoE前沿推理、Agent 编排、深度研究2Laguna S 2.1poolside/laguna-s-2.1:freePoolside262K8B/118B MoE智能体编程、软件工程3Ling 3.0 Flash Fininclusionai/ling-3.0-flash-fin:freeinclusionAI262K5.1B/124B MoE金融分析、多步任务规划4DeepSeek V4 Flash 0731deepseek/deepseek-v4-flash-0731:freeDeepSeek1.05M13B/284B MoE编程、推理、Agent 工作流5Nemotron 3.5 Lightningnvidia/nemotron-3.5-lightning:freeNVIDIA1M3B/30B MoE高吞吐、领域定制6Dots3-Note Previewdots-studio/dots-3-note-preview:freeDots Studio512K16B/280B MoE推理、编程、多模态理解7Ling 3.0 Flash VLinclusionai/ling-3.0-flash-vl:freeinclusionAI262K5.5B/124B MoE视觉感知、视觉 Agent8Nex-N2.5-Pronex-agi/nex-n2.5-pro:freeNex AGI262K—智能体编程、GUI 自动化9Inklingthinkingmachines/inkling:freeThinking Machines1.05M41B/975B MoE通用推理、多模态、RAG10Nemotron 3 Supernvidia/nemotron-3-super-120b-a12b:freeNVIDIA262K12B/120B MoE多步规划、长上下文11Ling 3.0 Flash Santeinclusionai/ling-3.0-flash-sante:freeinclusionAI262K5.1B/124B MoE医疗知识推理、临床安全12Inkling Smallthinkingmachines/inkling-small:freeThinking Machines1.05M12B/276B MoE轻量多模态、指令跟随13North Mini Codecohere/north-mini-code:freeCohere256K3B/30B MoE代码生成、终端任务提示不想逐个挑模型时可使用openrouter/free这一特殊路由OpenRouter 会自动为每个请求匹配一个合适的免费模型。免费使用指南DeepSeek Harness 支持三种方式接入 OpenRouter从图形界面到配置文件再到对话式接入总有一款适合你。方案一Web UI 配置推荐适合大多数用户全程图形化操作无需手写配置文件。操作步骤启动 DeepSeek Harness Web UI终端运行npx deepseek-ai/dsh web浏览器自动打开http://127.0.0.1:3080。进入设置页面在 Web UI 中打开设置 模型。添加自定义提供方点击添加提供方选择添加自定义提供方。填写提供方信息Provider IDopenrouter小写一经设定不可更改基础 URLhttps://openrouter.ai/api/v1API 协议openai-completions凭据sk-or-v1-你的Key在 OpenRouter Keys 页面获取添加模型 ID在模型列表中填入模型 ID例如nvidia/nemotron-3-ultra-550b-a55b:free。也可点击获取可用模型让 Harness 自动探测端点提供的模型搜索后勾选。在模型目录中勾选模型保存后在模型选择器中选中刚添加的模型即设为新会话默认值。注意Provider ID 是永久的请求、已保存会话和凭据引用都会使用它。若需重命名请新建提供方再删除旧的。模型变更在下一次请求时生效无需重启服务器。方案二settings.yaml 配置文件适合需要批量管理模型、精细控制请求兼容性的进阶用户。配置文件位于~/.dsh/settings.yaml与模型页写入的是同一份文档可直接编辑适配器会在下次请求时重新读取。配置内容llm-pi-ai:providers:openrouter:apiKeyEnv:OPENROUTER_API_KEYapi:openai-completionsbaseURL:https://openrouter.ai/api/v1models:-id:nvidia/nemotron-3-ultra-550b-a55b:freedisplayName:Nemotron 3 Ultra (Free)设置环境变量exportOPENROUTER_API_KEYsk-or-v1-你的KeyapiKeyEnv只命名凭据引用密钥本身存储在~/.dsh/.credentials.yaml中settings 只保留引用名。将export写入~/.bashrc或~/.zshrc可实现持久化。进阶提示视觉模型如 Ling 3.0 Flash VL、Inkling 系列需补充模态声明否则附图会被拦截input: [text, image]。若推理模型请求被拒可能是网关不接受developer角色需在路由上设compat.supportsDeveloperRole: false及compat.maxTokensField: max_tokens。方案三对话式无脑接入最简单如果你连表单都懒得填DeepSeek Harness 的 Agent 本身就能帮你完成配置。Harness 是一个能读写文件、运行命令的智能体——直接在会话里用自然语言告诉它“帮我接入 OpenRouterAPI Key 是 sk-or-v1-xxxx基础 URL 是 https://openrouter.ai/api/v1协议用 openai-completions把所有免费模型都加上。”Agent 会读取并编辑~/.dsh/settings.yaml、写入凭据、添加模型全程你可能只需点击几次审批确认。完成后即可直接开始对话零配置文件知识门槛。适合完全不熟悉 YAML 语法的用户。局限性免费虽好但需理性看待以下限制速率限制OpenRouter 免费层通常有每日请求次数上限如 200 req/day高并发或长任务可能触发限流不适合生产环境。数据使用条款部分免费模型如 Poolside 系列的提供方可能会使用你的输入输出来训练和改进模型敏感数据不宜通过免费模型处理。可用性不保证免费模型可能因提供方调整、容量不足而临时不可用或下线OpenRouter 不对免费层的稳定性做出承诺。模型能力差异免费模型在推理深度、多模态精度、工具调用兼容性等方面与付费旗舰模型存在差距复杂 Agent 任务可能不如付费模型稳定。上下文与输出限制部分模型上下文窗口较小262K且最大输出 token 数可能受限超长代码库分析或长篇生成需注意截断。配置兼容性坑自定义提供方的模型需手动声明模态input和推理等级reasoningEfforts未声明则按纯文本处理非 OpenAI 网关可能需额外的compat兼容性开关才能正常请求。框架仍在预览期DeepSeek Harness 处于开发者预览阶段未来版本可能出现破坏兼容性的变更生产部署需自行承担风险。总结DeepSeek Harness 的插件化架构让接入第三方网关变得异常简单而 OpenRouter 的 13 款免费模型则提供了零成本起步的全部弹药。两者结合你可以在几分钟内搭起一个覆盖编程、推理、多模态、金融、医疗等全场景的私人 AI 工作站。维度方案一Web UI方案二settings.yaml方案三对话式难度低中极低适合人群大多数用户进阶用户零基础用户是否需写配置否是否Agent 代写批量管理一般强一般精细控制基础字段全部字段依赖 Agent推荐指数★★★★★★★★★★★★一句话行动指南先跑npx deepseek-ai/dsh web再选一种方案填上 OpenRouter Key即刻开聊。参考链接DeepSeek Harness 官方文档https://deepseek-harness.github.io/deepseek-harness/DeepSeek Harness GitHub 仓库https://github.com/deepseek-ai/deepseek-harnessOpenRouter 免费模型列表https://openrouter.ai/modelsOpenRouter 免费模型合集https://openrouter.ai/collections/free-modelsOpenRouter API Key 获取https://openrouter.ai/keysDeepSeek Harness 模型配置指南https://deepseek-harness.github.io/deepseek-harness/guide/providers本文基于 2026 年 9 月 23 日的公开信息整理模型列表与免费策略可能随时间变动请以 OpenRouter 官方页面为准。DeepSeek Harness 处于开发者预览阶段API 与配置格式可能随版本更新调整。本文仅供学习交流不构成任何使用建议。
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

手把手教你本地接入 deepseek-v4-pro 模型:TaoToken 统一 Key 配置与 Cline 实战 2026/9/26 17:08:06

手把手教你本地接入 deepseek-v4-pro 模型:TaoToken 统一 Key 配置与 Cline 实战

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

阅读更多 →
断网环境下用松鼠备份实现异步直播:现场通讯实战指南 2026/9/26 17:08:06

断网环境下用松鼠备份实现异步直播:现场通讯实战指南

1. 工程项目现场的通讯底牌:断网才是平常态到非洲工地的头一个月,我就把“断网环境”这四个字刻进了骨头里。我们项目部靠一台柴油发电机维持营地用电,唯一的 VSAT 卫星链路白天被工程调度、视频回传和数据上报占满,晚上八点之后才…

阅读更多 →
iPhone Duo双屏适配实战:布局策略、多窗口生命周期与状态管理 2026/9/26 17:08:06

iPhone Duo双屏适配实战:布局策略、多窗口生命周期与状态管理

1. 从单屏到双屏:iPhone Duo适配到底在解决什么问题第一次拿到iPhone Duo这类折叠/双屏形态的设备做适配时,很多开发者的第一反应是"不就是屏幕变宽了吗"。我一开始也这么想,结果真机一跑,问题全冒出来了:左…

阅读更多 →
Mac系统数据占用187GB?一文彻底清理磁盘空间实战指南 2026/9/26 17:08:06

Mac系统数据占用187GB?一文彻底清理磁盘空间实战指南

1. 从一次真实的磁盘告警说起 那天下午正编译着项目,Xcode 突然弹出一个磁盘空间不足的提示,我瞄了一眼关于本机,系统数据那一栏赫然写着 187GB。第一反应是 Time Machine 的本地快照堆积了,但清理完快照之后,系统数据…

阅读更多 →
BIN和TXT转换实战:用TaoToken统一Key打通配置文件与二进制互转脚本 2026/9/26 17:07:59

BIN和TXT转换实战:用TaoToken统一Key打通配置文件与二进制互转脚本

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

阅读更多 →
用LangGraph4j在Spring Boot中实现Multi-Agent Supervisor模式 2026/9/26 17:07:59

用LangGraph4j在Spring Boot中实现Multi-Agent Supervisor模式

最近在搞一个 Java 服务里的多智能体协作需求,需要在同一个进程里跑几个职责不同的 Agent,再由一个 Supervisor 统一调度、分配任务。最早我用 Python 版的 LangGraph 搭原型,逻辑很快跑通,但到了交付阶段,团队不想为一…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞 ✉