新闻详情

新闻详情

首页 / 资讯中心 / 详情

SnapOtter:终极自托管文件处理神器,一条Docker命令替代5个付费SaaS

发布时间:2026/10/1 14:52:37来源:尧图网络
SnapOtter:终极自托管文件处理神器,一条Docker命令替代5个付费SaaS
SnapOtter:终极自托管文件处理神器,一条Docker命令替代5个付费SaaS【免费下载链接】SnapOtterOpen-source, self-hosted file-processing tool. Convert, compress, OCR, transcribe run local AI across image, video, audio, PDF documents, via UI, REST API pipelines. Your files never leave your network.项目地址: https://gitcode.com/gh_mirrors/st/SnapOtter还在为压缩图片开 TinyPNG、转格式用 CloudConvert、录音转文字找 Otter.ai?这些付费 SaaS 不仅按月收费,文件还必须上传到别人的服务器。今天介绍的SnapOtter是一款开源、自托管的文件处理工具,一条 Docker 命令即可部署,集成 200 个工具,覆盖图片、视频、音频、PDF 和文档五大类,支持 OCR、语音转写和本地 AI 处理——你的文件永远不离开自己的网络。为什么需要 SnapOtter 这样的自托管文件处理工具?市面上每个文件处理场景几乎都有一个对应的付费服务,但它们的共同点是:文件要出网、功能被切割、按量收费。SnapOtter 的思路是把这一切搬进你自己的服务器:付费 SaaS常见用途SnapOtter 对应能力CloudConvert格式转换55 输入格式、17 种输出格式,图片/视频/音频/PDF 全支持SmallpdfPDF 合并、压缩、加密码34 个 PDF 工具,含 OCR、签名、水印、脱敏TinyPNG图片压缩112 个图片工具,压缩/裁剪/转换/去重TinyWow万能转换站23 个文件工具(CSV/JSON/Excel/ZIP)Otter.ai语音转文字本地 AI 转写,还能为视频自动生成字幕SnapOtter 核心能力一览:️200 工具 × 5 大模态:图片 112 个、视频 57 个、音频 27 个、PDF 34 个、文件 23 个本地 AI:去背景、老照片修复上色、人脸模糊、物体擦除、图像放大、OCR 文字提取、语音转写,全部在本地硬件上运行,断网也能用管道(Pipelines):把多个工具串成可复用的工作流,默认支持 20 步,可导入/导出 JSON‍REST API:每个工具都可以通过 API 调用,交互式文档内置在/api/docs自托管:单容器快速启动,或三容器生产栈;支持 AMD64 和 ARM64(Apple Silicon、树莓派均可)21 种界面语言:含中文、日文、阿拉伯文(RTL 支持)一键安装:SnapOtter 最快部署方法安装是整篇文章最简单的部分——真的只有一条命令:docker run -d --name SnapOtter -p 1349:1349 -v SnapOtter-data:/data snapotter/snapotter:latest打开http://localhost:1349,使用admin/admin登录(首次登录会被要求修改密码),安装就完成了。这个单容器镜像已内嵌 Postgres 17 和 Redis 8,无需额外安装任何数据库。生产环境:使用 Docker Compose 搭建 SnapOtter 三容器栈如果你要长期运行或面向团队,建议使用官方的 Compose 生产栈(App Postgres 17 Redis 8),定义见 docker/docker-compose.yml:docker compose -f docker/docker-compose.yml up -d 有 NVIDIA GPU 的用户,可以换用 docker/docker-compose-gpu.yml 获得 CUDA 加速,让去背景、放大、转写等 AI 任务快数倍。生产环境值得留意的几个配置项(均在 Compose 文件中以环境变量形式提供):变量作用DEFAULT_PASSWORD修改默认 admin 密码,对外部署必改MAX_UPLOAD_SIZE_MB上传大小限制MAX_PIPELINE_STEPS管道最大步骤数(默认 20)CONCURRENT_JOBS并发处理任务数OIDC_*接入 Google/GitHub/Okta 等 OIDC 单点登录图片处理与图像编辑器:比在线修图站更灵活图片是 SnapOtter 工具最多的模态。以 Resize(调整大小)为例,支持自定义像素、等比缩放、社交媒体预设、内容感知缩放,还能直接从 URL 导入图片,拖拽即可处理:除了上百个单点工具,SnapOtter 还内置了一个免费的图层式图像编辑器(编辑器前端源码),支持画笔、形状、滤镜、曲线调整、混合模式和快捷键——浏览器打开即用,但所有处理跑在你自己的硬件上:本地 AI 与管道:把重复劳动变成一条工作流这是 SnapOtter 和同类工具最大的差异点:OCR 文字提取:内置 Fast OCR(官方镜像仅增加约 25 MiB),可选装高精度语言包,图片和 PDF 都能提取文字语音转写:录音转文字全本地完成,还能给视频自动生成字幕AI 修图:一键去背景、老照片修复上色、人脸增强、物体擦除、画布扩展管道编排:比如批量 HEIC → JPG → 压缩 → 加水印 → 合并 PDF,串成一条流程后一键执行,支持 JSON 导入导出(实现见 apps/api/src/routes/pipeline.ts)AI 相关的运行时代码位于 packages/ai/src/,模型与运行时的安装脚本在 packages/ai/python/install_feature.py,按需安装、按需加载。用 REST API 接入自己的业务每个工具都有对应的 API 端点,使用 API Key 认证,交互式文档开箱即用。图片引擎的底层实现在 packages/image-engine/src/engine.ts,文档引擎(基于 QPDF、Ghostscript、LibreOffice、Pandoc)在 packages/doc-engine/src/index.ts,音视频处理引擎在 packages/media-engine/src/ffmpeg.ts——想接入自动化流程,可以直接参考这些模块的输入输出契约。总结:一份部署,五个订阅说拜拜SnapOtter 的定位非常清晰:用一条 Docker 命令,在自有硬件上跑起一套覆盖图片、视频、音频、PDF 与文档的完整文件处理基础设施,文件全程不出内网,隐私与成本问题一次解决。它的许可证为 AGPLv3 开源 商业双许可,详见 LICENSING.md。快速回顾:✅ 一条命令部署,内嵌数据库,零依赖✅ 200 工具,55 输入格式,21 种界面语言✅ 本地 AI:OCR、转写、去背景、老照片修复✅ 管道 REST API,轻松嵌入自动化✅ AMD64 / ARM64 通用,GPU 可选加速如果你的团队每天在和文件打交道的同时,还在向五个 SaaS 按月付费——是时候把这套 SnapOtter 自托管文件处理工具 部署到自己的服务器上了。【免费下载链接】SnapOtterOpen-source, self-hosted file-processing tool. Convert, compress, OCR, transcribe run local AI across image, video, audio, PDF documents, via UI, REST API pipelines. Your files never leave your network.项目地址: https://gitcode.com/gh_mirrors/st/SnapOtter创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

Claude Opus 5.5编码代理实战:68万行老项目的成本重构 2026/10/1 15:35:27

Claude Opus 5.5编码代理实战:68万行老项目的成本重构

1. 项目概述:一堆老代码和一个新“队友”如果你也是那种每天都在跟几十万行遗留代码打交道的开发者,看到“Claude Opus 5.5编码代理”这个词,大概率不是来凑热闹的,而是想搞清楚一个问题:这东西到底能不能真的帮我干活…

阅读更多 →
Agent判断器选型与本地部署:Laya和Jev实践指南 2026/10/1 15:35:27

Agent判断器选型与本地部署:Laya和Jev实践指南

做了一年多 Agent 项目,我最大的感受不是“模型不够聪明”,而是“Agent 太听话”。你给它一个任务,它会把所有中间步骤都当成命令执行,该停的时候不停,该问的时候不问,最后产出一堆看似合理但方向全偏的结果…

阅读更多 →
Agent判断器选型指南:Laya与Jev本地部署及Python环境配置 2026/10/1 15:35:27

Agent判断器选型指南:Laya与Jev本地部署及Python环境配置

1. 从“能跑”到“跑得对”:为什么 Agent 需要一个判断器很多人做 Agent 项目,第一步都是把模型接进来,跑通一个“输入问题、返回答案”的闭环,然后就觉得大功告成。但真正上线之后你会发现,问题根本不是“能不能跑”&…

阅读更多 →
PyTorch+PyQt5手写识别闭环系统:训练-部署-GUI实时交互 2026/10/1 15:35:20

PyTorch+PyQt5手写识别闭环系统:训练-部署-GUI实时交互

简介:这是一份面向Python初学者与深度学习入门者的实战项目资源,基于PyTorch实现手写数字识别,并集成可交互的GUI手写板界面,帮助用户直观理解模型推理流程与端到端AI应用开发。资源共5个文件,包含4个核心Python脚本&a…

阅读更多 →
Docker_03_DockerCompose多容器编排 2026/10/1 15:35:20

Docker_03_DockerCompose多容器编排

Docker Compose 多容器编排:从入门到实战 一、什么是 Docker Compose? 1.1 定义 Docker Compose 是一个用于定义和运行多容器 Docker 应用的工具。通过一个 YAML 文件配置应用的服务、网络和卷,然后使用一个命令就可以创建和启动所有服务。 1…

阅读更多 →
LeetCode--丢失的数字 2026/10/1 15:35:14

LeetCode--丢失的数字

题目:给定一个包含 [0, n] 中 n 个数的数组 nums ,找出 [0, n] 这个范围内没有出现在数组中的那个数。本题解法及感悟:这道题的名字很有意思,叫做“丢失的数字”,实际上解法也很简单,其中运用了高斯求和公式…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞 ✉