新闻详情

新闻详情

首页 / 资讯中心 / 详情

如何不联网在手机上跑本地大模型:Google AI Edge Gallery 部署指南

发布时间:2026/9/26 7:51:32来源:尧图网络
如何不联网在手机上跑本地大模型:Google AI Edge Gallery 部署指南
如何不联网在手机上跑本地大模型Google AI Edge Gallery 部署指南【免费下载链接】galleryA gallery that showcases on-device ML/GenAI use cases and allows people to try and use models locally.项目地址: https://gitcode.com/GitHub_Trending/gallery44/galleryGoogle AI Edge Gallery 是一个把开源大模型直接跑在手机上端的侧应用多轮对话、图像问答、语音转写都在设备内完成。模型加载完成后可断网使用推理过程不出设备。 它先替你干这几件事图像问答你拍一张照片或从相册选一张它返回物体是什么、场景里在做什么。语音转写你录 2 分钟语音它输出实时文字还能给出翻译。设备控制你说把亮度调到 50%它调用手机的对应设置项直接执行全程不联网。⚡ 断网可用的前提条件检查系统Android 12 及以上工程 minSdk 为 31或 iOS 17 及以上。安装应用Android 从 Google Play 安装没有 Play 就从最新 release 页拿 APK 直接装iOS 从 App Store 安装另有 macOS 版本。下载模型在应用的模型管理里从列表挑一个从 Hugging Face 拉取当前版本官方支持 Gemma 4 系列。断网验证下载完成后开飞行模式再发一句话能正常出字即可长期使用。想改代码再克隆仓库git clone https://gitcode.com/GitHub_Trending/gallery44/gallery用 Android Studio 打开构建。各能力怎么用对话输入话题开始多轮交流在支持的模型Gemma 4 系列起上可打开 Thinking Mode看到模型逐步的推理过程。图像拍照或从相册选图作为输入模型返回物体识别、视觉谜题答案或详细描述。音频录音作为输入实时转写成文字支持翻译输出适合会议记录和素材整理。设备控制Mobile Actions 由 FunctionGemma 270m 的微调版本驱动——注意此处驱动指运行时调用模型听懂你的指令后调用手机设置或系统动作返回执行结果。 加载自己的 .litertlm 模型应用支持加载自定义 .litertlm 模型并随时切换。模型以 LiteRT 格式打包在模型管理面板导入模型文件也可以粘贴 Hugging Face 的模型地址导入导入后可与列表中的模型互相切换、删除并跑基准测试对比表现。加载与删除逻辑集中在 ModelManagerViewModel.kt要自己加一个 AI 任务模块看 customtasks/ 目录。 读懂推理性能指标应用内置基准测试每轮跑出三个数字TTFTtime to first token从发送到第一个字出现所用的秒数越短首响越快输入越长这个值越吃亏。解码速度decode speedtokens/sec首字之后的持续生成速度越高后续输出越快。prefill 速度处理输入部分的速度同为 tokens/sec是长上下文档位的主要瓶颈。判断好坏别看单次数值同一台设备跑同一个模型做对比并记录当时用的是 CPU 还是 GPU 加速。适用边界这套方案适合要验证设备端大模型、或网络不可用场景的部署如果你要的是顶级云端模型的对话能力端侧模型目前够不到。MCP 外部工具接入与 Thinking Mode 仍是实验性功能后者只在受支持的模型上生效应用本身处于实验性 Beta 阶段硬件下限与具体模型的兼容性以官方发布为准。【免费下载链接】galleryA gallery that showcases on-device ML/GenAI use cases and allows people to try and use models locally.项目地址: https://gitcode.com/GitHub_Trending/gallery44/gallery创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

Atlas 300V 24G推理卡如何高效部署YOLO:从模型转换到性能调优 2026/9/26 8:39:42

Atlas 300V 24G推理卡如何高效部署YOLO:从模型转换到性能调优

最近群里好几个朋友在问同一件事:手里拿到一张Atlas 300V 24G,到底算不算“运算加速卡”,拿来跑YOLO检测模型能不能用、怎么跑。这个问题其实很有意思,因为它背后暴露的是不少人对昇腾推理卡和GPU训练卡的认知差异。我用这张卡实跑…

阅读更多 →
VMware虚拟机磁盘清理:零填充与vdiskmanager压缩实战 2026/9/26 8:39:17

VMware虚拟机磁盘清理:零填充与vdiskmanager压缩实战

1. 虚拟机磁盘清理的核心逻辑与方案选型1.1 为什么虚拟机磁盘会越用越大用过 VMware Workstation 的人基本都遇到过这个场景:虚拟机里明明删了几十 GB 的文件,宿主机上的 vmdk 文件却一点没变小,甚至还在持续膨胀。这不是软件出了 bug&#x…

阅读更多 →
从规则驱动到对话式AI:智能家居技术栈演进与工程实践 2026/9/26 8:39:10

从规则驱动到对话式AI:智能家居技术栈演进与工程实践

智能家居这两年的出货量一直在涨,但真正让这个赛道变得有意思的,不是多卖了几台音箱或者多装了几个开关,而是设备开始"会说话"了。以前我们做智能家居项目,核心逻辑是"if this then that"——门磁开了就亮灯&…

阅读更多 →
JSP+Servlet+JavaBean选课系统:数据库设计与冲突约束实战 2026/9/26 8:39:10

JSP+Servlet+JavaBean选课系统:数据库设计与冲突约束实战

简介:这是一套面向高校计算机相关专业学生的数据库设计课程设计完整源码,采用jspservletjavabean技术路线,基于Eclipse与Tomcat8.5开发,数据库选用SQL Server 2017,适合作为课程设计、毕业设计参考或Java Web入门练手项…

阅读更多 →
跨平台文件传输工具横评:10款主流方案原理、实测与选型指南 2026/9/26 8:39:10

跨平台文件传输工具横评:10款主流方案原理、实测与选型指南

1. 为什么“传个文件”这件事值得认真对待手机和电脑之间传文件,看起来是个小得不能再小的需求,但真正每天在两端来回倒腾素材、文档、安装包的人都知道,这件事的体验差距可以大到让人抓狂。我自己常年是“手机拍照、电脑修图、平板看稿、再回…

阅读更多 →
higgsfield实战解析:从RLHF到生成模型的强化学习框架 2026/9/26 8:39:09

higgsfield实战解析:从RLHF到生成模型的强化学习框架

1. 名字背后的双重故事:从希格斯场到AI训练框架刚看到“higgsfield”这个名字的时候,我第一反应是粒子物理背景的朋友一定秒懂——Higgs Field,希格斯场,那个在标准模型里赋予基本粒子质量的场。做机器学习这些年,名字…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞 ✉