news 2026/9/5 19:38:39

Google AI Edge Gallery 实用上手指南:在手机上离线跑本地 AI 模型

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Google AI Edge Gallery 实用上手指南:在手机上离线跑本地 AI 模型

Google AI Edge Gallery 实用上手指南:在手机上离线跑本地 AI 模型

【免费下载链接】galleryA gallery that showcases on-device ML/GenAI use cases and allows people to try and use models locally.项目地址: https://gitcode.com/GitHub_Trending/gallery44/gallery

Google AI Edge Gallery 是一个把开源大模型完整跑在手机端的应用。下载 Gemma 等本地 AI 模型后,对话、看图、转写录音全部离线完成,提示词和照片不会离开设备。适合想体验端侧模型又不想搭服务器环境的新手,以及准备改源码做二次开发的 Android 开发者。

装好应用并下载第一个模型

系统要求:Android 12 及以上,或 iOS 17 及以上。

  1. 安装应用:从 Google Play 或 App Store 安装;两个渠道都用不了时,到项目 release 页面下载 APK 手动安装。
  2. 首次打开:同意用户协议后进入功能列表,Chat、Ask Image、Audio Scribe、Prompt Lab 等入口都在首页。
  3. 下载模型:在任一功能页选中模型并点击安装,应用会从 Hugging Face 拉取模型文件。Gemma-3n-E4B 约 4.4GB,建议预留 6GB 以上空间。
  4. 下载完成后状态变为可用,回到对应功能页即可开始使用。

按场景走查:聊天、看图、转写、加技能

多轮对话:选模型,按需开推理开关

目标:和模型连续对话。入口是 Agent Chat 页。选定模型后直接提问,支持推理开关的模型(目前为 Gemma 4 系列)可以打开 Thinking Mode,查看逐步思考过程,用来核对复杂问题的推理是否靠谱。预期结果:逐条生成回复,多轮之内上下文保持。

让本地 AI 看懂照片

目标:识别物体、解释画面。入口是 Ask Image 页。从相机拍摄或从相册选图,再输入问题(例如"图里是什么植物")。只有标注支持图像输入的模型(如 Gemma 3n E2B/E4B)能跑这个功能。预期结果:模型返回对图片内容的文字描述。

语音转写:录音变文字

目标:把口述内容转成文字。入口是 Audio Scribe 页。开始录音或导入音频文件,模型实时输出文字,也支持翻译。处理全程在设备端完成,断网也能用。

用 Agent Skills 给模型加技能

目标:让模型会查维基、画地图、生成二维码。入口是 Agent Chat 输入框旁的 Skills 标签,点加号可从推荐列表添加、按 URL 加载或从本地导入。每个技能由一份 SKILL.md 描述,模型判断相关时自动调用,仓库 skills/ 目录里的示例可以直接参考。

问题排查:现象、原因、处理

  • 下载卡住或失败→ 网络不稳或空间不足。换稳定的 Wi-Fi,删掉不用的旧模型腾空间。
  • 推理时应用闪退→ 模型占内存超过设备上限。换 1B 级别的更小模型,并关闭后台应用。
  • 首次回复特别慢→ 模型刚加载进内存。等状态指示变为就绪再提问。
  • MCP 工具调不通→ 小模型解析不了工具定义,或工具太多挤占上下文。换 Gemma-4-E4B,并在管理页只打开需要的工具。
  • 模型加载失败→ 文件下载不完整或版本不匹配。删除该模型后重新下载。

模型怎么选:按内存和任务定

仓库内置的 model_allowlist.json 列出了每个模型的文件体积和预估峰值内存,可直接对照:

  • 如果你要响应快、占地方少,就选 Gemma3-1B(文件 0.55GB,峰值约 2GB),代价是只支持纯文本。
  • 如果你要图片问答且内存受限,就选 Gemma-3n-E2B(文件 3.1GB,峰值约 5.9GB)。
  • 如果设备内存 8GB 以上、追求更好的对话质量,就选 Gemma-3n-E4B(文件 4.4GB,峰值约 7GB)。
  • 拿不准就两个都下,用应用内置的 Benchmark 在真机上测一遍速度和效果,再决定保留哪个。

进阶之路:文档、源码与扩展

想深入的话,仓库里几份文档是入口:README.md 讲整体功能,DEVELOPMENT.md 讲本地构建(需先在 Hugging Face 创建开发者应用,把 clientId 填入 ProjectConfig.kt),mcp/README.md 讲如何接入 MCP 服务器,Function_Calling_Guide.md 讲如何给模型加自定义函数。

扩展方向主要是三个:照 skills/ 的结构写自己的 SKILL.md 技能、接 MCP 服务器让本地 AI 调用外部工具、改源码后自行构建安装。本地构建只需两条命令:

git clone https://gitcode.com/GitHub_Trending/gallery44/gallery cd gallery/Android/src && ./gradlew installDebug

从聊天、看图到转写录音,这个应用把端侧推理流程做成了可以逐项体验的演示。把常用的本地离线模型留在手机里、定期清理不用的文件,日常使用基本不会有压力;要改代码时,仓库里的示例能直接当模板。

【免费下载链接】galleryA gallery that showcases on-device ML/GenAI use cases and allows people to try and use models locally.项目地址: https://gitcode.com/GitHub_Trending/gallery44/gallery

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/5 19:37:03

TDengine Linux 完整安装配置指南

TDengine Linux 完整安装配置指南 【免费下载链接】TDengine High-performance, scalable time-series database designed for Industrial IoT (IIoT) scenarios 项目地址: https://gitcode.com/GitHub_Trending/tde/TDengine TDengine 是面向工业物联网、车联网等场景的…

作者头像 李华
网站建设 2026/9/5 19:36:39

品牌监测架构升级:基于RAG与多模型语义感知的实践

1. 从"关键词告警"到"生成式监测",这次架构升级到底解决了什么做品牌监测这个方向的人应该都有同感:传统方案走到今天,瓶颈早就不是"能不能抓到信息",而是"抓到了能不能看懂"。之前我们团…

作者头像 李华
网站建设 2026/9/5 19:35:10

全局BP赛制:如何重塑电竞比赛的策略与观赛体验

全局BP并不是近几年才冒出来的新概念,但当它在一场又一场KPL夏季赛中被反复验证,甚至被越来越多电竞项目当作“竞赛规则的标准答案”时,我们就有必要停下来认真想一想:为什么一次看起来只是限制选手“不准重复选英雄”的机制调整&…

作者头像 李华
网站建设 2026/9/5 19:32:47

电竞复盘如何科学归因:从BP到操作,分清决策与执行

AG败走EWC无缘冠军 的赛后讨论里,很多人把问题压缩成一个选择题:教练BP背锅,还是选手操作背锅。这个问法很容易得到答案,但在专业复盘里几乎无法使用。原因很简单:BP和操作不是两个并列的独立变量,而是一条…

作者头像 李华
网站建设 2026/9/5 19:30:48

三步装好并跑通 TDengine 时序数据库:Linux 安装配置完整指南

三步装好并跑通 TDengine 时序数据库:Linux 安装配置完整指南 【免费下载链接】TDengine High-performance, scalable time-series database designed for Industrial IoT (IIoT) scenarios 项目地址: https://gitcode.com/GitHub_Trending/tde/TDengine 如果…

作者头像 李华