Google AI Edge Gallery 实用上手指南:在手机上离线跑本地 AI 模型
【免费下载链接】galleryA gallery that showcases on-device ML/GenAI use cases and allows people to try and use models locally.项目地址: https://gitcode.com/GitHub_Trending/gallery44/gallery
Google AI Edge Gallery 是一个把开源大模型完整跑在手机端的应用。下载 Gemma 等本地 AI 模型后,对话、看图、转写录音全部离线完成,提示词和照片不会离开设备。适合想体验端侧模型又不想搭服务器环境的新手,以及准备改源码做二次开发的 Android 开发者。
装好应用并下载第一个模型
系统要求:Android 12 及以上,或 iOS 17 及以上。
- 安装应用:从 Google Play 或 App Store 安装;两个渠道都用不了时,到项目 release 页面下载 APK 手动安装。
- 首次打开:同意用户协议后进入功能列表,Chat、Ask Image、Audio Scribe、Prompt Lab 等入口都在首页。
- 下载模型:在任一功能页选中模型并点击安装,应用会从 Hugging Face 拉取模型文件。Gemma-3n-E4B 约 4.4GB,建议预留 6GB 以上空间。
- 下载完成后状态变为可用,回到对应功能页即可开始使用。
按场景走查:聊天、看图、转写、加技能
多轮对话:选模型,按需开推理开关
目标:和模型连续对话。入口是 Agent Chat 页。选定模型后直接提问,支持推理开关的模型(目前为 Gemma 4 系列)可以打开 Thinking Mode,查看逐步思考过程,用来核对复杂问题的推理是否靠谱。预期结果:逐条生成回复,多轮之内上下文保持。
让本地 AI 看懂照片
目标:识别物体、解释画面。入口是 Ask Image 页。从相机拍摄或从相册选图,再输入问题(例如"图里是什么植物")。只有标注支持图像输入的模型(如 Gemma 3n E2B/E4B)能跑这个功能。预期结果:模型返回对图片内容的文字描述。
语音转写:录音变文字
目标:把口述内容转成文字。入口是 Audio Scribe 页。开始录音或导入音频文件,模型实时输出文字,也支持翻译。处理全程在设备端完成,断网也能用。
用 Agent Skills 给模型加技能
目标:让模型会查维基、画地图、生成二维码。入口是 Agent Chat 输入框旁的 Skills 标签,点加号可从推荐列表添加、按 URL 加载或从本地导入。每个技能由一份 SKILL.md 描述,模型判断相关时自动调用,仓库 skills/ 目录里的示例可以直接参考。
问题排查:现象、原因、处理
- 下载卡住或失败→ 网络不稳或空间不足。换稳定的 Wi-Fi,删掉不用的旧模型腾空间。
- 推理时应用闪退→ 模型占内存超过设备上限。换 1B 级别的更小模型,并关闭后台应用。
- 首次回复特别慢→ 模型刚加载进内存。等状态指示变为就绪再提问。
- MCP 工具调不通→ 小模型解析不了工具定义,或工具太多挤占上下文。换 Gemma-4-E4B,并在管理页只打开需要的工具。
- 模型加载失败→ 文件下载不完整或版本不匹配。删除该模型后重新下载。
模型怎么选:按内存和任务定
仓库内置的 model_allowlist.json 列出了每个模型的文件体积和预估峰值内存,可直接对照:
- 如果你要响应快、占地方少,就选 Gemma3-1B(文件 0.55GB,峰值约 2GB),代价是只支持纯文本。
- 如果你要图片问答且内存受限,就选 Gemma-3n-E2B(文件 3.1GB,峰值约 5.9GB)。
- 如果设备内存 8GB 以上、追求更好的对话质量,就选 Gemma-3n-E4B(文件 4.4GB,峰值约 7GB)。
- 拿不准就两个都下,用应用内置的 Benchmark 在真机上测一遍速度和效果,再决定保留哪个。
进阶之路:文档、源码与扩展
想深入的话,仓库里几份文档是入口:README.md 讲整体功能,DEVELOPMENT.md 讲本地构建(需先在 Hugging Face 创建开发者应用,把 clientId 填入 ProjectConfig.kt),mcp/README.md 讲如何接入 MCP 服务器,Function_Calling_Guide.md 讲如何给模型加自定义函数。
扩展方向主要是三个:照 skills/ 的结构写自己的 SKILL.md 技能、接 MCP 服务器让本地 AI 调用外部工具、改源码后自行构建安装。本地构建只需两条命令:
git clone https://gitcode.com/GitHub_Trending/gallery44/gallery cd gallery/Android/src && ./gradlew installDebug从聊天、看图到转写录音,这个应用把端侧推理流程做成了可以逐项体验的演示。把常用的本地离线模型留在手机里、定期清理不用的文件,日常使用基本不会有压力;要改代码时,仓库里的示例能直接当模板。
【免费下载链接】galleryA gallery that showcases on-device ML/GenAI use cases and allows people to try and use models locally.项目地址: https://gitcode.com/GitHub_Trending/gallery44/gallery
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考