news 2026/10/10 9:22:54

ASCEND:与当地的Gemma一起,将一次小小的散步变成一次真实世界的探险

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
ASCEND:与当地的Gemma一起,将一次小小的散步变成一次真实世界的探险

这是提交给Hacktoberfest开源人工智能挑战赛:第1周——触摸草地.

附近的公园感觉很普通。给它一扇神秘的门,一个小故事,一个在尽头等待的叶耳伴,同样的散步变成了一场冒险。

这就是背后的想法上升。下一层是你前门外的某个地方。

我建造的东西
ASCEND是一款基于浏览器的户外任务游戏。它结合了对动画进展的期待和在现实世界中寻找事物的喜悦。你从E级开始,完成小冒险,收集原始同伴,解锁奖杯,逐渐向S级努力。

游戏从你的位置和你拥有的时间开始。它在OpenStreetMap中查找附近的公园、花园、户外艺术品、视点和其他符合条件的地方,并为城市公园、纪念碑和喷泉提供单独的Wikidata后备。Gemma在你的设备上运行并为绘制的目的地写一小段幻想的气氛。这个故事也有助于为探索任务选择一个有限的观察提示。

有三种方法可以探索:

探索 你做什么 报酬
到达大门 走到一个地图上的地方,登记入住 100 XP
有所发现 到达后,拍下你注意到的东西,并写下一些话 150 XP
追踪线索 按顺序在三个地方签到 250 XP
您的第一个完成的任务解锁费恩福克斯。后来的冒险介绍了一只长满苔藓的乌龟、一只发光的蛾子、一只月光下的猫头鹰、一只灰烬蝾螈和一只星界小鹿。他们是有原创作品的原创角色。

https://www.iissbbs.com /ASCEND’s companion collection, shown with labelled rehearsal progress

同伴是通过完成任务获得的。彩排奖励与现实世界的排名是分开的。

没有条纹惩罚。如果你错过了今天,明天安静的散步仍然是受欢迎的。

演示 播放ASCEND

开始试试排练在没有GPS、相机许可或帐户的情况下探索所有三种任务类型。它的排名和到达次数明显是虚构的,它的分数也从未进入全球排行榜。

对于一个真正的追求,选择找到我的下一个任务,允许位置,并选择一个冒险。试试当地的Gemma作家,读或听简报,然后打开袖珍指南。在检查点,重新打开应用程序并办理登机手续。

The actual ASCEND quest board

袖珍指南有用于重复简报、暂停和签到的大控件。安装的设备语音可以阅读简报。可选的浏览器识别支持“重复”、“状态”、“暂停”和“检入”等命令没有使用十一实验室。当浏览器缺少语音支持时,屏幕上也有同样的操作。

当页面被隐藏或手机被锁定时,浏览器GPS会暂停,因此ASCEND会在检查点要求您重新打开。手机帮助启动冒险并记录其结局;行走发生在这两个时刻之间。

密码
源代码、设置、测试和部署配置

探索探索引擎, Gemma工人,或者部署配置。自述文件包括自己运行它的命令。

代码是麻省理工学院许可的。生成的艺术有自己的归因说明,下载的模型权重保留了Gemma的条款。

我是如何建造的
基于实际地图的故事图层
地图服务使用OpenStreetMap天桥,并带有有界提供者回退。一个真实的部署测试暴露了不可用的立交桥网关,所以我添加了一个独立的Wikidata查询,用于城市公园、纪念碑和喷泉。它的有界查询在遵循类别关系之前搜索本地区域,然后检查已知的室内、溶解和未来位置。广义的住宅花园和游乐园类别被排除在外。

搜索被缓存并在并发浏览器之间共享。已知的私有和室内OpenStreetMap标签被过滤掉。访问信息和原始的OpenStreetMap或Wikidata项目仍然可见,因为地图上的地点并不能证明它是开放的或可以通过步行路线到达的。

杰玛写故事;一个独立的任务引擎锁定目的地、目标和经验。该模型不能发明一个目的地或授予奖励。冗长的、代码式的或不合适的叙述退回到一个明确标记的策划简报。

这个小模型给了我们一个有用的教训:一个复杂的格式提示可能会产生代码或者一个过于戏剧化的故事。简短地要求两个平静的童话般的句子效果更好。即使在改进了提示符之后,我仍然保留了输出保护。

本地Gemma,测量而非假设
该应用程序使用Gemma 3 270M米、Transformers.js和ONNX运行时。可用时使用WebGPU单独固定的兼容型号版本支持CPU上的WASM。第一次使用下载数百兆字节,所以应用程序在加载前解释这一点。

一个真正的浏览器推理产生了这一行:

当太阳温暖了长满青苔的叶子,微风拂过银色的花瓣时,灯笼花园低声诉说着秘密。

在测试的浏览器上,第一代花了5.1秒。第一个下载加生成模型98.5秒。这些是一台机器的测量结果,并不是对每一部手机的承诺。完整的提示、输出、修订和计时记录在中推理报告.

在禁用WebGPU的情况下测试了CPU回退:33.1秒对于一代人和170.4秒包括第一次下载。它的单独报告记录真实的WASM推论。

大型模型下载也暴露了测试期间中断的CDN传输。加载器现在可以在经过验证的8 MiB范围内获取固定工件,重试中断的块,并拒绝不匹配的修订。这使得真正的GPU和CPU运行完整。

A real local Gemma story for the explicitly fictional rehearsal destination

模特的叙述是虚构的。该报告确认,生成它使检查点坐标保持不变。

用于共享游戏的渲染,用于私人记忆的设备
前端和Express API在Render上运行。发布配置使用新加坡的免费web服务和免费Postgres。奖励更新使用数据库事务,包括防止重复的同时登记。资源管理器状态和世界排名存储在Render Postgres中。

GPS检查需要最近的定位、可接受的精度以及靠近检查点。之前完成的目的地会在24小时内从建议中消失。必须按顺序完成路径检查点。

世界排名是选择加入,并公布了一个别名与聚合游戏统计数据。他们不暴露目的地或照片。相机图像和最新的30个日志存储器保留在设备的索引数据库中;服务器接收照片元数据而不是像素。私有会话导出允许您恢复对浏览器的访问。

Render的免费服务大约需要一分钟才能唤醒,其免费Postgres在30天后过期。自述文件记录了这些限制以及在到期前导出或迁移的需要。这个词条使用免费服务,没有付费AI API。

我实际验证的是
33项自动化测试cover auth、GPS验证、相机元数据、进度、冷却、重复奖励、地图缓存和后退,以及Postgres回滚和清理。
19种浏览器场景涵盖任务流程,相机捕捉,同伴,奖杯,排名,会话导出/恢复,日志删除,以及每一个390像素宽的屏幕。
部署的API返回18个真实的地标靠近伦敦市中心的一个公共测试坐标,创造了一个接地的追求,没有要求户外访问或奖励。
一个私人探险家和他的主动探索在Postgres重启服务后幸存了下来。这实时部署报告记录支票;没有测试XP被添加到公共排名中。
Gemma的推理在浏览器中真实运行;其测量输出如上所述。
浏览器套件使用模拟全球定位系统和合成摄像头。声音命令动作用一个合成的抄本进行测试。可听的本地语音和现场麦克风转录仍然需要在物理电话上测试。我没有要求户外实地试验,浏览器报告的GPS仍然是欺骗性的:这些排名支持友好的比赛。

为什么开放式创新很重要?
位置感知游戏可以很容易地成为发送到远程模型的另一个私人信息流。开放重量让ASCEND在探索者的设备上生成它的故事。该提示不需要托管的AI端点、每层费用或AI API密钥。

OpenStreetMap和Wikidata提供可检查的目的地。Transformers.js和ONNX运行时使浏览器推理变得实用。任务引擎是可读的,所以有人可以改变奖励规则,添加同伴,交换模型,或拥有自己的版本。

本地推断不会使整个应用程序离线:新的地图查找和共享排名仍然需要一个连接。在模型被下载到一个有能力的设备上之后,它确实让创造性的部分在本地运行。对于一个围绕走出去而构建的游戏来说,这是一个有用的边界。

建立注释和学分
ASCEND的新存储库、游戏性、API、数据库、界面、艺术作品和测试都是在第一周的窗口中构建的。本地模型兼容性工作借鉴了我早期的斯蒂尔鲁特实验。动画进展和位置收集灵感得到认可;不使用单人关卡或神奇宝贝游戏资源。

Codex协助实施,测试,并撰写了这篇文章。封面和配套插图是为此项目制作的;他们的提示和出处都有记录.

奖项类别
Gemma的最佳用途:正版设备-本地Gemma推理编写了接地冒险的幻想故事,并有助于发现焦点。
渲染的最佳用途:渲染主机的可玩前端和共享的任务API,与探险家进展和排名的Postgres。
你的下一扇门可能是一个你已经走过一百次的花园。带点好奇心。费恩福克斯会在那里和你会合。

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/10/10 9:18:34

Qt C++ 坦克大战实战:从 QGraphicsScene 到完整 35 关源码解析

简介:面向C课程设计或大作业场景的经典坦克大战游戏项目,基于Qt 5.14.1与gcc 7.3.0环境开发,使用Qt Creator 4.11.0进行构建调试,完整实现单人闯关玩法。游戏共有35关,每关需要击败20个敌方坦克;玩家每关拥…

作者头像 李华
网站建设 2026/10/10 9:18:23

山海鲸可视化 VS FineReport:渲染能力与报表能力,决定项目选型边界

数字化大屏项目落地到实际业务,终究绕不开一个核心问题:项目核心诉求到底是三维场景渲染展示,还是复杂业务报表输出。园区 IOC、工厂数字孪生、财务统计报表、监管报送驾驶舱,不同项目的核心目标完全不一样,而山海鲸可…

作者头像 李华
网站建设 2026/10/10 9:15:34

Twenty CRM 5.8万星背后:为AI Agent打造的可编程数据模型与集成实战

1. 从5.8万星说起:这个CRM到底戳中了什么痛点第一次在代码托管平台上刷到Twenty这个项目时,5.8万颗星这个数字确实让我停了一下。做企业软件这么多年,我太清楚CRM这个赛道有多拥挤了——从老牌巨头到各种轻量级SaaS,几乎每个团队都…

作者头像 李华