Laya演示:体验在手机上运行的System One模型

九个在线演示把自己做出的每一个决策都交给同一个开放AI模型,而这个模型运行在来自Acurast Network的一部Android手机上。在一个演示里,它玩经典的Snake游戏;在另一个演示里,它判断您的提示词注入能否骗过防护。
这个模型就是Laya,来自ConvAI Innovations的开放System One模型。上一篇文章介绍了为什么System One模型适合去中心化云。本文将带您逐一了解Laya演示:每个演示做什么,Laya在其中决定什么,以及在哪里亲自体验。
每个演示的工作原理
System One模型不写文本。每个演示都会把当前情况和一个带固定选项的问题发送给Laya,Laya从中选出一个,并为每个选项给出概率。向左转还是向右转?收件箱、垃圾邮件还是钓鱼邮件?放行这条提示词,还是拦截它?
这就是对一部手机发出的一次HTTP调用:手机在自己的CPU上运行Laya,大约0.2到1秒内给出回答。演示根据回答采取行动,展示发生了什么变化,然后再次提问。下面每个演示都以同一个模型运行同一个循环,变化的只有选项。
9
在线演示,外加一个API
0.2秒
最快手机上的单次简短决策耗时
游戏:Snake、Tetris和Doom
游戏让这个循环一目了然,因为屏幕上的每一步都是Laya片刻之前做出的决策。
Snake
Laya负责掌舵。在单步模式下,游戏会等待每一个回答,每次只移动一格。在实时模式下,蛇会一直移动,因此Laya要提前规划在哪里转弯。您可以在每个问题中加入自己的策略,观察玩法如何随之改变。
Tetris
对于每个方块,页面会先筛选出五个最佳落点,并标注其好坏:消除一行、严丝合缝、留下空隙。Laya从中选择一个。同样,您自己的策略也会加入每一个问题。
Doom
这是真正的Doom引擎,运行的是免费的Freedoom游戏文件。Laya只能获得玩家能看到的信息:生命值、弹药,以及视野中的怪物、物品和门。没有地图,没有出口标记,也看不到墙后的任何东西。每一回合,它都会选择下一步行动(射击、瞄准、拾取物品、开门或探索),再由页面上的一个小型控制器执行。
阅读收件箱:邮件、新闻和聊天
文本分类正是System One模型专为之打造的日常工作。三个演示从不同角度展示了这一点。
- 邮件分类器:一位像素邮差送来一袋邮件,Laya逐封拆开,把每封信归入收件箱、垃圾邮件或钓鱼邮件。每封信都有已知的正确答案,因此页面会记录得分。您也可以自己写一封信,看看它会被归到哪里。
- 新闻编辑室:标题从印刷机上滚滚而出,Laya判断每条标题的写法:正经新闻、讽刺、标题党还是操纵性内容。它无法核实事实,因为它无法访问互联网,所以它评判的是写法。您可以给它输入真实的RSS源、您自己的分类或您自己写的标题。
- 实时聊天审核员:直播聊天不断滚动,Laya从实时队列中标记有害、垃圾和诈骗消息。您也可以参与聊天,看看自己会不会被标记。
越狱防护挑战
Laya守在一个AI助手的门口,对每一条提示词决定放行还是拦截,并判断它看起来属于哪种攻击。您的任务是让一条狡猾的提示词注入骗过它。门后并没有真正的助手,只有判定结果,所以您可以尽情尝试。
这是生产用途最明显的演示。这样的防护可以部署在任何聊天机器人或智能体之前,筛查到达它们的内容,而且运行在您自己掌控的手机上,而不是别人的API上。
纯属娱乐:帮我滑和匿名热线
- 帮我滑:描述您心目中的终身伴侣,Laya就会在一叠古怪的像素资料卡中左右滑动,其中不乏历史上最奇特的人物,并为每一位给出匹配度评分。您也可以把自己的资料加入这叠卡片。
- 匿名热线:在某个决定上犹豫不决?描述一下情况,列出您的选项,一部您永远不会见到的手机就会替您选一个。无需帐户,无需注册,而且这部手机不保留任何请求日志。
在您自己的应用中使用
演示所做的一切都只是一次HTTP调用,API页面对此有完整说明:提供一个状态和几个带类型的问题,返回的是一个选项、一个评分或一个是/否概率。页面附带curl、JavaScript和Python示例、一个在线体验场,以及一个llms.txt文件,让AI智能体一次就能读完整个API。
“Snake、垃圾邮件过滤和提示词安全看起来像三种不同的产品。对Laya来说,它们是同一个问题,只是选项不同。”
不足之处
这些演示既展示了Laya的优势,也展示了它的局限。在测试中,邮件分类器在160封信中答对了144封,准确率约为90%,所以偶尔出错在所难免。新闻编辑室能看出一条标题读起来像标题党,却无法判断它是否属实。刁钻或对抗性的文本仍能骗过它,而这正是防护游戏邀请您去尝试的。此外,一部手机的处理能力终究有限:加快聊天速度,审核员的队列就会开始变长。
请把Laya当作快速的第一道过滤器,而不是最终结论。
亲自体验
演示已在laya.acurast.com上线,而背后的模型并不运行在数据中心里。每一个回答都来自Acurast Network上的一部真实手机,每个页面都会显示是哪一部:它所在的国家、芯片以及已处理的决策数量,并附有链接,可在链上验证。当Laya让您的蛇转弯或拦截您的提示词时,是世界某处的一部手机做出了这个判断,而您可以亲自核实。不妨从防护挑战开始:看看您最好的提示词注入能撑多久。
想要拥有自己的实例?选择Cargo: Laya模板,它就在Acurast Hub Playground里。几分钟后,您自己的决策模型就会在超过320,000部手机中的一部上运行,费用每天不到1 ACU。包含演示在内的代码已在GitHub上的Acurast示例应用中开源。
在Acurast上构建?如果您正在经过证明的手机上运行自己的模型、智能体后端或决策服务,欢迎加入Acurast Discord,与其他构建者交流经验。加入Discord。


