Por que modelos System One combinam com uma nuvem descentralizada

Boa parte da IA em produção responde a perguntas simples. Este e-mail é spam? O ticket é um pedido de reembolso ou um relato de bug? Este prompt é seguro? Em 15 de setembro, a TypeSafe AI lançou o Jev, um modelo criado só para esse tipo de pergunta. Uma semana depois, já havia uma alternativa aberta.
Essa nova classe se chama modelo System One (o nome remete ao “Sistema 1”, o pensamento rápido e intuitivo), e ela é exatamente a carga de trabalho que uma nuvem descentralizada executa melhor. Veja por que as decisões são o terreno em que a IA descentralizada faz mais sentido e como isso funciona em um celular.
As demos estão no ar: teste você mesmo em laya.acurast.com.
A carga de trabalho
Decisões, descentralizadas
Pequena, sem estado e privada: a IA que cabe em um celular.
O que é um modelo System One
A IA de chat escreve a resposta uma palavra por vez. Um modelo System One pula a escrita. Você fornece um texto e algumas perguntas com opções fixas, e ele responde a todas de uma vez, com uma probabilidade para cada uma:
- Escolha uma: reembolso, ajuda técnica ou outra coisa?
- Sim ou não: é urgente?
- Classifique: calmo, irritado ou furioso?
Nada para interpretar, nada para alucinar. O Jev é a versão fechada, uma API paga que prende todo app construído sobre ela a um único fornecedor. O Laya, da ConvAI Innovations, é a versão aberta: licença Apache 2.0, cerca de 800 MB e compatível com a API do Jev, então um app feito para um pode trocar para o outro.
Por que modelos System One combinam com uma nuvem descentralizada
Os modelos de linguagem mais avançados precisam de racks inteiros de GPUs (processadores gráficos), e é por isso que a maior parte da “IA descentralizada” ainda acaba alugando data centers. Um modelo System One é o oposto: pequeno o bastante para um único celular, sem memória entre as requisições e alimentado com alguns dos textos mais privados que uma empresa tem. É exatamente o tipo de trabalho para o qual uma rede de celulares foi feita.
Escala na horizontal, não na vertical
Data centers escalam na vertical: uma GPU maior, um prédio maior. As decisões escalam na horizontal. Cada requisição é independente, então dez celulares fazem dez vezes o trabalho, e na Acurast o número de celulares é uma única configuração.
A oferta já existe. Cerca de 1,39 bilhão de smartphones são vendidos por ano, e os que eles substituem ainda têm processadores perfeitamente bons. Mais de 310.000 celulares já entraram na Acurast.
310K+
Celulares cadastrados
1B+
Transações on-chain
0,2 s
Por decisão nos celulares mais rápidos
Acessível: deploy direto do navegador
Nenhum servidor para alugar, só o celular de outra pessoa: o exemplo tem um custo de deployment de menos de 1 ACU por dia. No playground do Acurast Hub, escolha o modelo inicial Cargo: Laya, defina quantos celulares quer usar e faça o deploy. Poucos minutos depois, seu próprio modelo de decisão está no ar.
Privado: decisões lidam com seus dados mais sensíveis
Com uma API hospedada, cada e-mail, mensagem de chat e ticket de suporte que você classifica passa pelos servidores de terceiros. Rode o seu próprio modelo e isso muda. Nenhuma empresa fica no meio, os pesos do modelo são abertos, o app de exemplo não guarda logs e só roda em celulares atestados, verificados como hardware genuíno.
Viabilizado pelo Cargo
O Acurast Cargo dá a cada deployment um ambiente Linux completo no celular, então o Laya é instalado exatamente como seria em um servidor alugado. O mesmo runtime já hospeda OpenClaw, WordPress e servidores de Minecraft. A IA avança em semanas, e o Cargo acompanha.
“Quando a próxima classe de modelos aparecer, ela não vai precisar de uma nova integração, só de um script de inicialização de quem quiser rodá-la.”
Veja rodando
Os celulares de teste usados no exemplo estão espalhados pela Europa, pelos EUA e pela Ásia. Os mais rápidos respondem a uma pergunta curta de sim ou não em cerca de 0,2 segundo e classificam um e-mail inteiro em bem menos de um segundo; os mais lentos levam mais ou menos um segundo. Isso é mais lento que uma GPU de data center, e para e-mail, moderação ou agentes não faz diferença.
Os jogos mostram para que serve essa velocidade. O Laya olha o tabuleiro, escolhe uma jogada, vê o que mudou e decide de novo: para que lado a cobra vira, onde cai uma peça do Tetris e, no Doom, se deve mirar, atirar, pegar algo ou abrir uma porta. O classificador de e-mails e o moderador de chat rodam o mesmo ciclo; só mudam as opções.
Onze demos rodam no Laya, agora incluindo Doom: um classificador de e-mails, um moderador de chat ao vivo, uma redação que identifica clickbait, uma proteção contra prompt injection, um app de namoro, Snake, Tetris e mais. Teste ao vivo em laya.acurast.com.
Onde ele deixa a desejar
Os modelos System One existem como categoria há uma semana, e o Laya tem limites reais. A precisão cai quando uma pergunta tem mais de cerca de 20 opções, o modelo base é confiante demais até ser calibrado, e textos capciosos ou adversariais ainda o enganam. Use-o como um primeiro filtro rápido, não como a palavra final.
Faça o deploy do seu
Não há lista de espera nem fornecedor a quem pedir acesso à API. Abra o playground do Hub, escolha Cargo: Laya e faça o deploy. O código, incluindo as onze demos, está aberto nos apps de exemplo da Acurast no GitHub.
Construindo na Acurast? Se você roda seus próprios modelos, backends de agentes ou serviços de decisão em celulares atestados, o Discord da Acurast é onde os desenvolvedores trocam experiências. Entre no Discord.


