Nova ia atrai programadores ao amenizar ‘alucinações’
O novo modelo de inteligência artificial (IA) que está fazendo sucesso entre programadores ...
O novo modelo de inteligência artificial (IA) que está fazendo sucesso entre programadores não escreve uma palavra, não produz código e não oferece respostas de chatbot. Ainda assim, promete se tornar uma ferramenta barata para reduzir os erros dos grandes modelos de linguagem (LLMs), como os que sustentam o ChatGPT. O modelo se chama Jev e foi lançado na semana passada pela startup TypeSafe.
A TypeSafe foi cofundada há dois anos por Diogo Almeida, ex-funcionário da OpenAI que ajudou a criar um dos principais mecanismos do ChatGPT: o aprendizado por reforço com feedback humano (RLHF, na sigla em inglês). Com ele, as respostas do chatbot melhoram a partir do trabalho de avaliadores humanos. Almeida saiu da OpenAI em 2024 para fundar a TypeSafe, cujo primeiro produto para o público é o Jev.
IA classificadora
Um LLM funciona, basicamente, da seguinte forma: ao receber um comando (o prompt), ele gera a resposta palavra por palavra, seja produzindo um texto ou um código de computador. No entanto, em muitos casos de uso, o programador precisa que o modelo tome decisões mais simples, quase como "sim" ou "não".
Na arquitetura atual dos LLMs, isso significa que cada decisão tomada pela máquina é custosa tanto do ponto de vista do consumo de tempo quanto do de recursos computacionais " afinal, ela acaba produzindo e lendo texto para cada uma de suas ações.
Já o Jev corta a "conversa fiada" ao receber uma tarefa. O programador define o contexto e as alternativas para o problema e recebe do sistema uma decisão classificada pela probabilidade de ser a melhor opção. É o que a TypeSafe chama de "decisão calibrada".
" O Jev foi desenhado para ser uma interface de máquina para máquina, focada em tomada de decisão, classificação, pontuação e nota. Para software, isso é ótimo, porque dá um resultado estruturado. Ele não é um LLM. É uma IA de classificação " diz Leo Candido, AI First Transformation Manager na consultoria Artefact.
IAs classificadoras não são novidade. O Jev, porém, é uma espécie de classificador generalista. Ou seja, ele não precisa ser calibrado para cada tarefa que vai realizar " e há grande debate entre programadores se eles estão diante de uma nova classe de modelos, ou de uma reciclagem de velhos conceitos. Assim como os LLMs são treinados com texto, o Jev foi treinado em "decisões", o que permite sua aplicação a qualquer tarefa.
O modelo é treinado com uma técnica batizada de Reforço por Decisões Calibradas (RLCD, na sigla em inglês), um método no qual a IA aprende a dar respostas cuja probabilidade de acerto ela mesma consegue estimar.
Isso permite que o modelo cobre apenas US$ 0,042 por milhão de tokens (pedaços de palavras) processados. A IA chinesa DeepSeek, uma das mais baratas, cobra US$ 0,22.
" Hoje, muitas decisões simples passam por modelos enormes, que gastam muita eletricidade. Se parte dessas tarefas for para modelos de IA menores, o consumo e o custo podem cair. Isso só acontecerá se o Jev substituir essas tarefas, mas ainda faltam dados públicos sobre esse consumo " explica Wellington José da Silva, diretor de Tecnologia para IA da Riachuelo.
Além do potencial de ser mais barato, o Jev pode reduzir as alucinações dos LLMs comuns. Ao ser acoplado a esses modelos, o Jev pode direcionar respostas mais plausíveis e exigir que o programador seja mais claro nas orientações.
O Jev tornou-se o lançamento mais popular da plataforma Vercel, que hospeda sites e aplicativos, e a TypeSafe atraiu um investimento de US$ 40 milhões do fundo DCVC. (Bruno Romani)