📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

🤖MAX chegou: a IA que escolhe a MELHOR IA para cada tarefa (isso muda tudo)

Onde eu Clico12:41

Transcription

um modelo para todos governar. Durante anos, cada nova IA prometeu ser definitiva, a mais rápida, a mais inteligente, a que finalmente resolveria tudo. Mas a verdade é que nenhuma sozinha conseguiu dominar todos esses cenários até agora.

A Arena IAI acaba de lançar algo que muda completamente esse jogo, um sistema que não depende de um único modelo, porque ele escolhe automaticamente o melhor modelo para cada tarefa. Código, texto, matemática, criatividade, tudo roteado de forma inteligente, com base em milhões de avaliações reais dos usuários. E o resultado, um desempenho geral que supera todos os modelos mais avançados do mercado.

Hoje eu vou mostrar para vocês o que é o Max, porque isso pode mudar a forma como a gente usa a inteligência artificial e o que isso significa para quem cria, trabalha ou vive com IA todos os dias, inclusive com as limitações.

Agora, vocês já repararam que tem conteúdo novo por aqui todo dia? Então, para não perder nada, inscreva-se no canal e ative aquele sininho que tá aparecendo aqui embaixo para ser avisado quando o vídeo é postado, combinado? Então, bora pro vídeo.

Bom, pessoal, hoje eu quero falar com vocês sobre essa novidade aqui que acabou de ser anunciada pelo pessoal da Arena IAI. Escutem aí. Diga olá para o Max. Max é o roteador inteligente da Arena, alimentado por mais de 5 milhões de votos da comunidade do mundo real. O Max encaminha cada solicitação para o modelo mais adequado, levando em consideração a latência. Os modelos de IA se destacam em diferentes aspectos: código, matemática, velocidade e raciocínio. Então, Max orquestra os pontos fortes de cada modelo para oferecer desempenho confiável em casos de uso do mundo real. E ele tá disponível gratuitamente para você poder testar.

Antes disso, vocês repararam que agora o LM Arena se chama Arena? É isso mesmo. Mesmo que você digite ali LM Arena, ele vai jogar pro Arena. E por que que isso mudou? Escutem aí.

"O que começou como um experimento de pesquisa de doutorado para comparar modelos de linguagem de IA cresceu ao longo do tempo e se tornou algo mais amplo, moldado pelas pessoas que o utilizam. Uma comunidade global de milhões de pessoas trouxe estímulos do mundo real, opiniões de especialistas, novas modalidades e diversas maneiras de trabalhar com IA. O que começou como um projeto de pesquisa acadêmica na Universidade de Berkley evoluiu para uma plataforma global para avaliar o desempenho de IA na prática. Temos o prazer de compartilhar hoje nossa nova identidade visual, que reflete nossa missão científica, mensurar e expandir as fronteiras da IA para o uso no mundo real. Essa evolução é o motivo de sermos agora Arena, disponível em arena.ai."

Então essa é a nova identidade visual, mas se você digitar LM Arena também vai entrar no site. E aí eles explicam aqui porque escolheram Arena.

"Nossa Arena é um espaço transparente e compartilhado. Diariamente, pessoas usam a Arena para testar modelos sob, programar, raciocinar, projetar, pesquisar e criar. Quando desenvolvemos o Chatbot Arena há 3 anos, criamos o termo arena para um lugar onde os modelos competem para serem avaliados por usuários reais. Agora que nossa plataforma se tornou a arena de fato, o LM já não serve mais para nós, é hora de abandoná-lo."

Então, a partir de agora, todo mundo vai chamar de Arena AI ou Arena AI pra gente aqui no Brasil.

Bom, vamos falar do Max agora, apresentando o Max. Hoje estamos lançando o Max, o roteador de modelos do Arena, desenvolvido com base em mais de 5 milhões de votos reais da nossa comunidade. O Max funciona como um orquestrador inteligente. Ele direciona cada solicitação do usuário para o modelo mais adequado para aquela solicitação específica. Dessa forma, o Max alcança o máximo desempenho em todos os domínios.

Aí eles demonstram aqui o desempenho do roteador base, pontuação máxima na Arena. O Model Arena avalia o desempenho geral e as categorias de desempenho em cada modelo. Então você tem aqui geral, especialista, instruções difíceis, codificação, matemática, escrita criativa, instruções a seguir e consulta mais longa. Na categoria geral, o Max conseguiu 1500 pontos, enquanto Gemini 3 Pro 148, o Grok 4.176, o Gemini 3 Flash 1471 e o Claude 4.5 1468. Como especialista, a gente vê que o Max também aparece aqui em primeiro lugar. Então, em todas essas categorias que estão sendo demonstradas aqui, o Max saiu melhor quando comparado com os modelos aqui de forma individual.

Aqui a gente tem a distribuição geral de roteamento, ou seja, quando você coloca o prompt, qual é o modelo que ele acessa? Em primeiro lugar, Gemini 3 Pro 37%, depois Grok 4.1 Finking com 15.35, Claude Opus 4.5 Finking 15.85 85 e assim por diante. Então aqui ele traz um parâmetro de acesso dependendo daquilo que você pede, utilizando ali o campo do prompt. Então dá pra gente perceber que o Gemini 3 Pro aparece aqui em primeiro lugar.

Então para quem quiser se aprofundar mais nesse assunto, eu vou deixar o link aqui do blog da Arena AI direitinho para que vocês possam consultar. Então vamos lá que eu vou mostrar para vocês agora como acessar o Max, o que eu já consegui criar e quais são as virtudes e também as limitações desse roteador.

Então esse daqui foi o primeiro prompt que eu usei. "Crie uma landing page moderna, estilo clássico para uma joalheria. Eu não tenho as fotos dos produtos, pois a loja é fictícia. Então use imagens a sua escolha para criar o site. Luxuoso e minimalista."

Uma das limitações aqui do roteador, pelo menos por enquanto, no momento que eu tô gravando esse vídeo, é que você não consegue visualizar o código aqui dentro da ferramenta. Ele vai montar o código para você, só que para poder visualizar, você vai ter que levar para uma outra ferramenta. Então, esse daqui foi o código que ele criou para mim. Aí eu copiei, salvei no meu bloco de notas e esse daqui foi o resultado. Essa é a página da joalheria que ele me entregou. Eu achei que ficou muito legal, porque do jeitinho que eu pedi, é um site moderno, minimalista, luxuoso, de bom gosto, com as imagens que eu disse para ele colocar porque eu não tinha, com os menus aqui todos funcionando. Enfim, ficou bem bacana.

Agora, qual será que foi o modelo que ele usou? Vamos voltar aqui. Para saber é só clicar aqui no menuzinho. Então, para criar o site da minha joalheria, ele utilizou aqui um modelo da Antropic, provavelmente o Claude Opus 4.5.

Vamos agora pro segundo exemplo. "Crie um aplicativo para calcular a quantidade de calorias dos alimentos. A ideia é que esse aplicativo traga exemplos com fotos de todos os grupos alimentícios. Esse aplicativo deve ter uma UI moderna, estilo esportivo e botões responsivos que levem aos alimentos."

Aí ele montou o código aqui para mim e dividiu em três arquivos. Então eu tenho isso daqui HTML, depois um CSS e por fim um script.js. Aí como eu não consigo visualizar tudo isso aqui dentro do Max, o que que eu fiz? Eu criei um aplicativo aqui dentro do Google AI Studio para fazer exatamente isso. Então, primeiramente, eu vou fazer o upload aqui do meu arquivo HTML, agora do CSS e por fim do JavaScript. E aí eu já tenho aqui o meu aplicativo montado. E olha, ficou bem bacana. Eu tenho aqui carboidratos, proteínas, frutas, vegetais, laticínios, gorduras boas. Quando eu clico, olha só, arroz branco, pão integral, macarrão, batata e aveia. E aí eu posso ir adicionando aqui a minha dieta. Tenho aqui a calculadora, onde eu consigo fazer o cálculo exato aqui daquilo que eu tô consumindo e também aqui um diário para que eu coloque exatamente aquilo que eu tô comendo. Então, é um aplicativo bacana, funcionou de primeira, ele criou ali para mim aqueles três arquivos. Eu só joguei aqui dentro desse outro app que eu criei aqui dentro do Google AI Studio para poder mostrar para vocês. E aí agora eu consigo visualizar o meu app que ficou muito bem feito.

Qual foi o modelo que ele usou? Vamos lá ver. Então, voltando aqui, clicando no seletor, mais uma vez ele utilizou o modelo da Antropic, provavelmente o Claude 4.5.

Aí pra escrita, eu pedi o seguinte: "Escreva uma redação com 30 linhas sobre povos indígenas no Brasil. Use todos os requisitos exigidos pelo Enem." Aí ele pensou por aproximadamente 15 segundos e me trouxe aqui a redação. "A urgência da proteção aos povos indígenas no Brasil. A Constituição Federal de 1988 representa um marco na garantia de direitos aos povos indígenas brasileiros, reconhecendo sua organização social, costumes e línguas." E aí ele montou aqui direitinho a redação para mim, 1, 2, 3, 4 parágrafos e no final aqui apresentou uma solução respeitando os requisitos do Enem. Para essa tarefa ele também utilizou o modelo da Antropic.

Nesse outro caso aqui, "Faça uma pesquisa sobre equações diferenciadas e traga alguns exemplos." E aí, mais uma vez ele fez a pesquisa, trouxe aqui os exemplos de equação, tudo direitinho. E aí, para executar essa tarefa aqui, ele utilizou o modelo da Xi, provavelmente o Grok 4.1.

Agora vamos às limitações desse modelo. Vejam, eu pedi aqui para ele criar uma imagem para mim e ele não faz isso. Ele até tentou criar para mim aqui a imagem de um cavalo no deserto usando aqui o modelo da Xi, que a gente sabe que consegue gerar imagem, só que olha só o que ele diz. "Aqui está a imagem que gerei para você. Um cavalo árabe majestoso atravessando as dunas do deserto ao entardecer com tons quentes de laranja dourado." E aí ele coloca uma imagem quebrada aqui e não tem como visualizar. Mesmo que eu peça novamente aqui para ele gerar um link para mim, isso não dá certo. Olha só, a imagem não está aparecendo. Veja, mais uma vez ele tenta e não dá certo. Então eu acho que essa é uma limitação aqui do Max, pelo menos no momento em que eu tô gravando esse vídeo, ele não consegue gerar imagem.

Vamos fazer uma nova tentativa. Como é que a gente faz para acessar o Max aqui dentro da Arena AI? É muito simples. Você vai clicar aqui em novo chat. Se no seu menu seletor tiver aparecendo battle ou batalha, basta clicar na flechinha e aí você escolhe o chat direto. Automaticamente ele vai pular aqui pro Max. Se não tiver aparecendo, tiver em qualquer um desses outros modelos aqui, basta clicar novamente e aí você escolhe o Max. Detalhe, se você selecionar aqui qualquer uma dessas funções, como por exemplo, criar um site ou um aplicativo, gerar uma imagem ou fazer uma pesquisa na web, automaticamente ele sai do Max. Então, se eu clicar aqui para codificar, ele já escolhe aqui para mim o Claude Opus 4.5. Se eu clicar para fazer imagem, aí eu tenho a opção aqui do GPT 4.5. E para pesquisar na web, ele vai aqui pro Gemini 3 Flash. Então, para usar o Max, nenhuma dessas opções aqui devem estar ativadas. Aí é só digitar o seu prompt.

"Faça a imagem de uma maçã" e vou enviar. Engraçado é que ele não diz que ele não consegue, ele tenta fazer, mas a imagem não aparece. Olha lá, mais uma vez ele usou aqui o modelo da Xi, provavelmente aí o Grok 4.1. Tem uma imagenzinha aqui quebrada, mas a imagem não aparece. Então aqui no Max você não consegue selecionar qual modelo você quer usar. A própria inteligência artificial aqui da Arena, ela vai direcionar pro modelo mais capaz de executar essa tarefa. Pelo menos por enquanto, ainda não dá para criar imagens. Como tem aqui um íconezinho de imagem quebrada, pode ser que já já eles consertem isso e a gente também consiga criar imagens, mas por enquanto ainda não dá.

Então, pessoal, testem aí. Essa é uma ferramenta muito bacana, tá disponível gratuitamente. Você vai se inscrever aqui na Arena. Não precisa pagar nada. Seleciona ali o modelo Max e a partir daí você pode pedir o que quiser, menos imagens, como eu acabei de mostrar e aí automaticamente o roteador vai escolher o melhor modelo para executar aquela tarefa que você tá pedindo. Então testem aí e depois voltem aqui nos comentários para dizer para mim o que vocês acharam do novo Max.

E aí, que que vocês acharam desse roteador de modelos? Será que resolve o problema de saber qual é o melhor para cada tarefa? Conta aí para mim nos comentários, tá bom? Te vejo no próximo vídeo.