Transcription
Este vídeo é trazido a você por Stack AI. Mais sobre eles depois.
GPT6 pode estar chegando até o final do ano. Este sujeito na CNBC disse que acabou de conversar com Brad Gersonner, uma figura proeminente no Vale do Silício, e ele acabou de dizer que o GPT6 está chegando até o final deste ano. Isso é daqui a 2 meses e meio.
Agora, isso vem logo após o GPT5. E honestamente, eu não acho que isso vá acontecer. Seria muito estranho ter este lançamento massivo do GPT5, que é realmente uma mudança fundamental na forma como os usuários interagem com o chat GPT, em vez de escolher entre um monte de modelos diferentes. Eles têm um modelo principal e um roteador, e foi apenas este momento muito unificador, este modelo unificador que eu acharia muito surpreendente ser substituído em pouco mais de alguns meses. Mas quem sabe? Veremos.
Em seguida, a Nvidia começou a vender o menor supercomputador da Terra. Este é o DGX Spark, e o próprio Jensen está entregando-o às principais empresas de IA do mundo. Veja este vídeo dele entregando o DGX original para Elon Musk em 2016. E agora, avançando menos de 10 anos depois, ele está entregando o DGX Spark. Assista a isto.
>> Como vai? Bem. Como vai? Este é o seu escritório? Uh, esta é a fábrica de foguetes. A fábrica de foguetes da SpaceX em Star, Texas. Eu só quero que todo mundo no mundo ouça que você disse que eu construo coisas maiores do que você. Uh >> você constrói. Os data centers são muito enormes. >> Tudo começou em 2016. Eu anunciei o primeiro supercomputador de IA do mundo. >> O DGX1, >> o computador mais avançado que alguém já construiu. >> Foi só silêncio. >> Silêncio >> exceto por uma pessoa. E foi você. Foi como uma ótima ideia. Então, eu construí outro DGX. Ótimo. >> E esta coisa é poderosa. Este é o novo DGX Spark. Então, essa é toda a coisa. >> Uau. >> Cinco vezes o poder computacional do DJX1. 40 watts, não quatro. >> Uau. >> DJX1 para DJX Spark. >> Mal posso esperar para colocar as mãos em um desses. Já pedi à equipe e estou apenas em uma lista de espera agora.
E, claro, a equipe da OpenAI também conseguiu um. Aqui está. Aqui está Greg Brockman. Aqui está Sam Altman. E ali está Jensen. Eu vejo Mark Chen no canto. E o resto da equipe da OpenAI com o belo DGX Spark.
Em seguida, a Anthropic lançou algo muito único e meio que passou despercebido, mas acho que pode ser um negócio maior do que a maioria das pessoas pensa. Este é o Claude Skills. Veja isto.
Hoje, estamos introduzindo skills no Claude.ai, Claude Code e na API. Skills permitem que você empacote conhecimento especializado em capacidades reutilizáveis que o Claude carrega sob demanda enquanto os agentes lidam com tarefas mais complexas. Muitas pessoas estão dizendo que isso é um substituto para MCP, embora pareça aumentar o MCP, como mostra este gráfico aqui. Então, Alex diz que é meio que como no Matrix, onde Neo aprende novas habilidades simplesmente injetando o conhecimento em seu cérebro. É meio que assim. Então, você carrega uma pasta com skill.md nela. O arquivo começa com um nome e descrição, depois contém instruções, código e recursos. Essa simplicidade significa que qualquer pessoa agora pode especializar o Claude sem construir agentes personalizados. Skills podem conter contexto efetivamente ilimitado sem inchar a janela de contexto. Então, ele carrega apenas o que sabe que precisa. Esses arquivos empacotados podem conter tudo, desde instruções adicionais de markdown até ativos de imagem e trechos de código que o Claude pode executar.
Tudo bem, então veja isto. Aqui está um exemplo de como funciona. Então, digamos que você administra uma empresa e tem diretrizes de marca. Você coloca suas diretrizes de marca lá. Você tem uma pasta skill.md e recursos. Você junta tudo neste pequeno arquivo zip. Em seguida, você o carrega como uma skill e agora o Claude tem acesso às suas diretrizes de marca sempre que você fala sobre branding. Então, é claro, minha empresa está trabalhando em um novo jogo emocionante. Ajude-nos com o pitch deck criativo e verifique a skill de diretrizes de marca. Ele a encontrou e agora pode carregar os ativos. Ele pode carregar as instruções e qualquer outra coisa que precise para ajudar a criar diretrizes de marca. E novamente, você não precisa carregar isso em todas as janelas de contexto. Ele apenas sabe procurar por isso. Então, eu acho isso muito legal. Eu ainda não tive a chance de verificar. Se você quiser que eu crie um tutorial completo sobre isso, me avise nos comentários. E se você gosta de construir com agentes, confira o patrocinador de hoje, Stack AI. Agentes de IA são o futuro do trabalho, mas a maioria das equipes não sabe como construí-los. É aí que entra o Stack AI. É o kit de ferramentas corporativo para construir agentes de IA seguros e poderosos rapidamente. Você pode começar com um modelo pré-construído, conectar sua base de conhecimento, executar RAG e OCR. Escolha seu LLM favorito e você pode escolher entre mais de 100 ferramentas integradas nativamente. Você pode até exportar com sua própria interface de usuário, senhas, SSO, URLs de origem, tudo. E é compatível com SOC 2, GDPR, HIPAA com proteção de PII integrada, sem treinamento em seus dados e guardrails. A melhor parte é que você apenas digita o que deseja e deixa a plataforma fazer o resto. Ela construirá exatamente o que você precisa. Portanto, se você precisar de agentes para TI, jurídico, finanças, pesquisa, tudo apoiado por uma infraestrutura segura construída com Stack AI. Experimente o kit de ferramentas corporativo hoje. Deixarei um link abaixo. Diga a eles que eu os enviei. Isso nos ajuda a construir o canal. E agora de volta ao vídeo. Tudo bem.
Em seguida, em algo que provavelmente todos esperávamos, Poly Market diz: "General do Exército dos EUA admite ter usado ChatGPT para tomar decisões de comando chave." E isso viralizou completamente. 7,5 milhões de visualizações. Tudo bem. Agora, há muito o que analisar aqui. Agora, se o general está simplesmente perguntando: "Quem eu ataco?" Isso não é bom. Mas se ele está usando o ChatGPT para ajudá-lo a entender todas as diferentes opções, a coletar informações, a pensar em diferentes permutações do que poderia acontecer em certas situações, eu realmente acho que isso é uma coisa boa. É para isso que eu uso. Agora, é claro, meus casos de uso não são de vida ou morte, mas usar o ChatGPT para ter uma melhor noção do campo de batalha, para ter uma melhor noção de todas as opções potenciais, eu realmente acho que isso é bom. E alguém perguntou a Grok, o que você acha? Ferramentas de IA como o ChatGPT podem gerar ideias ou resumir dados rapidamente, o que pode auxiliar na tomada de decisões. No entanto, para comandos militares críticos, confiar em saídas não verificadas de modelos de propósito geral convida riscos como alucinações, vieses ou vazamentos de segurança. O julgamento humano, apoiado por IA especializada focada na verdade, permanece essencial. XAI prioriza essa confiabilidade sobre o hype. Então, Grok essencialmente ecoa o que eu disse, que é usá-lo para coletar informações, usá-lo para sintetizar informações, verificar as saídas e, em seguida, para decisões chave, para a verificação e tomada de decisão real, isso precisa permanecer com os humanos. Use a IA para coletar informações, para sintetizar informações e, em última análise, a decisão e a verificação precisam estar nas mãos humanas, humano no circuito. Tudo bem.
Em seguida, a OpenAI está visitando empresas para propor o uso de um botão "entrar com ChatGPT". Muito semelhante ao que já temos com "entrar com Google", "entrar com Apple", mas agora "entrar com ChatGPT". Obviamente, isso tem muitos benefícios para a OpenAI. Eles obtêm seu pixel, seu botão em muitos sites diferentes. Eles obtêm todos esses dados de telemetria adicionais. Mas uma parte interessante da proposta, de acordo com as informações, é que as empresas que concordam podem transferir o custo de uso dos modelos de IA da OpenAI para seus clientes. Muito interessante. Portanto, à medida que o ChatGPT continua a se infiltrar em todos os tipos de sites tradicionais, aplicativos tradicionais, todo esse custo de computação, todo esse custo de inferência está sendo pago pelo editor, pelo desenvolvedor do aplicativo. E agora, digamos que eu tenha uma conta ChatGPT Pro. Posso fazer login em um site e usar minha própria conta ChatGPT Pro. Portanto, não apenas o editor ou desenvolvedor do aplicativo não precisa pagar por mim, mas eu posso realmente obter um modelo de maior qualidade porque é para isso que estou pagando com o ChatGPT Pro. Então, eu realmente acho que isso é super inteligente por parte da OpenAI. E, claro, tenho falado muito sobre risco de plataforma ultimamente. E sempre que você está construindo parte de sua infraestrutura sobre outra empresa, e especialmente a OpenAI ultimamente, há sempre esse risco de plataforma inerente. Se a OpenAI decidir mudar suas regras e, de repente, seu site não estiver em conformidade com suas regras e eles desativarem esse botão de login, talvez uma grande parte de sua base de usuários não consiga mais fazer login facilmente e eles tenham que mudar. Então, novamente, há muito o que pensar, mas da perspectiva da OpenAI, faz muito sentido.
Tudo bem, em seguida. Isso foi hilário. Então, 50 pessoas em São Francisco foram para uma rua sem saída ao anoitecer e pediram Wimos, e todos eles pediram para o final desta rua sem saída. E, claro, a consequência, todos eles ficaram presos. Aqui estão algumas imagens disso. Você pode ver todos os Wimos esperando na fila. Eles não podem fazer nada. Na verdade, descobri que os Wimos em ruas sem saída realmente lutam e levam muito tempo. Eu estava hospedado em um Airbnb em São Francisco há alguns meses. Pedi um Airbnb para esta rua sem saída e levava tipo 30 segundos ou 60 segundos para ele descobrir como simplesmente virar e ele não se movia. Ele apenas esperava lá enquanto descobria e depois se movia. Então imagine isso vezes 50. Aqui está outra imagem disso. Olhe para todos esses pobres Wimos presos no canto aqui. Mas eu acho isso hilário e Riley chamou isso de o primeiro ataque DOS de Wimo.
Tudo bem, em seguida. O V3.1 está disponível. Este é um pequeno salto de versão, mas muitas atualizações interessantes. Com o V3.1, estamos trazendo áudio para as capacidades existentes para ajudá-lo a criar a cena perfeita. Com ingredientes para vídeo, você pode usar várias imagens de referência para controlar personagens, objetos e estilo. O Flow usa seus ingredientes para criar uma cena final que se parece exatamente como você imaginou. Então você também pode controlar a cena do início ao fim. Então, forneça uma imagem inicial e final com quadros para vídeo. E isso permitirá que você conecte vários vídeos e realmente obtenha um comprimento de vídeo ilimitado. Agora você pode criar vídeos com duração de um minuto ou mais. Cada vídeo é gerado com base no último segundo do seu clipe anterior, tornando-o mais útil para criar tomadas estabelecidas mais longas. Você também pode inserir elementos em uma cena existente. Algo que vi pela primeira vez com o Genie 3. Você também pode remover objetos e personagens indesejados de uma cena. Muito legal. Temos testado levemente, ainda não extensivamente. Acho que algumas pessoas estão tendo muito sucesso com isso, sendo melhor que o V3, e algumas pessoas dizem que não é muito melhor, se é que é. Me diga o que você acha nos comentários.
Tudo bem, falando em modelos de vídeo, o Sora recebeu algumas atualizações. Primeiro, storyboards agora estão disponíveis na web para usuários Pro. Você pode pensar nisso como o Flow do Google para o V3 é storyboards para Sora. Todos os usuários agora podem gerar vídeos de até 15 segundos no aplicativo e na web. Usuários Pro de até 25 segundos. Então, apenas algumas atualizações rápidas sobre Sora.
Em seguida, estamos na era dos modelos de IA descobrindo ciência nova. Esta é a parte mais emocionante da IA para mim hoje. Sundar, o CEO do Google, um marco emocionante para a IA e a ciência. Nosso modelo de fundação C2S scale 27B, construído com Yale e baseado em Gemma, então open source com pesos abertos, gerou uma hipótese nova sobre o comportamento celular do câncer que cientistas validaram experimentalmente em células vivas. E a parte mais emocionante é que esses modelos são limitados apenas pela quantidade de computação que podemos dedicar a eles. E, portanto, se é uma função de quanta computação podemos dedicar para resolver o câncer, devemos dedicar o máximo possível. Assim, com mais testes pré-clínicos e clínicos, essa descoberta pode revelar um novo caminho promissor para o desenvolvimento de terapias para combater o câncer. Muito legal, Google.
Tudo bem. Em seguida. A Androll parece estar trazendo nossos militares para o futuro. Eles acabaram de lançar o Eagle Eye, que é um capacete futurista completo que os militares usarão. Então, o Eagle-Eye oferece a visão aérea definitiva através de uma mesa de areia 3D colaborativa. Este é apenas um exemplo do que ele pode fazer. Vou mostrar mais alguns. Execute ensaios de missões remotas, integre feeds de vídeo com reconhecimento de localização, coordene movimentos, vença a luta. Então, aqui está outro vídeo de demonstração. E novamente, parece um videogame, mas não é. Isso é realmente realidade aumentada para nossos militares. E como você pode ver, ele tem um pequeno minimapa no canto inferior esquerdo. No canto superior direito, temos todas essas atualizações de status. Também temos o que você obtém em Assassin's Creed. Então, se você tem um objetivo de missão, você pode vê-lo em vermelho aqui e verde. É tão legal. Legal. E então no canto inferior direito você obtém vídeo. Eles estão realmente pegando a estética e a funcionalidade de videogames e tornando-as realidade. É tão incrível. Aqui está outro exemplo. Até o sistema de menu, como ele se parece. Juro que é direto de Call of Duty. Mas aí vamos nós. Você pode ver que ele está rastreando inimigos. Você tem aliados aqui. Ele rastreia atrás do carro. Tão legal.
Tudo bem, em seguida. Jeff Bezos diz que os data centers podem estar se movendo para a órbita e há uma série de benefícios. Um deles é a energia solar constante, outro é que é bastante frio lá em cima e você pode não precisar de tanta energia para resfriar esses sistemas. Ouça este clipe. Uma das coisas que vai acontecer no futuro, é difícil saber exatamente quando, são 10 anos ou mais, mas aposto que não mais que 20 anos. Vamos começar a construir esses gigantescos data centers de gigawatts no espaço. Então, esses gigantescos clusters de treinamento, eles serão melhor construídos no espaço porque temos energia solar lá 24 horas por dia, 7 dias por semana. Seremos capazes de superar o custo dos data centers terrestres no espaço nas próximas décadas. E, portanto, o espaço acabará sendo um dos lugares que continuará a tornar a Terra melhor. Já aconteceu com satélites meteorológicos. Já aconteceu com satélites de comunicação. O próximo passo serão os data centers e depois outros tipos de fabricação. >> Isso é tão legal de pensar e faz sentido. Há apenas uma desvantagem potencial. Será incrivelmente caro construir um data center no espaço. E esse custo pode superar o custo de simplesmente construí-lo aqui e alimentá-lo na Terra.
Tudo bem. Em uma visualização que achei muito legal e quis compartilhar com vocês. É assim que o Cloud Code se parece ao navegar pelo seu código-base. Veja isto. O nó azul que você está prestes a ver é o Cloud Code navegando e explorando seu código-base. Aí está. Este cara bem aqui, passando por todo o seu código, explorando todos os diferentes arquivos, todos os diferentes diretórios, e apenas aprendendo conforme avança. Eu simplesmente achei essa visualização muito divertida de assistir.
E por último, um novo artigo tenta definir o que é AGI realmente, porque tem sido um alvo móvel. Houve várias definições diferentes. Mesmo de uma única empresa, as definições têm mudado. Então, este é Dan Hendris. O termo AGI é atualmente um objetivo vago e móvel. Para fundamentar a discussão, propomos uma definição abrangente e testável de AGI. Usando-a, podemos quantificar o progresso. O GPT4 estava a 27% do caminho para a AGI. O GPT5 está a 58%. Parece que estamos bem perto. Então, nossa definição de AGI é uma IA que pode igualar ou exceder a versatilidade e proficiência cognitiva de um adulto bem-educado. Para medir isso, avaliamos múltiplas dimensões de inteligência derivadas do modelo mais empiricamente validado de inteligência humana, a teoria CHC. Então, aqui estão algumas das categorias que entram nisso. Conhecimento geral, leitura e escrita, matemática, raciocínio imediato, memória de trabalho, armazenamento e recuperação de memória de longo prazo, visual, auditivo e velocidade. Por exemplo, se um modelo não tem memória persistente, ele pontuará 0% em armazenamento e recuperação de memória. Confiar em janelas de contexto massivas é uma contorção de capacidade, uma solução alternativa que mascara essa limitação fundamental. Então, a propósito, se você quiser que eu faça uma análise completa deste artigo, me avise nos comentários.
Então, é isso por hoje. Obrigado a Stack AI. Confira-os. Eles são um ótimo parceiro para nós. Link na descrição abaixo. Clique nele. Diga a eles que eu os enviei. Se você gostou deste vídeo, por favor, considere dar um like e se inscrever. E eu te vejo no próximo.