Transcrição do Episódio 0:00 [música techno] Fala pessoal! 0:09 Direto da maior comunidade de ciência de dados do Brasil, a gente traz o Data Hackers News, as notícias mais quentes da área de dados, AI e tecnologia, direto do podcast Data Hackers. 0:19 Eu sou Monique Femme e junto comigo eu trago ele que a gente tava morrendo de saudade, o Paulo Vasconcelos, pra gente falar do que tá bombando essa semana. E aí, Paulo, como que cê tá? Fala Monique! Fala aí, pessoal. 0:32 De volta da terra dos Tio Sam. [som de tapa] [riso] Com saudade de comer uma feijoada, um arroz com feijão, mas tô de volta aqui- Olha! [riso] Pra gente falar dessa notícia que movimentou bastante a semana, né, Monique? 0:42 Semana passada ali já tem várias novidades aí que a gente vai trazer pra essa semana aqui. Exatamente. E 2023 só tá acabando, mas parece que 2024 já começou. Só que a gente só não foi avisado, né Paulo? 0:53 Exatamente, é, isso é verdade. 0:55 Ainda mais essa semana, Monique, o que tá rolando aqui na comunidade, vamo botar, científica, vai sair o-- tá saindo não, vai começar essa semana o NeurIPS, que é a maior conferência, uma, tipo assim, das, sei lá, top três maiores conferências de inteligência artificial, sabe? 1:10 Que a gente tem aí de machine learning, sendo-- onde lançam vários, várias notícias assim, várias novidades, muitos trabalhos legais. 1:18 Então a gente tá gravando aqui na segunda-feira, mas é provável que até o fim da semana tenha muita novidade aí, que a gente vai trazer onde, né? 1:23 Claro, na newsletter do Data Hackers, então cê tem que ficar ligado lá no datahackers.news pra saber essas e outras notícias que a gente vai falar também. Exatamente. 1:31 E a gente já deu até alguns spoilers de algumas coisas que vão acontecer essa semana, né? E que a gente traz ali também no próximo Data Hackers News, né? Boa! [música techno] Bora pras notícias, Paulo? 1:48 Vamo simbora, Monique, porque olha só, todo mundo aí que trabalha em tecnologia, acho que até quem não trabalha em tecnologia ficou sabendo, que essa semana passada teve o lançamento do Google Gemini, né? 1:58 Que é o mo-- a inteligência artificial mais avançada do Google. 2:01 Mas uma coisa que a gente quer trazer aqui não é o lançamento dela, mas o fato do vídeo de demo, do vídeo de exibição que foi feita, es-- mostrando as capabilities, né, da IA, ele foi encenado, né? 2:12 Não era um vídeo de interação real, né, ali. É, e pra quem não sabe, é, o Google finalmente mostra ali o seu grande concorrente do ChatGPT, que é o modelo de, de LLM, né? 2:23 Que promete ser a AI mais avançada do momento, né? 2:28 E ao contrário do que se pensava, especulações ali das últimas semanas, né, o Google decidiu ali essa questão de lançar esse modelo, que tem três principais tamanhos, né? O Nano, o Pro e o Ultra. Sim. 2:41 Mas como o Paulo já disse aqui, o que tá dando o que falar é que tem um vídeo rolando aí de demonstração, ali tanto técnica quanto prática, desse novo modelo de inteligência artificial, que deixou de ser o assunto mais quente do momento e passou a ser acusado ali por críticos de ser, alguns falam basicamente falso, outros de vídeos que tá sendo manipulado, que tá movimentando essa discussão, né Paulo? 3:06 Ô Monique, vou te falar a real, eu queria que esse fosse o maior problema do Google Gemini, tá? [riso] Olha! 3:11 Eu queria que esse fosse-- eu queria que todo o problema que ele tivesse fosse realmente: "ah, meu Deus, o vídeo que mostraram não era verdade". [riso] Mas, sinceramente, tem problema muito piores assim. 3:20 Um ponto é o seguinte: quando eles anunciaram o Gemini, eles anunciaram um paper. 3:24 Um paper, não, um report técnico, né, que agora essas empresas não fica mostrando mais a tecnologia por trás, faz um report técnico do que faz. 3:30 No report técnico, eles já falavam, e no post de lançamento já falavam que o vídeo foi realmente, é, encenado, né? É um vídeo que, que mostrou algumas interações. 3:40 Então não foi alguém que descobriu assim: "meu Deus, olha, Google tá escondendo da gente". Já tava lá no post. Exatamente. 3:45 No paper, inclusive, eles falam quais prompts eles utilizaram em cada uma daquelas interações, né? 3:50 Pra quem não viu o vídeo ainda, tá disponível no YouTube aí, cê-- a gente colocou também no, na newsletter do Data Hackers. É, mostrando um pouco dessa interação. 3:56 E a gente sabe que demo de produto ele geralmente é mais ensaiada mesmo, que é pra mostrar as capa, as capabilities, né, do pro, do pro, do produto, as possibilidades e tudo mais. 4:05 É pruma pes-- um público até ma-- menos técnico que é aquele, aquele ponto. Só que quais são os problemas que eu vejo do Gemini, tá? 4:11 O primeiro ponto dele é que o Ultra, que é aquele mostrado no vídeo, ou seja, o modelo mais poderoso, ele não tá disponível. 4:17 Eles nem planejam o lance de deixar esse modelo disponível por enquanto, não deixou nada claro, né? O Bard, que é o principal produto, né, competidor ali do ChatGPT, não vai usar o Ultra, ele vai utilizar o Pro. 4:28 A minha especulação aqui, minha hipótese, é que esse Ultra tá tão caro de você usar. [riso] Vai ser tão caro de você colocar a nível em massa, né, pra toda a base, que não dá pra você utilizar, né, dessa forma. 4:40 Então esse foi um dos problemas. Outro problema é a forma como eles avaliaram a ca-- a habilidade do modelo, né? 4:45 Ele foi muito cla-- ele foi muito comparado ao, ao GPT-4, né, que ele é o principal concorrente, é o GPT-4 dele. 4:51 É, só que as métricas que eles utilizaram pra classificar, pra-- de benchmark, né, não foram, vamo botar assim, não-- eles não tavam comparando maçã com maçã, sabe? Eles tavam comparando maçã com laranja ali. 5:01 Então não tava legal isso. Então, como eu falei, quem dera só o problema dele fosse: "ah, não, eles mostraram o vídeo errado", mas- Exatamente. 5:08 É, o Gemini ele teve um, né, ele teve um boom muito grande, um buzz muito grande, ele tá começando a perder aquele, aquela tração dele. 5:16 O pessoal tá começando a olhar aquilo como um flop da, da Google, não como uma, não sei, uma tecnologia em potencial. 5:22 É, e é importante cê ressaltar isso, né Paulo, porque a gente acaba entrando numa questão midiática, né? Até mesmo porque o próprio vídeo é um vídeo comercial, então já se espera ter ali algumas ações nesse sentido. 5:35 E é um pouco do que você mesmo mencionou, né? Porque as discussões que deveriam ter es-- tá sendo discutidas nesse exato momento, não estão sendo discutidas, né? E a gente parte numa camada muito superficial, né? 5:46 Exato, assim, o pessoal técnico, vamo botar assim, cientista de dados, engenheiros de machine learning, provavelmente não vão trocar o GPT-4 pelo Gemini, por conta desses e outros problemas que, que tiveram aí, né? 5:57 Assim, eu acho que o pessoal da Google é muito mais do que capaz de criar uma, um modelo forte, assim, um modelo bem poderoso. Só que a comunicação realmente foi meio estranha, né, assim. 6:07 E as comparações que o pessoal queria fazer, principalmente com o GPT-4, não foram tão legais assim. Assim, eu fico feliz com o lançamento do Gemini porque é mais um competidor na arena forte, né? 6:17 A gente tá falando simplesmente da Google. Exatamente. Que tem a capacidade de criar coisas de forma incrível. Então assim, eu tô feliz e vê, mas acho que a gente vai ver uma evolução do Gemini nos próximos meses assim. 6:29 Enquanto, por enquanto o lançamento não me animou muito, não. Não me animou muito não. [riso] Muito bom saber o seu ponto. 6:37 [riso]É, Paulo, e outra notícia que tá dando o que falar ali, ninguém esperava por isso nesse exato momento, é que a criadora do Stable Diffusion pode ser vendida. 6:51 Isso porque, em 2022, a Stability AI alcançou ali os status ali de empresa unicórnio, né, que arrecadou mais de cento e um bilhões de dólares ali com a promessa ali dos investidores, de ser o software que pudesse gerar ali imagens através de prompts, que pudesse ser impressionantes e toda aquela história que a gente já conhece. 7:14 Sim. E aí toda essa discussão, hoje em dia, tá pautada ali nas despesas que a própria empresa tá tendo, né, incluindo ali as contas de folha de pagamento. Sim. 7:23 Que superaram a sua receita e que tá ali no comparativo de, de ter gastado nos últimos meses, principalmente, mais de oito milhões por mês em contas de folha de pagamento. Olha aí. 7:36 Considerando que de receita gerada, eles tiveram um ponto dois milhões ali em agosto. Uhum. 7:43 Quando, na verdade, existia uma projeção de três milhões, né, de dólares ali para novembro, comparando a questão da usabilidade do software e serviços. Então a conta aí não tá fechando, né, Paulo? É isso aí, Monique. 7:58 Então, eu queria ter escre-escrito isso em algum lugar pra poder falar agora que eu tinha previsto isso. Olha! 8:04 Mas uma discussão que eu fazia com o pessoal muito era de que, das empresas, das AI companies, acho que uma das primeiras, essas grandes que seriam vendi-- seria a Stability mesmo, por alguns motivos, tá? 8:14 Só lembrando, a Stability foi-- revolucionou no... Cara, a linha do tempo de IA tá tão confusa que eu não lembro se foi ano passado ou ano retrasado, mas eu acho que foi ano passado. 8:23 Que tipo, eles tiraram, eles conseguiram tirar totalmente o foco do DALL-E, do DALL-E 2, da, da OpenAI ao lançar o Stable Diffusion, que era um modelo open source com a mesma capacidade de geração de imagem. 8:34 E realmente era muito impressionante, né? O modelo, acho ele um dos, dos melhores modelos, é o melhor modelo open source que a gente tem. 8:40 Só que eu já vinha vendo algumas notícias falando da dificuldade que eles tavam tendo em monetizar a solução. Olha. Né? 8:46 Por exemplo, eles têm ali uma plataforma que cê pode comprar, você pode assinar pra fazer, é, pra fazer geração de imagens e tudo mais. Só que eles tavam tendo essa dificuldade. 8:56 E olha, e, e pensando que assim, eles têm um, um, como se fala, o folha de pagamento deles é bem alta, assim, tem bastante gente trabalhando ali. E eu tava vendo essa, essa nu-- essa dificuldade deles achar. Exatamente. 9:07 O CEO é meio doidão também. Se você ver os vídeos dele na internet, ele é meio, meio, meio loucão. 9:11 Então eu imaginei que eles iam ter uma, uma certa dificuldade, porque realmente é difícil de monetizar, ainda mais quando ele fala de imagem, né? É caro você pro-pro-produzir imagem, né, processar imagem e tudo mais. 9:20 Então, é, assim, eu imaginava que ia surgir alguma coisa do tipo deles serem comprados ou coisa do tipo. E tem esse rumor aí rolando, né? 9:27 Provavelmente 2024 pode ser um ano aí de AI companies começarem sendo vendidas, né? E vamo ver como é que vai ser o impacto disso, né? 9:33 Que a gente não consegue nem imaginar o que será, será que vai ter uma leva de empresas de IA sendo vendidas, abrindo IPOs? Pois é. Não sei, vai depender da taxa de juro, uma série de fatores macroeconômicos aí também. 9:43 Mas tomara que seja uma boa notícia, né, de eles conseguirem manter o trabalho ali do Stable Diffusion. Eu gosto muito deles. Esse ano eles lançaram o Stable Diffusion XL lá, o XL, que é muito bom também. 9:53 É, e vai ser um baita de um, de um produto na mão ali também pra poder trabalhar, né? 9:57 É, o que eu vejo, eu acredito que não vai morrer, até porque já dentro desses rumores existem empresas que querem fazer a-ali aquisição e aí tem as especulações de negociações e tudo mais que tá acontecendo. 10:11 Existe também a questão de, do próprio CEO também ser, ser uma das pessoas que o próprio conselho ali tá tentando tirar. [riso] Né? Então lembra muito o caso da Work, né, lá atrás, pra quem acompanhou. 10:25 É, o Work era doideira. É bem hardcore, né? É hardcore. 10:30 [riso] Esse CEO, por exemplo, da Stability, não sei se cê lembra, mas teve um vídeo dele falando que não existiria desenvolvedores em, tipo, seis anos, alguma parada assim, sacou? [riso] Você vê no nível. 10:40 É, eu acho que ele utiliza aquela estratégia de engajamento da polêmica, né, que a gente fala ali de vez em quando, né? Pois é. Talvez seja a forma dele conseguir visibilidade e agariar mais dinheiro ali. 10:51 [riso] Mas brincadeiras à parte, né, eu acho que tem muito pra gente acompanhar. 10:56 Eu olhando ali as últimas notícias e também tudo que tá acontecendo, eu acho que o ano de 2024 já começa bem quente ali, de rumores do que pode acontecer, mas tem muito que rolar, né, Paulo? Total, total. 11:09 E você sabe onde cê tem que ficar acompanhando isso, né? Data Hackers News, Newsletter do Data Hackers. Exatamente. Não deixa de seguir a gente não, rapaz. É isso. 11:23 Vamos simbora pra última notícia daqui que o ChatGPT, ele acaba de ganhar um competidor aí de peso, hein? Acaba de ganhar um competidor brasileiro. Brasileiro. Que é o tal da Maritaca AI, né, que tá disponível aí, né? 11:33 Como é que é o negócio? É, Paulo. E o Maritalk é ali o chatbot baseado em LLM, que tá gratuito pra você poder utilizar. 11:43 Ele é treinado ali pra atender as necessidades do Brasil, conforme a própria plataforma já diz, que pode ser usado gratuitamente também em português e que promete melhor qualidade e menor custo. Uhum. Né? 11:57 Uma das coisas que a gente acaba discutindo aqui, a gente já falou várias vezes aqui no Data Hackers News. Sim. 12:02 E o Maritalk é uma solução de uma startup chamada Maritaca AI, de alguns brasileiros ali que se reuniram pra poder criar essa solução, onde eles se colocam ali, até mesmo dentro do site deles, como uma startup brasileira focada em especializar modelos de linguagem para domínio de di-idiomas específicos, né? 12:24 Garantindo que sejam eficientes, implementando e reflita o conhecimento único de diversos setores. 12:31 E além de usar ali os modelos de API, né, você também pode hospedar esses dados localmente, né, permitindo que essas contagens em tokens sejam consumidos e que vá também pros servidores deles ali de uma maneira mais segura, né? 12:48 Então é um pouquinho do que a gente vê de avanços ali de, de soluções que tão acontecendo, né? E que que cê acha, Paulo? 12:55 Não, eu acho muito legal assim a, a, o pessoal que tá por trás também, esses pesquisadores que têm feito muito estudo legal assim aplicando LLMs em contexto brasileiro, como por exemplo, pegar e aplicar o Enem pra ver qual é a qualidade desse modelo pra responder perguntas do Enem. 13:08 Exatamente. É, a gente tem ali, né, o fundador e o CEO ali, é o Rodrigo Nogueira, que é um dos coinventa-- é, coinventores do Bertimbau, que é o, a versão brasile-- português, né, do, do Bert. 13:19 Isso aí a gente tá falando de anos antes de explodir, é, ChatGPT, explodir essas, esses modelos de, de linguagem. E é legal, assim, a gente ter uma opção, né, brasileira. 13:28 Eu testei, fiz alguns prompts ali, testei rapidamente. Então é uma solução que tem muito potencial. Realmente ela é bem mais barata, né, ali pelo pricing ali que a gente, é, que a gente, que eles deixam disponíveis. 13:39 É, não tem muita informação sobre rate limit, né, então quantas chamadas você pode fazer. 13:42 Então isso dificulta saber um pouquinho a escalabilidade que a gente pode trazer pra esse tipo de solução, pro ambiente corporativo, né, o ambiente empresarial ali também. 13:50 Mas assim, é um primeiro passo muito legal que a gente tá vendo de uma empresa brasileira aí, né? Exato. 13:53 Aplicando, trazendo esses modelo da, da moda aí também para a ponta, né, pra os desenvolvedores, para pessoas que querem aplicar um contexto mais próximo ali do português também. Então bem legal aí. Que legal, Paulo. 14:04 Pode ir. É, tem muita coisa ainda pra gente poder falar, mas a gente traz na próxima semana aqui pra vocês no Data Hackers News. 14:17 E se você ainda não acessou a nossa newsletter semanal, que sai toda segunda na sua caixa de e-mail, é só acessar datahackers.news e você se inscreve pra receber essa e outras notícias e tudo que tá rolando na área de dados aí na sua caixa de entrada. 14:33 E aí, Paulo, bora se despedir? Vambora! Valeu demais, galera. E lembra-se de compartilhar o Data Hackers aí com seus colegas no WhatsApp. Tem um botãozinho de compartilhar aí no Spotify. 14:42 Já segue a gente se você não seguir. E a gente se vê no próximo episódio. Valeu, valeu, Monique. Valeu! A gente se encontra e até mais. Fui. 14:59 [música de encerramento] Esse podcast foi editado por Aerolitos, edição inteligente. [música de encerramento]