Transcrição do Episódio 0:00 [música de introdução] Diretamente da maior comunidade de ciência de dados do Brasil, a gente traz o Data Hackers News, as notícias mais quentes da área de dados AI e tecnologia, direto do podcast Data Hackers. 0:19 Eu sou Monique Femme e junto comigo eu trago ele, Paulo Vasconcelos, pra gente poder discutir as notícias dessa semana. E aí Paulo, como que cê tá? Fala Monique, fala pessoal, beleza? 0:30 Mais uma semana começando aí, semana de polêmica, hein? Temos duas notícias polêmicas aqui nesse, nesse episódio de hoje. Tô animado pro que a gente vai falar aqui, trazendo novidade pra galera. 0:39 É, e eu já vou soltar a polêmica aí, porque eu quero saber se a gente teve evolução no State of Data 2023, que a gente subiu lá no Kaggle os dados. Quero saber qual é o ranking que a gente tá ali das medalhas, hein? 0:51 Ó, vou a-ao vivaço agora ver os dados aqui, dados atualizados de segunda-feira. Olha, a gente tá com medalha de prata no nosso dataset- Olha! Do State of Data Brasil, né, 2023. É, noventa e quatro up votes, Monique. 1:05 Só que o Kaggle ele é meio, ele é meio-- ele é fogo, porque ele não considera todos os up votes, você tem que ser, não pode ser novato pra, pra votar. 1:13 Acho que é pra evitar que tenha aqueles robôs que ficam votando up vote nas coisas. Mas a gente tá quase, galera, tamo quase com, é, chegando à medalha de ouro. 1:22 A gente conseguiu medalha de ouro nos outros anos aí, né, Monique? Exatamente. E aí precisamos da sua ajuda aí pra gente chegar de novo nessa, né, nessa conquista aí. É isso aí. 1:32 Enquanto a gente não chega lá, bora pras notícias dessa semana. É isso. 1:38 [música de introdução] A gente já começa o Data Hackers News citando novamente a Figma, que anunciamos na semana passada, mas dessa vez com uma polêmica envolvida, onde a Figma cancelou sua ferramenta de inteligência artificial. 1:53 Como é que é o negócio? Isso mesmo. 1:55 A nova ferramenta da Figma, a Make Designs, que permitia que os usuários criassem rapidamente modelos e aplicativos u-usando AI generativa, foi retirada do ar depois que a ferramenta elaborou alguns designs muito semelhantes ao aplicativo de clima da Apple. 2:13 E depois de algumas discussões ali no próprio X e também respostas do próprio CEO da Figma, a grande questão agora é querer entender de quem é a responsabilidade dos treinamentos desses modelos. 2:24 Os principais modelos de inteligência artificial que impulsionaram o Make Design são providos pela OpenAI e pela Amazon. 2:31 E se for verdade que o Figma não treinou suas ferramentas de AI, mesmo gerando réplicas semelhantes aos aplicativos da Apple, isso pode sugerir que os modelos da OpenAI ou da Amazon estão sendo treinados pelos designers da Apple. 2:45 Que confusão, hein, Paulo? E aí, o que que cê tem a dizer sobre isso? 2:48 Não, eu vou criar uma regra, Monique, que agora a gente vai ter que esperar uma semana da, da novidade ser anunciada antes da gente trazer pro Data Hacker News. 2:56 Porque não deu, cara, não deu nem uma semana que foi que a gente anunciou a novidade da Figma. 3:01 A gente falou semana passada que eles anunciaram e na sexta-feira, assim, eles já tinham tirado do ar a, a ferramenta por causa dessa, dessas críticas que recebeu ali, né? Doideira que, que isso foi. 3:11 Mas assim, uma coisa que chama a atenção, né, primeiro é que eles não treinaram mesmo o seu modelo, né? 3:17 O que tá-- o que acontece bastante em empresas, né, muitas empresas que f-falam de funcionalidades de IA, nada mais é do que um, um, uma embalagem ali, né, um wrapper de OpenAI, desses modelos da Amazon também. 3:30 Mas assim, essa investigação ela é complicada de fazer, né, se tu para pra pensar, porque vamo lá, a Apple ela é um bastião do design no, no mundo todo. Uhum. 3:40 Muita gente copia o design da, do, da Apple em vários dos seus aplicativos, né? 3:45 Então eu não duvido nada que assim, o dado que esse modelo foi treinado, foi de uma pessoa, de um designer fazendo um sketchzinho, fazendo um projeto pessoal, fazendo uma brincadeira ali, de tipo um, criar esses aplicativos e o modelo acaba aprendendo isso. 4:00 Talvez nem tenha, tipo assim, dado do, de designer da Apple mesmo ali, ma-mas de alguém que copiou isso, colocou na plataforma, que foi depois coletado o dado pra treinar es-esses modelo, né? 4:11 Então assim, provavelmente vai demorar pra essa, essa funcionalidade voltar, né? 4:15 Pelo menos essa do, é, esse do Make, do Make Design, mas é uma situação complicada aí pra, pra Figma, que, que sofreu essa, essas críticas aí, né? 4:24 É, porque uma das funcionalidades, né, de utilizar a ferramenta ali através de AI generativa, é poder gerar ali alguns recursos, né? Tudo bem que a gente tem ali uma, é, vai ser captado de alguma base de dados, né? 4:36 Mas a questão é, é a grande semelhança com algo já pré-existente, ainda mais questões relacionadas ali à Apple, né? Uhum. E aí é ver aonde que isso vai parar. E agora tem essa discussão ali de quem que é a culpa, né? 4:48 De quem é a responsabilidade, né, do modelo. Cara, é, gente, esquece o que eu ca-- eu falei. Eu tô revendo a imagem aqui da, da Apple. [risos] Cê viu, né? É muito semelhante. 4:58 Ô, Monique, é cuspido, é cuspido e escarrado isso daqui, cara, não tem como não. Isso aqui... Cara, tá muito igual. Ficou bonito, ficou bonito, mas realmente tá muito parecido com, com, com o da Apple aqui. 5:10 É idêntico, é cuspido, né, como diz, né? Não, exatamente. E assim, é, 5:16 é complicado, né, esses tipos de, de novidade que tem esse, esse impacto, quando uma pessoa começa, começa a mexer, começa a testar, acaba batendo nesse tipo de demo-- de problema. 5:27 É, mas vamo ver aí se a Figma vai decidir treinar o seu próprio modelo, se vai continuar usando. Treinar o meu próprio modelo eu acho que não, mas pelo menos tentar diminuir esse problema de acontecer no futuro, né? 5:37 Mas com certeza eles vão esperar um pouquinho a poeira abaixar antes de voltar pra essa, esse tema. Exatamente, até porque o próprio CEO da Figma disse que nunca foi a intenção deles ali, né? 5:47 Por isso que eu acho que surgiu essa responsabilidade tanto pra OpenAI quanto da própria Amazon, né? Porque existe uma polêmica aí envolvida. 5:55 Mas vamo aguardar aí os próximos rumores e o que pode acontecer e saber se realmente eles vão, é, trazer de novo essa funcionalidade voltada à inteligência artificial para as ferramentas aí do Figma, hein? 6:10 E vamo pra segunda notícia, onde a Eleven Labs usará voz de celebridades que já faleceram para ler audiobooks. Já avisei que vai dar merda isso. 6:21 Parece bizarro quando a gente fala sobre o uso de acervos digitais de falecidos, mas a empresa de inteligência artificial Eleven Labs, aquela que virou manchete lá no início desse ano, por ter usado ali sua ferramenta pra criar uma falsa chamada automática do presidente Joe Biden, é a empresa que traz um novo burburinho pro mercado, né, Paulo? 6:41 Isso porque a Eleven Labs tá trazendo dublagens de celebridades produzidas digitalmente de atores falecidos. 6:50 A empresa disse que o aplicativo pega artigos, PDFs, boletins ou qualquer outro texto e transforma em dublagens. 6:58 A gente já falou aqui sobre várias polêmicas geradas pelo uso de voz e também que envolve o direito autoral, mas eu quero saber, Paulo, se você acha que essa é daquelas notícias que a gente vai voltar aqui pra dizer que deu ruim, hein? 7:11 [risos] Excelente ponto, excelente ponto. Olha, eu vou te-- vou ser honesto, eu não sei o que sentir sobre uma notícia dessa. Sinceramente, eu li a notícia- Uhum. 7:20 Tá lá, Eleven Labs vai usar a voz de atores que já morreram pra narrar audiobooks. 7:25 Eu não-- sinceramente, eu não sei o que se-- o que sentir, pa-é muito estranho uma notícia dessa assim pra mim, parece uma notícia de ficção científica mesmo, sabe? Olha. E, assim, eu não acho que vai ter- Uhum. 7:35 É, tanto problema quanto teve com, sei lá, o OpenAI com a Scarlett Johansson, coisas do tipo, porque a, a própria notícia fala que a, a Eleven Labs, ela entrou em contato com as, os agentes que representam os interesses desse, vamo botar assim, desse, de atores, né? 7:51 E chegaram a um acordo ali. Então assim, eu acho que não vai ter nenhum backlash, tipo, cês voltarem: "galera, cês tão usando voz aí sem ter direito autoral". Eles têm o direito. [risos] Né? 8:01 Mas, cara, será que daqui a pouco a gente vai ter mais pessoas, Monique, que vai ter que fazer igual ooo... Igual o caso da Elis Regina, né? Que utilizaram todos os acervos digitais dela. 8:12 E aí existe ali uma polêmica, né, se a família realmente poderia ter a autorização, se a pessoa, né, depois de morta, sei lá, autorizaria também, né, utilizar ali os seus acervos digitais pra questões ali comerciais, né? 8:25 Exatamente. Eu esqueci o nome daquele do, do, um ator americano que era muito famoso, ele era comediante. Esqueci qual o nome dele agora, fugiu. 8:33 Que ele antes de morrer, né, infelizmente, ele, ele, ele morreu e antes de morrer, ele fez uma declaração falando que ele não queria que a voz dele fosse utilizada em nenhuma... 8:44 Na época não era inteligência artificial, mas era animação, filmes, né, é, ele não queria que nada disso fosse feito. E que é capaz que no futuro vai ter que começar, mais gente vai fazer isso também, né? 8:55 Pra se proteger de alguma forma, ou pelo menos, se for utilizar, que a família seja compensada de algum, de alguma forma, né, mas aí vai, acho que vai dar ponta má, acho, acho que vai chamar bastante a atenção do, da galera aí, que com certeza vai testar e procurar alguma coisa, mas vamo ver no que que isso vai dar. 9:13 Pois é, e a gente até anunciou aqui em outras notícias do próprio Theta Hackers News, né? Se eu não me engano, é na China, né, que tem um mercado já pra isso, né? 9:22 Onde a pessoa morre e aí o ente da família ali pega uma parte, um fragmento ali da voz- Ah, é E de-- e gera uma inteligência artificial onde ela pode conversar com a pessoa que morreu, né? Puta merda. 9:35 E é um mercado- No, God, please, no, no! É um mercado que, se eu não me engano, é, quando se iniciou lá atrás, para cada serviço dele custava em média ali mil dólares. 9:47 Caralho E agora, como tem outras empresas, é, e concorrentes, chegou ali agora uma bagatela de cento e noventa e nove dólares, tipo assim, entendeu? Caraca. 9:56 Reduziu tipo oitenta por cento ali do, do valor que era comercializado, né? Mas pra gente poder ver, né, onde a gente vai chegar, hein, Paulo. Ê Monique, eu lembrei o nome aqui, foi o Robin Williams. Iiisso. 10:06 Que infelizmente fale-faleceu e ele, que inclusive ó, que a galera que é gamer aí, a filha dele se chama Zelda, por causa do, do jogo Zelda, ele gostava muito de, de Zelda. Ah, é? 10:16 Ele batizou o nome da filha dele de, de Zelda. É, mas é, que doideira, é muito me-- Black Mirror isso, cara. Muito. Tipo, cê, a pessoa m-morreu e quer, e quer fazer a voz. 10:26 Ó, já vou deixar aqui registrado nesse episódio, galera, se eu morrer, não usa minha voz pra nada. [risos] Eu proíbo aí, já tá aqui gravado no podcast. É muito estranho isso, cara. 10:35 É, ca-causa uma tristeza muito grande pra mim, sei lá, não sei o que sentir sobre isso, não. Exatamente. Já pensou, Paulo, sua voz em um audiobook? Pô, aí talvez seja interessante. Não, não vai ser, ser não [risos]. 10:46 Não quero não. Sua voz em audiobook pode ser interessante, né? [risos] Eu só, eu só aceito a minha voz ser usada se for num, num filme biogra-- de biográfico do, do Brad Pitt. Pode colocar minha voz pra ser- Olha! 10:59 Interpretar o Brad Pitt, isso. [risos] Só essa, essa, essa é a única exceção. Essa é a única exceção. Pensando melhor, né, Paulo? Exato [risos]. 11:07 E aí já, já deixa aí registrado quem é que vai receber por isso, por favor, né, então- Exatamente. Pra não ter problema, hein. Mas enfim, né, vamo parar de falar aqui de, desse assunto de morte, né? 11:17 [risos] E vamo pra próxima notícia E a última notícia é que laboratório f-francês cria impressionante modelo de voz similar ao ChatGPT. 11:32 Em um evento realizado na última quarta-feira, em Paris, o laboratório de pesquisa de inteligência artificial chamado Q*Time, apresentou seu novo assistente de voz, o Moshi. 11:43 O assistente surge como um forte concorrente do ChatGPT da OpenAI, destacando-se por sua capacidade de expressar setenta diferentes emoções e estilos. O quê? 11:54 Uma inovação que promete transformar a interação entre humanos e máquinas. 11:59 Mas Paulo, eu confesso pra você, que o que mais me deixa encucada aqui nessa notícia, é saber qual é a relação de um laboratório francês com um nome que parece japonês, hein? [riso] Tem o menor sentido, né? 12:12 A gente até olhou antes da notícia aqui, foi ver: "Nossa, por que os caras se chamam Q*Time, se são, são já, é, franceses?" A gente entrou no site, procurou no, no- Qual é a relação, né? 12:22 Procurou no press release, a gente qui-a gente quis trazer essa informação, mas a gente não achou ne-- nada que faz sentido. 12:28 Mas, mas foi Monique, semana passada, isso foi bastante barulho aí na comunidade, lá no Twitter, fez bastante barulho lá. E tem nomes de peso por trás dessa, dessa tecnologia, desse laboratório, né. 12:39 Por exemplo, um, um dos, hã, das pessoas que tão contribuindo ali, um dos investidores que fizeram é o Eric Schmidt, que é o ex-presidente e funda-e fundador da Google. Olha! 12:49 Né, então assim, é um laboratório que tá chamando bastante atenção. E realmente, você vai ver a, você vê a demo do, do Moshi e é muito boa a qualidade. E é muito rápido. 12:58 Ele é tão rápido, a, tipo assim, a latência, né, que acontece, porque pra quem não conhece, você vai fazer, às vezes, interagir com o modelo de voz, ele demora um, dois segundos pra dar uma, uma resposta. 13:08 E a latência desse modelo é tão baixa que ele começava a falar antes da pessoa terminar. Olha! 13:13 Então, a gente tá chegando num ponto que a tecnologia tá, tá tão boa, que a gente vai ter que botar um delay, é, é artificial ali, tipo assim, vai ter que dar um atraso de um, dois segundos antes da voz começar, porque ela já tá rápida o suficiente pra responder bem rápido a, as suas perguntas. 13:27 E, ô Monique, alguns, algumas questões, alguns pontos torna esse laboratório muito interessante, tá? Primeiro deles: esse laboratório ele vai ser totalmente open source. 13:36 A, a, ele é, ele é uma instituição sem fins lucrativos, parecido com o que a OpenAI era lá atrás, né, quando ele foi, foi fundada e tudo mais. 13:44 E o pesquisadores falaram durante esse evento que eles vão liberar o código, os pesos do modelo e o dataset usado para treinar esse modelo também. Olha! Então, isso aí é o open source na veia, se eles fizerem isso tudo. 13:57 É tipo, você tá liberando não só o dado, mas o modelo e o, os dados que você usou. Isso é muito bom pra comuni-comunidade. 14:04 É, outro ponto que chama bastante a atenção é que esse modelo ele foi feito, é, a velocidade dele tá conseguindo responder tão rápido, é por conta da arquitetura em Rust que ele foi criado também, que permite ser bem, bem ágil assim na hora de criar, é, essas respostas. 14:17 E o terceiro, né, o terceiro ponto, que é uma concorrente forte aí ao ChatGPT, né, que ainda nem liberou o seu modelo de voz ali em sua totalidade, mas é uma opção open source aí que, de novo, aperta o calo ali da OpenAI de conseguir- É. 14:33 Né, trazer u-um, trazer algo mais, com, com mais, é, mais sólido pro mercado, né, alguma coisa mais encorpada ali pro mercado, pra não ficar pra trás, né? 14:42 Porque já tão comba-- competindo com o Sora, já tão competindo com a voz, já tem modelo de LLM bom competindo com o ChatGPT 4. E aí, o que que sobra pra, pra OpenAI, né? Exatamente. 14:52 Cada semana que passa aqui no Data Hackers News, é mais um modelo que surge, é mais uma funcionalidade que surge e batendo par a par ali com a própria OpenAI, né? Não, exatamente. 15:03 E assim, é claro que eu br-brinco aqui que o que que sobra pra OpenAI, o que sobra é que ela tem uma penetração de mercado absurda, né? Tipo, ela tá com a, com a, com a Apple, tá com, fazendo parcerias e tudo mais. 15:15 Mas assim, em questão de produto, de criação de produto, isso vai gerando uma certa dificuldade ali para eles, é, se manterem competitivos, né? 15:23 E como tá tudo muito acelerado, então é, é, a, o ânimo da galera vai ficando muito, muito grandes e muito, muito inflados também, né? Mas vamo acompanhar aí. 15:33 Eu tô louco pra testar esse Moshi aqui, com certeza vai ser um modelo que vou brincar aqui assim que eles liberarem, que tem, tá muito, muito interessante mesmo. 15:40 É, vamo esperar e quem sabe a gente também desvende, desvende aí essa relação do laboratório francês com um nome que não é francês, né? Exatamente. Vamos aguardar as cenas do próximo capítulo. 15:57 [vinheta] Bom, essas e outras notícias você também acompanha lá no Data Hackers News, então acessa lá datahackers.news. 16:06 Se você não é cadastrado na nossa newsletter semanal, cadastra seu e-mail, porque toda segunda-feira tem notícias fresquinhas dentro da área de dados, tudo que tá rolando, carreira, vagas. 16:16 Então você pode acompanhar aí no datahackers.news. E aí, Paulo, bora se despedir? Vamo simbora, Monique. É isso aí, pessoal. Obrigado aí pela presença de vocês mais uma vez. 16:25 Dá um pulinho lá no nosso dataset do Kaggle, dá aquele up vote, ajuda a gente a compartilhar aí, pra gente conseguir chegar na medalha de ouro de novo, isso vai ser bastante importante aí pra gente. 16:34 E a gente se vê semana que vem, né, Monique? É isso aí. Semana que vem a gente traz mais notícias. Até mais. Valeu! 16:40 [vinheta] Esse podcast foi editado por Aerolitos, edição inteligente. 17:02 [vinheta]