Artwork

Content provided by Enrique Rodal. All podcast content including episodes, graphics, and podcast descriptions are uploaded and provided directly by Enrique Rodal or their podcast platform partner. If you believe someone is using your copyrighted work without your permission, you can follow the process outlined here https://player.fm/legal.
Player FM - Podcast App
Go offline with the Player FM app!

Latxa, la inteligencia artificial generativa vasca entrenada con datos en euskera

15:58
 
Share
 

Manage episode 421371659 series 2170879
Content provided by Enrique Rodal. All podcast content including episodes, graphics, and podcast descriptions are uploaded and provided directly by Enrique Rodal or their podcast platform partner. If you believe someone is using your copyrighted work without your permission, you can follow the process outlined here https://player.fm/legal.
Existen muchos modelos de inteligencia artificial generativa, como ChatGPT, Google Gemini o Microsoft Copilot; que tienen como base idiomas como el inglés y que se pueden utilizar en otros idiomas gracias a las herramientas de traducción. Sin embargo, los textos y los datos con los que están entrenados están, generalmente, en inglés. Latxa se entrena con contenidos escritos en euskera, emplea un gran corpus de textos en este idioma con licencia libre. En total son más de 4 millones de documentos y 1.200 millones de palabras, doblando en tamaño a los corpus existentes hasta el momento. Conversamos con Aitor Soroa, uno de los investigadores de Hitz Zentroa, el Centro Vasco de Tecnología del Lenguaje de la UPV/EHU, impulsor de este modelo vasco de IA generativa.
  continue reading

50 episodes

Artwork
iconShare
 
Manage episode 421371659 series 2170879
Content provided by Enrique Rodal. All podcast content including episodes, graphics, and podcast descriptions are uploaded and provided directly by Enrique Rodal or their podcast platform partner. If you believe someone is using your copyrighted work without your permission, you can follow the process outlined here https://player.fm/legal.
Existen muchos modelos de inteligencia artificial generativa, como ChatGPT, Google Gemini o Microsoft Copilot; que tienen como base idiomas como el inglés y que se pueden utilizar en otros idiomas gracias a las herramientas de traducción. Sin embargo, los textos y los datos con los que están entrenados están, generalmente, en inglés. Latxa se entrena con contenidos escritos en euskera, emplea un gran corpus de textos en este idioma con licencia libre. En total son más de 4 millones de documentos y 1.200 millones de palabras, doblando en tamaño a los corpus existentes hasta el momento. Conversamos con Aitor Soroa, uno de los investigadores de Hitz Zentroa, el Centro Vasco de Tecnología del Lenguaje de la UPV/EHU, impulsor de este modelo vasco de IA generativa.
  continue reading

50 episodes

All episodes

×
 
Loading …

Welcome to Player FM!

Player FM is scanning the web for high-quality podcasts for you to enjoy right now. It's the best podcast app and works on Android, iPhone, and the web. Signup to sync subscriptions across devices.

 

Quick Reference Guide