Artwork

Contenido proporcionado por Enrique Rodal. Todo el contenido del podcast, incluidos episodios, gráficos y descripciones de podcast, lo carga y proporciona directamente Enrique Rodal o su socio de plataforma de podcast. Si cree que alguien está utilizando su trabajo protegido por derechos de autor sin su permiso, puede seguir el proceso descrito aquí https://es.player.fm/legal.
Player FM : aplicación de podcast
¡Desconecta con la aplicación Player FM !

Latxa, la inteligencia artificial generativa vasca entrenada con datos en euskera

15:58
 
Compartir
 

Manage episode 421371659 series 2170879
Contenido proporcionado por Enrique Rodal. Todo el contenido del podcast, incluidos episodios, gráficos y descripciones de podcast, lo carga y proporciona directamente Enrique Rodal o su socio de plataforma de podcast. Si cree que alguien está utilizando su trabajo protegido por derechos de autor sin su permiso, puede seguir el proceso descrito aquí https://es.player.fm/legal.
Existen muchos modelos de inteligencia artificial generativa, como ChatGPT, Google Gemini o Microsoft Copilot; que tienen como base idiomas como el inglés y que se pueden utilizar en otros idiomas gracias a las herramientas de traducción. Sin embargo, los textos y los datos con los que están entrenados están, generalmente, en inglés. Latxa se entrena con contenidos escritos en euskera, emplea un gran corpus de textos en este idioma con licencia libre. En total son más de 4 millones de documentos y 1.200 millones de palabras, doblando en tamaño a los corpus existentes hasta el momento. Conversamos con Aitor Soroa, uno de los investigadores de Hitz Zentroa, el Centro Vasco de Tecnología del Lenguaje de la UPV/EHU, impulsor de este modelo vasco de IA generativa.
  continue reading

70 episodios

Artwork
iconCompartir
 
Manage episode 421371659 series 2170879
Contenido proporcionado por Enrique Rodal. Todo el contenido del podcast, incluidos episodios, gráficos y descripciones de podcast, lo carga y proporciona directamente Enrique Rodal o su socio de plataforma de podcast. Si cree que alguien está utilizando su trabajo protegido por derechos de autor sin su permiso, puede seguir el proceso descrito aquí https://es.player.fm/legal.
Existen muchos modelos de inteligencia artificial generativa, como ChatGPT, Google Gemini o Microsoft Copilot; que tienen como base idiomas como el inglés y que se pueden utilizar en otros idiomas gracias a las herramientas de traducción. Sin embargo, los textos y los datos con los que están entrenados están, generalmente, en inglés. Latxa se entrena con contenidos escritos en euskera, emplea un gran corpus de textos en este idioma con licencia libre. En total son más de 4 millones de documentos y 1.200 millones de palabras, doblando en tamaño a los corpus existentes hasta el momento. Conversamos con Aitor Soroa, uno de los investigadores de Hitz Zentroa, el Centro Vasco de Tecnología del Lenguaje de la UPV/EHU, impulsor de este modelo vasco de IA generativa.
  continue reading

70 episodios

Todos los episodios

×
 
Loading …

Bienvenido a Player FM!

Player FM está escaneando la web en busca de podcasts de alta calidad para que los disfrutes en este momento. Es la mejor aplicación de podcast y funciona en Android, iPhone y la web. Regístrate para sincronizar suscripciones a través de dispositivos.

 

Guia de referencia rapida

Escucha este programa mientras exploras
Reproducir