Artwork

Konten disediakan oleh Enrique Rodal. Semua konten podcast termasuk episode, grafik, dan deskripsi podcast diunggah dan disediakan langsung oleh Enrique Rodal atau mitra platform podcast mereka. Jika Anda yakin seseorang menggunakan karya berhak cipta Anda tanpa izin, Anda dapat mengikuti proses yang diuraikan di sini https://id.player.fm/legal.
Player FM - Aplikasi Podcast
Offline dengan aplikasi Player FM !

Latxa, la inteligencia artificial generativa vasca entrenada con datos en euskera

15:58
 
Bagikan
 

Manage episode 421371659 series 2170879
Konten disediakan oleh Enrique Rodal. Semua konten podcast termasuk episode, grafik, dan deskripsi podcast diunggah dan disediakan langsung oleh Enrique Rodal atau mitra platform podcast mereka. Jika Anda yakin seseorang menggunakan karya berhak cipta Anda tanpa izin, Anda dapat mengikuti proses yang diuraikan di sini https://id.player.fm/legal.
Existen muchos modelos de inteligencia artificial generativa, como ChatGPT, Google Gemini o Microsoft Copilot; que tienen como base idiomas como el inglés y que se pueden utilizar en otros idiomas gracias a las herramientas de traducción. Sin embargo, los textos y los datos con los que están entrenados están, generalmente, en inglés. Latxa se entrena con contenidos escritos en euskera, emplea un gran corpus de textos en este idioma con licencia libre. En total son más de 4 millones de documentos y 1.200 millones de palabras, doblando en tamaño a los corpus existentes hasta el momento. Conversamos con Aitor Soroa, uno de los investigadores de Hitz Zentroa, el Centro Vasco de Tecnología del Lenguaje de la UPV/EHU, impulsor de este modelo vasco de IA generativa.
  continue reading

50 episode

Artwork
iconBagikan
 
Manage episode 421371659 series 2170879
Konten disediakan oleh Enrique Rodal. Semua konten podcast termasuk episode, grafik, dan deskripsi podcast diunggah dan disediakan langsung oleh Enrique Rodal atau mitra platform podcast mereka. Jika Anda yakin seseorang menggunakan karya berhak cipta Anda tanpa izin, Anda dapat mengikuti proses yang diuraikan di sini https://id.player.fm/legal.
Existen muchos modelos de inteligencia artificial generativa, como ChatGPT, Google Gemini o Microsoft Copilot; que tienen como base idiomas como el inglés y que se pueden utilizar en otros idiomas gracias a las herramientas de traducción. Sin embargo, los textos y los datos con los que están entrenados están, generalmente, en inglés. Latxa se entrena con contenidos escritos en euskera, emplea un gran corpus de textos en este idioma con licencia libre. En total son más de 4 millones de documentos y 1.200 millones de palabras, doblando en tamaño a los corpus existentes hasta el momento. Conversamos con Aitor Soroa, uno de los investigadores de Hitz Zentroa, el Centro Vasco de Tecnología del Lenguaje de la UPV/EHU, impulsor de este modelo vasco de IA generativa.
  continue reading

50 episode

Tous les épisodes

×
 
Loading …

Selamat datang di Player FM!

Player FM memindai web untuk mencari podcast berkualitas tinggi untuk Anda nikmati saat ini. Ini adalah aplikasi podcast terbaik dan bekerja untuk Android, iPhone, dan web. Daftar untuk menyinkronkan langganan di seluruh perangkat.

 

Panduan Referensi Cepat