Compartir

logo-3Cat

El proyecto, liderado por Eurecat en colaboración con 3Cat, se ha embarcado de nuevo en la fabricación de nuevas herramientas hacia los asistentes periodísticos, en este caso para la descripción de fotos, explorando las capacidades sin precedentes de los modelos de lenguaje multimodales actuales.

La descripción de fotos en medios de comunicación a menudo es una tarea rutinaria, lejos de actividades intelectuales necesarias en la redacción de una noticia. Los pies de foto suelen atender criterios editoriales, mientras que la descripción de fotografías requiere una descripción en términos puramente visuales. Estas descripciones, incluidas en campos no visibles de los formatos digitales, tal como las páginas web, también llamados “textos alternativos”, a menudo no están presentes a causa de diferentes factores de los flujos de trabajo actuales. Esto hace que personas con limitaciones de accesibilidad no se puedan informar del mismo modo.

El desarrollo de nuevas herramientas basadas en modelos multimodales de inteligencia artificial generativa, optimizadas para la descripción de fotografías con fines informativos, pueden constituir un asistente periodístico que impacte positivamente en la calidad de la información, tanto en la creación de pies de foto, como en descripciones visuales con finalidad de accesibilidad.

En esta sesión, el CIDAI, en colaboración con 3Cat presentará los resultados y conocimientos adquiridos durante la ejecución de uno de los Proyectos de Alto Impacto en el que se han usado herramientas de IA generativa multimodales.

Programa

09:15h Registro

Presenta el evento: Sr. Marco Orellana, gerente del CIDAI.

10:00 h Bienvenida

  • Sr. Joan Mas i Albaigès, director del CIDAI i director Científico Digital de Eurecat.
  • Sra. Rosa Romà Monfà , presidenta de la Corporació Catalana de Mitjans Audiovisuals- 3Cat
  • Sra. Maria Galindo, secretaria de Políticas Digitales de la Generalitat de Catalunya

10:15h Proyecto de Alto Impacto Asistencia inteligente en la descripción contextualizada de fotos para noticias
10:15h- Sr. Medir Plandolit, responsable Digital Informativos 3Cat

La sociedad necesita una información de calidad para garantizar una democracia plena, pero hoy hay una desafección creciente: dos de cada tres catalanes no están satisfechos con el sistema democrático. Los hábitos de consumo han cambiado, con las redes sociales como principal fuente informativa. Esto dificulta identificar información fiable y debilita la conexión con los medios tradicionales. En este contexto, la IA tiene que ser una herramienta al servicio del periodismo, liberando a los profesionales de tareas repetitivas para centrarse en acciones de más valor.

10:30h- Sr. Rafael Redondo, responsable Línea de Imagen Unidad de Tecnologías Multimedia de Eurecat

Los modelos multimodales (LVM) pueden gestionar tareas de procesamiento tanto de imágenes como de lenguaje, integrando tanto los datos visuales como los textuales. Así, pueden crear descripciones o resúmenes coherentes a partir de diferentes tipos de entradas. Estos modelos multimodales, mediante instrucciones (prompts) y cadenas de razonamiento (Chain of Thought), como preguntas específicas o el contexto más amplio de un artículo de noticias, pueden guiar el proceso de subtitulado y descripción de imágenes de manera más efectiva hacia el desarrollo de nuevos asistentes periodísticos.

11.00h | Evaluación del proyecto – Asistencia inteligente en la descripción contextualizada de fotos para noticias
– Sr. Rafa Bermúdez, investigación y servicios transversales 3Cat

La evaluación de herramientas basadas en inteligencia artificial, especialmente por su naturaleza estocástica, es especialmente compleja. Hay que definir procedimientos rigurosos que reduzcan las distracciones que podrían condicionar los resultados, pero al mismo tiempo es fundamental evitar introducir sesgos. Por eso, se combinan metodologías como, pruebas dirigidas, entrevistas personales, y el análisis y visualización de los resultados, que permiten destilar la información más relevante para valorar la efectividad y utilidad de las herramientas. Mediante estas técnicas, se han podido identificar los aspectos más interesantes de la propuesta, ası́ como trazar las líneas de evolución más prometedoras para continuar desarrollando esta herramienta.

11:30h Clausura
11:35h Café Networking
12:00h Fin del acto

Lugar

AUDITORIO 3Cat
Carrer de la TV3, s/n
08970 Sant Joan Despí (Barcelona)

¿Cómo llegar al auditorio?

-En transporte públic:o
Autobusos (L21, L46, X30, 78, 157), tren (R4), metro (L5), o tramvia (T3)

-En coche particular:
Puedes aparcar en la calle delante de las instalaciones de TV3 o bien en el parking del Hospital Moissès Broggi (parking de pago)

Projecte de fabricació de noves eines cap als assistents periodístics, en aquest cas per la descripció de fotos, explorant les capacitats sense precedents dels models de llenguatge multimodals actuals.
CIDAI