Los historiadores advierten que los registros sesgados pueden distorsionar nuestra comprensión del pasado.

>>  viernes, 31 de julio de 2026

El archivo no es un juguete: los problemas ocultos de una IA ‘Vintage’
https://goodmenproject.com

Por Jacob Polay, Chloë Farr y Jessica Jack

Un nuevo modelo de IA entrenado en archivos históricos destaca por qué los historiadores advierten que los registros sesgados pueden distorsionar nuestra comprensión del pasado.



Generaciones de historiadores sociales han explorado archivos e inventado nuevas formas de abordar la historia mediante la colaboración con otras disciplinas. Un nuevo modelo de IA de estilo retro, llamado talkie, es un ejemplo de lo que sucede cuando la extracción de conocimiento reemplaza la colaboración.

Tras analizar las diversas comunicaciones en torno al modelo, el equipo detrás de talkie ha presentado su nuevo modelo de lenguaje natural (MLN) de dos maneras. En su publicación de blog, donde presentan este nuevo modelo, y en una entrevista con el podcast Hard Fork, el equipo describe su potencial predictivo. Su objetivo es comprobar si los modelos de lenguaje pueden predecir eventos más allá del período de los datos de entrenamiento, y para ello lo entrenan con documentos anteriores a 1931. El equipo parte de la premisa de que si este modelo "clásico" puede predecir su futuro, entonces los modelos modernos entrenados con la web actual pueden predecir nuestro futuro.

Sin embargo, la interfaz del chatbot talkie no utiliza el modelo como herramienta predictiva. No existe evidencia de su eficacia. En nuestras pruebas, su modelo local no incluye capacidades predictivas ni proporciona documentación suficiente para realizar ninguna predicción. En cambio, funciona más como un juguete para interactuar con una versión particular de la historia. Su eslogan anuncia el modelo como «un modelo LM de 1930», como si el usuario estuviera hablando con una entidad del pasado. Esta contraposición entre predicción e historia disfraza una herramienta cuyo uso no está claro y cuyos fundamentos son defectuosos.

Estos defectos comienzan con los datos con los que se entrenó talkie. Su corpus de entrenamiento era un subconjunto de los registros publicados en inglés anteriores a 1930. Como la mayoría de los archivos occidentales, este es un corpus probablemente dominado por escritores blancos, hombres y de élite. Otras voces quedan relegadas en los registros y, además, se filtran mediante la digitalización. El resultado es un modelo que habla con seguridad sobre el pasado con la voz de su segmento más limitado.

El equipo de talkie tomó estas decisiones deliberadamente. En el podcast Hard Fork, el Dr. David Duvenaud, miembro del equipo de Talkie y profesor asociado de la Universidad de Toronto, afirmó que querían que todo estuviera disponible públicamente en código abierto, y que la década de 1930 era la fecha más reciente que prácticamente no presentaba problemas legales. Sin embargo, el equipo no ha publicado las fuentes de los datos de entrenamiento, por lo que la poca información que tenemos sobre el conjunto de datos se basa en sus declaraciones públicas. Al parecer, el conjunto de datos de entrenamiento solo contiene textos impresos en inglés, excluyendo fuentes manuscritas o multilingües. Su publicación en el blog menciona específicamente "libros, periódicos, revistas, revistas científicas, patentes y jurisprudencia" como su corpus de entrenamiento. Obtuvieron estos materiales de repositorios como la Iniciativa de Datos Institucionales de la Universidad de Harvard, Internet Archive y productos del proyecto Common Pile. De esta manera, el equipo se basó en datos fáciles de encontrar y listos para usar, en lugar de desarrollar un corpus representativo con diversas perspectivas del pasado. Una dependencia excesiva de datos disponibles puede generar problemas, como la reproducción de puntos de vista estrechos de miras que ciertas personas sostenían en el pasado.

Esta dependencia de datos fáciles no se debía a la falta de acceso a conocimientos especializados. Cinco meses antes del lanzamiento de Talkie, Farr, una de nosotras, se reunió con Levine y Radford para una conversación de una hora sobre el reconocimiento óptico de caracteres (OCR) y el acceso a archivos históricos. Como parte del proyecto Talkie, se está desarrollando un OCR de última generación, que se relaciona con la investigación de Farr sobre modelos de lenguaje visual para la transcripción de archivos. Sin embargo, en lugar de hablar sobre nuevas herramientas de transcripción con IA, como Farr esperaba, el equipo le preguntó cómo obtener datos de entrenamiento para su modelo de predicción. Las preguntas de Farr sobre sus métodos de curación de corpus, como qué se incluiría o excluiría y cómo se reconocerían las lagunas, fueron recibidas con escaso interés. Consideraron que estas preguntas quedaban fuera del alcance de su trabajo actual. Cinco meses después, el modelo se lanzó con los problemas del corpus que Farr había señalado, representados únicamente como "limitaciones" y "direcciones futuras" en la publicación de lanzamiento, que reconoce su contribución en "discusiones útiles".

Si se hubieran tenido en cuenta advertencias como la de Farr, se habrían mitigado algunos de los problemas con los resultados de talkie. Como se observa en la Figura 1, talkie genera respuestas intolerantes y las presenta como una representación de 1930; un resultado de la metodología del proyecto. El arduo trabajo de ampliar el archivo se ve socavado. Investigadores de humanidades han contrastado las experiencias de personas marginadas con los registros publicados, han reconstruido la vida de personas esclavizadas utilizando libros de contabilidad coloniales y han reconstruido historias indígenas a partir de tradiciones orales y los márgenes de documentos coloniales. El uso que hace el equipo de talkie de documentos fáciles y accesibles, y la intolerancia resultante del modelo, eclipsa los esfuerzos profesionales y colaborativos que se han dedicado a diversificar y ampliar los archivos más allá de estas voces problemáticas. Estos esfuerzos han abordado los desafíos archivísticos ignorados por talkie: gran parte del material nunca se imprimió; gran parte de lo que se imprimió no está digitalizado; la mayoría de las fuentes manuscritas digitalizadas no están transcritas. Las fuentes efímeras y multilingües necesarias para entrenar un modelo con algo que se aproxime al archivo completo del pasado simplemente no existen en un formato legible por máquina.

Read more...

Autoridad Nacional de Medios (NMA) presenta proyecto nacional para archivar y digitalizar el patrimonio radiofónico y televisivo de Egipto

Proyecto de archivo impulsado por IA para preservar el patrimonio televisivo de Egipto

https://cairoscene.com/



Se digitalizarán alrededor de un millón de cintas de audio y vídeo durante dos años utilizando inteligencia artificial e infraestructura mejorada.

La Autoridad Nacional de Medios (NMA) ha presentado un proyecto nacional para archivar y digitalizar el patrimonio radiofónico y televisivo de Egipto como parte de una estrategia Digital First que utiliza inteligencia artificial para preservar y organizar la historia audiovisual del país.

Anunciada en el Teatro de Televisión de Maspero, la iniciativa sigue las directivas del presidente Abdel Fattah El-Sisi para modernizar el archivo de medios de Egipto. El proyecto utilizará IA para indexar y clasificar contenidos y, al mismo tiempo, mejorará la infraestructura tecnológica necesaria para preservar programas que se remontan a casi un siglo.

Según el general de división Dr. Walid Adly Attia, director del Departamento de Sistemas de Información de las Fuerzas Armadas, se espera que el proceso de digitalización concluya en dos años. La ministra de Estado de Información, Diaa Rashwan, dijo que se espera que el 41% del contenido televisivo incluido en el proyecto esté digitalizado en abril de 2027, y agregó que el archivo representa un activo nacional perteneciente al pueblo egipcio.

El archivo abarca material de los años posteriores a la Ley de Radio de 1926, que regulaba las estaciones de radio privadas, hasta el lanzamiento de la Radio Egipcia en 1934 y más allá. El proyecto tiene como objetivo preservar alrededor de un millón de cintas de audio y vídeo, equivalentes a aproximadamente 800.000 horas de contenido histórico, convirtiéndolas de formatos de almacenamiento tradicionales a archivos digitales seguros.

La Autoridad Nacional de Medios dijo que se han contratado empresas especializadas internacionales y equipos avanzados para apoyar el proyecto y al mismo tiempo garantizar que el archivo esté protegido de acuerdo con los estándares de ciberseguridad e inteligencia artificial.

Read more...

Vida lanza Scene Search: indexa las videotecas existentes y devuelve resultados a nivel de escena

VIDA lleva la búsqueda a nivel de escena de IA a los archivos de medios, poniendo fin a la era del registro manual
https://roastbrief.us/
por Breve asado




VIDA, el sistema seguro de gestión de activos de medios nativo de la nube lanzó hoy Scene Search, una capacidad de indexación fuera de línea impulsada por IA que permite a los equipos buscar dentro de sus bibliotecas de video en el nivel actual, sin depender de metadatos que se registraron manualmente hace años, en todo caso.

El problema de la industria es caro y está empeorando. Las bibliotecas multimedia están creciendo más rápido de lo que los equipos pueden registrarlas manualmente. Encontrar un momento específico ha dependido tradicionalmente de lo que se etiquetó o registró cuando se ingirió el contenido por primera vez. A medida que los archivos se expanden, ese enfoque se vuelve cada vez más difícil de mantener.

La búsqueda de escenas cambia esto. La capacidad de descubrimiento ya no depende de lo que se registró manualmente. En cambio, el contenido en sí se puede buscar, lo que permite a los equipos localizar escenas relevantes independientemente de cuán completos puedan ser los metadatos existentes.

“Existen momentos increíbles en tu biblioteca. Superarlo es el problema, dijo Symon Roue, director general de VIDA. “Imagínese a alguien que ha visto cada minuto de su archivo y lo recuerda todo. Scene Search hace que el contenido en sí se pueda buscar, por lo que la capacidad de descubrimiento ya no depende de lo que se etiquetó cuando un activo ingresó por primera vez a la biblioteca.”

Scene Search indexa las videotecas existentes y devuelve resultados a nivel de escena. Cada resultado se conecta directamente a los flujos de trabajo de administración de activos, derechos y entrega que ya se ejecutan dentro de VIDA Content OS. Los equipos pueden:Busque dentro del contenido en sí en lugar de depender únicamente de los metadatos ingresados manualmente.
Utilice la búsqueda en lenguaje natural para localizar momentos específicos dentro de más tiempo en lugar de buscar archivos.

Pase directamente de los resultados de búsqueda a nivel de escena a los derechos existentes y los flujos de trabajo de entrega sin cambiar de sistema.

Scene Search está diseñado para las realidades de las grandes bibliotecas multimedia. El contenido llega más rápido de lo que se puede registrar manualmente. Los archivos crecen más rápido de lo que se pueden mantener los metadatos y los equipos necesitan respuestas rápidamente.

Al hacer que el contenido sea buscable, Scene Search ayuda a las organizaciones a desbloquear el valor del contenido que ya poseen. Facilita el descubrimiento, la reutilización y la gestión de medios a escala.

La búsqueda de escenas ya está disponible como parte del sistema operativo VIDA Content. Las organizaciones pueden solicitar una demostración para ver cómo Scene Search indexa las bibliotecas existentes y conecta la búsqueda a nivel de escena con los flujos de trabajo de administración de activos, derechos y entrega que ya se ejecutan en VIDA Content OS.


Read more...

Snap Shots

Get Free Shots from Snap.com

  © Free Blogger Templates Autumn Leaves by Ourblogtemplates.com 2008

Back to TOP