Parece que cada pieza de software moderno ahora viene con IA para proporcionar a sus clientes características de calidad, practicidad y seguridad cuestionables. Mozilla y su navegador Firefox no son inmunes a este uso generalizado de la IA, y la compañía quiere implementarla para mejorar la accesibilidad.
En un reciente post en Mozilla Hacks, Tarek ZIade explicaba cómo Firefox utilizará la inteligencia artificial para mejorar la accesibilidad, concretamente ofreciendo subtitulos de imagen generados por IA para las personas que dependen de tecnologías de asistencia, como los lectores de pantalla.
Los subtítulos de imagen o «texto alternativo» proporcionan el contexto necesario a los lectores, pero lamentablemente muchos escritores ignoran el texto alternativo, lo que provoca que casi la mitad de las imágenes carezcan de descripciones adecuadas. Con los últimos avances en IA, ahora es posible ejecutar un modelo local de aprendizaje automático para autogenerar subtítulos sin enviar información potencialmente sensible a los servidores.
Firefox 130 se incluirá en el canal Nightly con una nueva función para el editor de PDF que generará texto alternativo utilizando pequeños modelos de aprendizaje automático de código abierto basados en Transformer. Mozilla afirma que son buenos para describir imágenes sin una gran carga de recursos. Por lo tanto, los usuarios de Firefox deberían obtener descripciones de imágenes (primero en PDF) incluso en dispositivos menos potentes.
Según la entrada del blog, los modelos pequeños pueden generar texto alternativo con más de 200 millones de parámetros, ocupan menos de 200 MB de espacio en disco y ofrecen resultados en cuestión de segundos. Son menos detallados y precisos en comparación con los mastodontes de los LLM modernos, como el último GPT-4o, pero los desarrolladores no quieren abrumar a los usuarios con demasiada información. Por lo tanto, Firefox se centrará en producir una descripción de una sola frase, como ésta:
Un grupo de personas en una oficina celebra con una tarta de cumpleaños encendida en primer plano y una mujer sonriente al fondo.
Utilizar un modelo local tiene varias ventajas. Además de una mayor privacidad (las imágenes no van a ninguna parte para ser procesadas), los usuarios obtienen una mayor eficiencia de los recursos, más transparencia, menos emisiones de CO2 (el entrenamiento de grandes modelos genera muchas emisiones de carbono) y actualizaciones frecuentes con mejoras periódicas.
Puede encontrar más información aquí.
Fuente WEB | Editado por CambioDigital Online








































