REF: AV DATA 2026

Socios para el Licenciamiento de Datos de Audio y Vídeo para IA

Pangeanic busca propietarios de datos, productoras, archivos audiovisuales, organizaciones de investigación y socios de recopilación cualificados con capacidad para licenciar o producir datos de habla en cámara con derechos claros y uso explícito autorizado para el entrenamiento de modelos de IA comerciales.

Derechos comerciales para IA 20.000 a 30.000 horas totales Español: máximo 2.000 horas Fecha límite: 30 de agosto de 2026
Postularse como socio de datos
Alcance del Proyecto

Datos de habla en audio y vídeo a gran escala para entrenamiento de IA

Requerimos organizaciones y socios cualificados capaces de licenciar bases de datos existentes libres de cargas o producir nuevos datos de habla en audio y vídeo. Las fuentes pertinentes incluyen conversaciones, entrevistas, reuniones, podcasts, grabaciones de estudio, archivos audiovisuales y proyectos de recopilación estructurada donde los hablantes sean visibles y el consentimiento pueda documentarse formalmente.

El programa exige entre 20.000 y 30.000 horas totales. La distribución lingüística esperada es de aproximadamente un 80% en inglés y un 20% distribuido entre español, francés, portugués, árabe, hindi, chino, japonés y coreano. Para el idioma español, el proyecto establece un límite máximo de 2.000 horas.

Se trata de una oportunidad de asociación y licenciamiento B2B, no de una tarea puntual de grabación. Priorizamos a propietarios de datos, titulares de derechos, redes de producción y organizaciones capaces de demostrar procedencia, cadena de consentimiento, derechos de uso y calidad de entrega a escala.

Contenido requerido
Conversaciones con hablante visible: Interacciones de habla natural donde los participantes aparecen en cámara y la relación audio-vídeo puede verificarse técnicamente.
Entrevistas, reuniones y podcasts: Habla humana grabada con turnos de intervención claros, derechos de uso, metadatos estables y documentación de consentimiento.
Archivos existentes o recopilación a medida: Se evaluarán conjuntos de datos ya licenciados, bibliotecas de medios, colecciones de investigación, grabaciones controladas y proyectos de captura dirigidos por socios.
Compatibilidad técnica

Formatos requeridos y umbrales de calidad

El proyecto exige activos de audio y vídeo de alta calidad preparados para flujos de trabajo de entrenamiento de modelos. Los proveedores deben indicar los formatos disponibles, la calidad métrica, la cobertura de metadatos, el estado de las transcripciones y la capacidad de entrega mensual.

Audio sin pérdida WAV o FLAC, preferiblemente a 48kHz/24-bit o superior, con documentación de las condiciones de grabación o fuente original.
Calidad de vídeo Vídeo a 720p/24fps o superior, con hablantes visibles y sincronización labial verificable.
Sincronización Audio-Vídeo Medición de sincronización AV con una varianza máxima aceptable de 40ms.
Transcripciones humanas Se requiere transcripción de validación humana con segmentación en bloques de hasta 15 segundos.
Diarización La identificación de turnos de intervención y diarización es obligatoria, o debe cotizarse como complemento estructural.
Metadatos del hablante Etiquetas demográficas (género, rango de edad) allí donde estén legalmente disponibles y cuenten con consentimiento auditable.
Requisitos legales y comerciales

Datos libres de cargas con trazabilidad de consentimiento

Derechos de entrenamiento de IA

Los proveedores deben tener la capacidad legal de licenciar los datos para el entrenamiento comercial de modelos de IA y definir el alcance de uso permitido.

Consentimiento y cesiones

Cuando los datos contengan hablantes identificables, se debe disponer del consentimiento documentado de los participantes o cesiones formales de derechos de voz e imagen.

Procedencia y trazabilidad

El origen de los datos, el método de recopilación, los derechos de la fuente original, las fases de procesamiento y los controles de calidad deben ser auditables.

Garantías e indemnidad

Los socios deben estar preparados para acordar cláusulas de garantía, representación de derechos y condiciones de indemnidad contractual aplicables.

Esta convocatoria internacional está sujeta a auditorías de derechos, validación de consentimientos, legislación aplicable, normativas comerciales y viabilidad contractual.

Perfil del proveedor

Buscamos organizaciones con activos de datos, titularidad de derechos o capacidad operativa

  • Propietarios de datos y titulares de derechos: Organizaciones que poseen conjuntos de datos de habla en audio o vídeo disponibles para entrenamiento de IA comercial.
  • Empresas productoras y de medios: Estudios, emisoras, redes de podcasts, productoras de entrevistas y archivos audiovisuales con derechos explotables y documentación de calidad técnica.
  • Socios de recopilación: Organizaciones capaces de coordinar grabaciones estructuradas con hablantes visibles a escala en los idiomas requeridos.
  • Socios de operaciones de datos y transcripción: Equipos estructurados que puedan proporcionar transcripciones, diarización, metadatos y control de calidad como parte de las entregas.
  • Redes operativas multilingües: Socios con acceso escalable y fiable a datos de habla en inglés, español, francés, portugués, árabe, hindi, chino, japonés y coreano.
Cobertura lingüística

Distribución lingüística prioritaria

El programa está fuertemente orientado al inglés, con cobertura multilingüe específica para varios idiomas globales. Los postulantes deben especificar las horas disponibles, la cobertura de dialectos o países, las condiciones de grabación, el estado de los consentimientos y la preparación para la entrega por idioma.

Idioma Asignación de volumen Especificaciones y notas
Inglés Aproximadamente 80% del volumen total Se evaluará cobertura nativa o casi nativa de EE. UU., Reino Unido, Irlanda, Canadá, Australia y otras regiones.
Español Límite máximo de 2.000 horas El español europeo y el español latinoamericano son pertinentes, aunque el volumen total para español está estrictamente delimitado.
Francés y Portugués Parte de la asignación multilingüe del 20% Se deben documentar las variedades europeas e internacionales disponibles.
Árabe e Hindi Parte de la asignación multilingüe del 20% Se debe indicar claramente el dialecto, la geografía y el entorno de grabación.
Chino, Japonés y Coreano Parte de la asignación multilingüe del 20% Los socios deben especificar el sistema de escritura, las convenciones de transcripción, la demografía de los hablantes y los metadatos disponibles.
Requisitos de la propuesta

Documentación técnica y legal requerida

Para evaluar la idoneidad y viabilidad, requerimos información concreta sobre derechos, métricas de calidad, cobertura lingüística, estructura de metadatos y capacidad de entrega. Las descripciones operativas generales son útiles en fase inicial, pero la evaluación final exigirá detalle técnico e institucional verificable.

01

Volumen disponible

Total de horas disponibles segmentadas por idioma, tipo de contenido, perfil de hablante, geografía y estado de preparación para la entrega.

02

Derechos y consentimiento

Derechos comerciales explícitos para entrenamiento de IA, consentimiento de los participantes, cesiones, contratos de origen y condiciones de transferibilidad.

03

Calidad técnica

Formato de audio, frecuencia de muestreo, profundidad de bits, resolución de vídeo, fotogramas por segundo, medición de sincronización AV y condiciones de grabación.

04

Capa de anotación

Disponibilidad de transcripciones, protocolos de segmentación, diarización, metadatos de hablantes, etiquetas demográficas y procesos de control de calidad (QA).

05

Capacidad mensual

Número de horas verificadas que pueden entregarse mensualmente, incluyendo previsiones de fase de aceleración (ramp-up) o restricciones de recopilación.

06

Condiciones comerciales

Estructura de precios por hora indicativa, volumen mínimo de pedido, cláusulas de exclusividad, límites de licenciamiento e hitos de facturación y entrega.

Gobernanza y Experiencia Operativa

Operaciones de datos de IA multilingüe con rigor legal, lingüístico y técnico

Pangeanic opera desde hace más de dos décadas en la intersección entre la tecnología lingüística, las operaciones de datos y el despliegue de IA B2B. Los datos de audio y vídeo para el entrenamiento de modelos requieren más que volumen. Requieren derechos claros, trazabilidad, metadatos, experiencia lingüística y un control de calidad capaz de superar auditorías corporativas, revisiones legales y procesos estrictos de ingesta técnica.

Trayectoria en datos lingüísticos

La infraestructura de datos de Pangeanic comenzó con grandes corpus multilingües para traducción automática y ha evolucionado sistemáticamente hacia datos de entrenamiento de IA, datos de evaluación, alineación de modelos y operaciones de datos multimodales.

Calidad auditable verificada por humanos

En entornos institucionales, la unidad útil en los datos de IA es el archivo acompañado indisolublemente de sus derechos, metadatos, transcripción validada y una cadena de decisiones que pueda ser auditada externamente.

Soberanía y gobernanza de datos europea

Pangeanic diseña y respalda flujos de trabajo de datos de IA en los que la privacidad, el consentimiento estructurado, la cobertura lingüística y las restricciones de despliegue soberano son centrales desde la fase de aprovisionamiento.

Resolución de dudas técnicas

Preguntas frecuentes sobre el programa

¿Se pueden proponer conjuntos de datos existentes?
Sí. Se evaluarán las bases de datos existentes si el proveedor puede documentar fehacientemente los derechos comerciales para entrenamiento de IA, la procedencia de la fuente, los consentimientos o cesiones pertinentes, las especificaciones de calidad técnica y los formatos de entrega.
¿Se puede recopilar nuevo contenido de habla en cámara para este proyecto?
Sí. Buscamos socios cualificados que puedan coordinar operativamente nuevas grabaciones de hablantes visibles a escala, siempre y cuando el proceso incluya la gestión contractual de consentimientos, cesiones de imagen, control de calidad, etiquetado de metadatos y cumplimiento de la cuota lingüística.
¿Se aceptan datos exclusivamente de audio?
El requisito principal y excluyente de este programa es el habla en cámara con hablantes visibles y sincronización medible. Los corpus de solo audio pueden ser relevantes para otros requerimientos de datos de Pangeanic, pero este proyecto específico prioriza datos conjuntos de audio y vídeo.
¿Son obligatorias la transcripción, la diarización y las etiquetas demográficas?
Las transcripciones humanas, la diarización y los metadatos de los hablantes son requisitos de alto valor. Si el conjunto de datos carece de esta capa de anotación, los proveedores deben indicar si poseen la capacidad de integrarla antes de la entrega, detallando costes operativos y plazos de ejecución asociados.
¿Cuánto volumen de datos en español requiere el programa?
El idioma español forma parte de la asignación multilingüe del 20%, pero este programa específico cuenta con un tope máximo estructurado de 2.000 horas para dicho idioma. Los proveedores de datos en español deben especificar técnicamente si se trata de corpus en español europeo, español latinoamericano o una variante particular.
¿Cómo se definen y evalúan las condiciones comerciales?
La evaluación económica dependerá de múltiples factores: idioma, calidad de muestreo, alcance y exclusividad de la licencia, densidad de los metadatos, estado de la transcripción, robustez de la cadena de consentimiento, formatos de entrega y capacidad de ingesta mensual. Los proveedores deben adjuntar en su propuesta un esquema de precios por hora indicativo y sus condiciones comerciales mínimas de operación.

Licenciamiento y producción de datos AV para IA

Si su organización gestiona, posee titularidad o dispone de la capacidad para producir datos de habla en audio y vídeo libres de cargas legales corporativas, indíquenos su volumen operativo, cobertura de idiomas, estructura de derechos, especificaciones de calidad técnica y umbrales de entrega mensual.