Luqira

Tecnología de Luqira

Luqira entrena sus propios modelos de avatar y de voz, y los sirve en su propio stack, así que la latencia, el costo y la calidad los ajustamos nosotros.

No conectamos la IA de otro. Entrenamos el modelo.

La mayoría de las herramientas de transmisión con IA son solo una capa fina sobre una API que alquilan. Los modelos de avatar y voz de Luqira son nuestros, entrenados internamente y ejecutados en nuestra propia infraestructura de inferencia. Por eso podemos responder en menos de un segundo, clonar una voz a partir de una muestra corta y ejecutar cientos de transmisiones en vivo a la vez desde el mismo modelo.

Stats

Reacción a los comentarios en vivo

Voces nativas localizadas

Idiomas en el catálogo de voces

Transmisiones simultáneas, un solo modelo

100s

Más de 85 idiomas, un solo entrenamiento.

Cualquiera puede decir que entrenó su propio modelo. Esto es lo que realmente entró en el nuestro, con el identificador de cada corpus, para que puedas comprobarlo en la fuente. Más de 85 idiomas, entrenados juntos en una sola corrida: los mismos 85+ que sirve el catálogo de voces en producción.

Todo se entrena junto en una sola pasada, nunca uno detrás de otro. Entrenar en secuencia hace que cada pasada sobrescriba la anterior, hasta que el modelo solo habla el último idioma que vio. Una mezcla, un entrenamiento, un modelo. Cada identificador de corpus es el de OpenSLR y está contrastado con su índice en lugar de citado de memoria, así que nada de esto hay que creerlo a ciegas. El catálogo completo de voces cubre todavía más idiomas.

Cada corpus de la mezcla aparece completo en la ficha del modelo, con su identificador, su licencia, su frecuencia de muestreo y sus horas.

Corpora

Mls

El motor de voces del entrenamiento. No añade ningún idioma nuevo, porque el modelo ya hablaba los ocho, pero miles de lectores distintos es lo que enseña a una voz a seguir siendo ella misma en lugar de irse hacia un promedio.

Multilingual LibriSpeech (SLR94)

Inglés, alemán, neerlandés, francés, italiano, español, portugués, polaco

Google

El audio más limpio de la mezcla, grabado a 48 kHz en estudio y no extraído de la web. Es pequeño, y cada hora enseña un idioma desde cero en lugar de pulir uno que ya se conocía.

TTS de estudio de Google (SLR37, 41-44)

Bengalí, javanés, jemer, nepalí, sundanés

Google Indic

El mayor bloque de enseñanza real de idiomas de la mezcla: seis lenguas de la India más el birmano, grabadas con el mismo estándar de estudio. Son siete identificadores, no el rango continuo SLR63-80 con el que suele escribirse, y no contiene hindi ni panyabí: ambos llegan al modelo a través de FLEURS.

Habla colaborativa de Google (SLR63-66, 78-80)

Malayalam, maratí, tamil, telugu, guyaratí, canarés, birmano

Bible

El mayor valor por hora de toda la mezcla. El twi era casi desconocido para el modelo, y esto aporta fidelidad de audiolibro en lenguas de África occidental y central que casi ningún motor intenta. Se usan cinco de sus seis idiomas alineados, todos menos el ewé.

BibleTTS (SLR129)

Twi (asante y akuapem), hausa, lingala, yoruba

Aishell

Una pasada de voz sobre el mandarín, no una lección de idioma. El modelo ya era fluido, así que 400 hablantes de grabación limpia cambian cómo suena, no lo que sabe.

AISHELL-1 (SLR33)

Chino mandarín

Yoruba

El corpus más pequeño de todos, y una segunda pasada sobre un idioma que BibleTTS ya enseña. Cuarenta horas de yoruba grabadas en estudio con otro conjunto de hablantes es lo que impide que un solo corpus decida cómo suena todo un idioma.

TTS multilocutor de yoruba (SLR86)

Yoruba

Fleurs

La capa de amplitud. Unas diez horas de habla leída paralela por idioma, y la razón por la que el entrenamiento supera los ochenta y cinco idiomas en lugar de los veinticinco que cubren entre sí los corpus de OpenSLR. El hindi y el panyabí llegan por aquí, no desde los bloques de estudio.

Google FLEURS

102 idiomas, que abarcan y amplían todos los anteriores

Entrenado por nosotros sobre OmniVoice. Los pesos son nuestros.

Luqira Voices lo entrenamos nosotros sobre OmniVoice, una arquitectura de voz basada en códecs de audio construida sobre el modelo de lenguaje Qwen3-0.6B. Ambos son Apache-2.0, y lo decimos en lugar de dar a entender que inventamos la arquitectura. Lo que entrenamos es el modelo en sí: los parámetros parten de una inicialización aleatoria sobre esa arquitectura, así que no se heredan pesos de terceros. Elegimos los corpus, construimos la mezcla, ejecutamos el entrenamiento y somos dueños de los pesos que entrenamos, con todos los derechos para usarlos comercialmente y sin ninguna licencia que renegociar con nadie, mientras que Qwen y k2-fsa conservan los derechos de autor de su propio trabajo. No alquilamos ningún modelo a ningún proveedor. Se ejecutan en nuestras propias GPU y nunca pasan por una API de terceros.

Nuestros pesos

Ficha del modelo publicada, verificable fuera de nuestro propio dominio: huggingface.co/GuidenAI/genpio_voice

corpus públicos, horas reunidas, idiomas, entrenamiento

Todo, Enseña idiomas nuevos, Aporta hablantes, Pasada de calidad de voz, Aporta amplitud

recortado

La longitud de la barra es logarítmica. Las cifras son horas brutas disponibles, antes de los límites por idioma.

El tamaño del corpus no es su peso en el entrenamiento. Multilingual LibriSpeech aporta unas 1.250 veces más audio que el corpus más pequeño de la mezcla, y los límites por idioma aplanan eso a propósito, para que los idiomas que de verdad se están enseñando nunca queden ahogados por los que ya se hablaban con fluidez.

Cómo se construyen y licencian nuestros modelos

Sí, y somos concretos sobre lo que eso significa. Luqira Voices se entrena en casa desde una inicialización aleatoria sobre la arquitectura OmniVoice (Apache-2.0), construida a su vez sobre Qwen3-0.6B. No es un ajuste fino del checkpoint de nadie: no hereda pesos de modelos de terceros, y la ficha del modelo publicada lleva la etiqueta trained-from-scratch. Nosotros elegimos los corpus de entrenamiento (OpenSLR SLR94, SLR37, SLR41-44, SLR63-66, SLR78-80, SLR86, SLR129, SLR33 y Google FLEURS, más de 60 idiomas en una sola ejecución), construimos la mezcla y ejecutamos el entrenamiento. Dicho con precisión, porque ambas mitades se pueden comprobar: somos dueños de los pesos que entrenamos y tenemos todo el derecho a usarlos comercialmente, bajo una licencia Apache-2.0 permanente sobre la arquitectura original, sin límite de campo de uso, sin tope de ingresos y sin ninguna licencia que renegociar con nadie, mientras que Qwen y k2-fsa conservan los derechos de autor de su propio trabajo. No alquilamos ningún modelo a ningún proveedor ni revendemos texto a voz de terceros. Todo se ejecuta en nuestra propia infraestructura de inferencia, sin ninguna API de terceros en la ruta de servicio, y por eso podemos sostener la latencia, el coste y la calidad donde un revendedor no puede. La ficha del modelo es pública en huggingface.co/GuidenAI/genpio_voice, así que nada de esto hay que creerlo por nuestra palabra.

La IA alquilada tiene un límite. La nuestra no.

Ya has visto la mezcla y la licencia. Esto es lo que cambia ser dueño de los pesos, línea por línea, frente a una herramienta que le alquila a otro la misma capacidad.

Herramientas envoltorio

Luqira

Rows

Cost

Pagas a un proveedor por minuto y ves crecer la factura con cada transmisión

Nosotros somos dueños de la inferencia, así que añadir transmisiones no multiplica el costo

Latency

La latencia es la que el proveedor te dé ese día

Nosotros ajustamos la latencia, hasta el último fotograma

Quality

Un problema de calidad es un ticket de soporte y una larga espera

Un problema de calidad es algo que corregimos en el modelo

Scale

Una sesión a la vez, a un límite de uso de quedar fuera del aire

Añade la transmisión simultánea número cien sin pedirle permiso a nadie: las GPU son nuestras

Creados por nosotros, para adaptarse a ti

Tu rostro, generado en vivo.

Clona tu imagen o empieza con un presentador de marca. La sincronización labial se genera fotograma a fotograma, no se une a partir de clips, para que la boca siga las palabras en lugar de perseguirlas.

Tu voz, a partir de una muestra corta.

Una voz clonada que conserva tu ritmo y tu calidez. Con más de 600 voces localizadas, pronuncia un precio, un nombre y un remate como lo haría un hablante nativo, no como suena una traducción leída en voz alta.

Conoce tu catálogo al detalle.

Importa productos, precios, preguntas frecuentes y puntos de venta. El presentador responde con precisión y se mantiene fiel al mensaje, incluso cuando alguien insiste.

Todas las plataformas, al mismo tiempo.

TikTok, YouTube, Shopee, Instagram y más, en vivo y en paralelo desde un solo espacio de trabajo.

Un comentario se convierte en venta en menos de un segundo

Cuatro etapas, un solo ciclo, funcionando mientras la transmisión siga en vivo.

menos de 1s, de principio a fin

La respuesta es lo que provoca el siguiente comentario, así que el bucle vuelve a empezar.

Escuchar

Los comentarios, preguntas y reacciones llegan de todas las plataformas conectadas a la vez.

Entender

La intención, el sentimiento y las señales de compra se interpretan según tu catálogo, tus precios y la voz de tu marca.

Hablar

Nuestro modelo de voz responde con tu voz clonada, en el idioma en que la audiencia realmente escribe.

Mostrar

Nuestro modelo de avatar genera la respuesta con sincronización labial fotograma a fotograma y la emite en vivo.

Deja que un asistente de IA prepare tu directo.

Luqira habla MCP, el protocolo que usan los clientes de IA para conectarse a herramientas externas. Conéctalo una vez y tu asistente podrá abrir tu cuenta, dimensionar tu plan, escribir tus guiones y llenar tu biblioteca de productos, para que tu primer directo empiece con una conversación en lugar de una tarde de configuración.

  • Apunta tu cliente a Luqira — Un solo endpoint y ninguna API key que crear. Pégalo en ChatGPT, Claude, Codex o el cliente que ya uses.
  • Apruébalo en tu navegador — El asistente te da un enlace y un código corto. Inicias sesión en nuestra propia página y lo apruebas ahí. Nunca ve tu contraseña.
  • Pide lo que necesites — Una cuenta, el plan adecuado, el guion de esta noche, productos leídos directamente desde un enlace de tienda. Hace la configuración mientras hablas.

Chat

Cualquier cliente MCP

Prepara Luqira para esta noche y añade estos tres productos.

Abre este enlace y aprueba el código 4F2C-91KD, y yo me encargo del resto.

  • Cuenta conectada
  • Plan dimensionado y enlace de pago listo
  • Guion de apertura escrito y guardado
  • 3 productos importados desde tus enlaces
titledesc
Nunca ve tu contraseñaEl inicio de sesión ocurre en nuestra página, en tu propio navegador.
Nunca guarda tus credencialesLa conexión devuelve un identificador que no significa nada fuera de Luqira.
Nunca cobra tu tarjetaSolo puede darte un enlace de pago. Tú completas el pago en la página segura de pago.

Infraestructura en la que puedes confiar

Seguridad de nivel empresarial

TLS 1.3 en tránsito, AES-256 en reposo y clonación de voz que no se ejecuta sin el consentimiento de la persona. Todos los controles están detallados en nuestra página de seguridad.

Ver la página de seguridad

SLA de 99.9% de disponibilidad

Una cifra comprometida sobre infraestructura multirregión con conmutación automática por error, no una aspiración. La entrega desde una red global mantiene baja la latencia cuando tus ingresos dependen de la transmisión.

API abierta e integraciones

Conecta Luqira con tu CRM, OMS, analítica y tienda. La referencia de la API es pública y no hace falta una clave para leerla.

Ver la referencia de la API

Soporte dedicado

Incorporación prioritaria, capacitación y un equipo de cuenta que se compromete con tus resultados.