Dale voz a tu IA — en el teléfono y en la web.
Audio en streaming, transcripción en tiempo real, voz de baja latencia y llamadas telefónicas — conectado a tu propio agente o LLM. En tu infraestructura o en nuestro cloud. Cumplimiento europeo de serie.
curl -X POST https://api.letsylabs.com/v1/sessions \ -H "Authorization: Bearer $LETSY_KEY" \ -d '{ "connector": "my-agent", "language": "es" }' { "session_id": "01JD…", "ws_url": "wss://…/audio" }
Trae tu propia inteligencia.
Nosotros nos encargamos de los medios en tiempo real — transporte, transcripción, turnos de conversación, interrupciones, voz y el registro de auditoría. Tú decides qué piensa. Conecta tu agente por HTTP + SSE, o cualquier endpoint compatible con OpenAI.
Infraestructura de voz sin atarte a un agente.
Transcripciones parciales en menos de 300 ms. Español primero, multilingüe por diseño.
Primer audio por frase, no por respuesta. La voz empieza mientras el modelo todavía piensa.
Interrumpe al agente con tu voz. El runtime gestiona los turnos para que tu código no tenga que hacerlo.
Cada tramo medido, cada conversación trazada. Consulta la línea de tiempo por llamada.
Convierte cualquier llamada en un stream programable.
Trae tu troncal SIP o tu centralita — Asterisk, 3CX, tu operador — y cada llamada se convierte en una sesión que controla tu software. Entrantes, salientes, transferencias, DTMF.
La ley ya lo exige. Nosotros lo traemos de serie.
La Ley 10/2025 de España y el AI Act de la UE exigen que las IA que llaman se identifiquen, ofrezcan transferencia a una persona y mantengan registros. letsylabs lo incluye como infraestructura: aviso automático de IA al inicio de la llamada, transferencia garantizada a una persona, marcado de audio sintético y un registro de auditoría exportable y certificado por llamada.
Se informa a quien llama de que habla con una IA desde el inicio. Automático, registrado, verificable.
Una vía garantizada de transferencia a una persona, a petición o por regla.
Un registro de eventos certificado y exportable por llamada. Cada aviso, cada transferencia.
Retención de grabaciones, borrado y rectificación — configurados, no programados.
Tu infraestructura. Tus datos. Un solo comando.
Ejecuta toda la plataforma en tus servidores con docker compose — incluidos los modelos de STT y TTS de pesos abiertos, así el audio nunca sale de tu infraestructura. La misma pila que ejecutamos en nuestro cloud.
Abierto donde importa.
Los contratos principales, VAD y los adaptadores de modelos de pesos abiertos son Apache 2.0. Construye con los mismos tipos que usamos nosotros — hoy en Rust, pronto en Python.
Contratos de sesión, eventos y fotogramas de audio. Los tipos que todo el sistema habla.
Detección de actividad de voz afinada para la conversación, no para el dictado.
Adaptadores de modelos de pesos abiertos — Voxtral y compañía.
Del primer stream a producción.
# 1. create a session bound to your connector curl -X POST https://api.letsylabs.com/v1/sessions \ -H "Authorization: Bearer $LETSY_KEY" -d '{ "connector": "my-agent" }' # 2. stream audio over the returned ws_url websocat "wss://api.letsylabs.com/v1/audio?session=01JD…"
let session = letsy::Session::create("my-agent").await?; let mut events = session.connect().await?; while let Some(ev) = events.next().await { if let Event::TranscriptFinal(t) = ev { agent.reply(&t.text).await?; } }
# letsy-py lands in 2027 — same contracts, same events session = letsy.Session.create(connector="my-agent") async for ev in session.events(): if ev.type == "transcript.final": await agent.reply(ev.text)
La voz es el primer sentido.
letsylabs está construido como la capa de interacción entre el software inteligente y el mundo real. La estamos lanzando un sentido cada vez.
Construye IA de voz que aguante en producción — y en una auditoría.
Todavía no hay formulario en línea — esto abre tu cliente de correo.
{PRIVACY_NOTICE} Política de privacidad