INFRAESTRUCTURA DE VOZ EN TIEMPO REAL PARA IA

Dale voz a tu IA — en el teléfono y en la web.

Audio en streaming, transcripción en tiempo real, voz de baja latencia y llamadas telefónicas — conectado a tu propio agente o LLM. En tu infraestructura o en nuestro cloud. Cumplimiento europeo de serie.

bash
curl -X POST https://api.letsylabs.com/v1/sessions \
  -H "Authorization: Bearer $LETSY_KEY" \
  -d '{ "connector": "my-agent", "language": "es" }'

{ "session_id": "01JD…", "ws_url": "wss://…/audio" }
stt.partial · 118ms stt.final · 142ms agent.first_token · 210ms tts.first_audio · 96ms call.transfer.human · ok trace.exported · 1.2s dtmf.received · "3" turn.barge_in · 61ms

Trae tu propia inteligencia.

Nosotros nos encargamos de los medios en tiempo real — transporte, transcripción, turnos de conversación, interrupciones, voz y el registro de auditoría. Tú decides qué piensa. Conecta tu agente por HTTP + SSE, o cualquier endpoint compatible con OpenAI.

HAZ CLIC EN UN ORIGEN Y UN DESTINO PARA REDIRIGIR
TeléfonoNavegadorTu appletsylabs runtimeVAD · STT · turns · TTS · traceTu agenteOpenAIOllamaCualquier LLM
HAZ CLIC EN UN ORIGEN Y UN DESTINO PARA REDIRIGIR
VOZ

Infraestructura de voz sin atarte a un agente.

stt.partial
STT en tiempo real

Transcripciones parciales en menos de 300 ms. Español primero, multilingüe por diseño.

tts.first_audio
TTS en streaming

Primer audio por frase, no por respuesta. La voz empieza mientras el modelo todavía piensa.

turn.barge_in
Turnos y barge-in

Interrumpe al agente con tu voz. El runtime gestiona los turnos para que tu código no tenga que hacerlo.

latency.turn
Trazado de latencia

Cada tramo medido, cada conversación trazada. Consulta la línea de tiempo por llamada.

stt.final · es · 142ms
TELEFONÍA

Convierte cualquier llamada en un stream programable.

Trae tu troncal SIP o tu centralita — Asterisk, 3CX, tu operador — y cada llamada se convierte en una sesión que controla tu software. Entrantes, salientes, transferencias, DTMF.

Tu troncalAsterisk · 3CX · operador SIP
letsylabs
DISPONIBLE EN GA
Números gestionadosnúmeros · colas · softphone
letsylabs
PRÓXIMAMENTE
Usa tu operador. O el nuestro, más adelante. Nunca atado.
CUMPLIMIENTO EUROPEO POR DISEÑO

La ley ya lo exige. Nosotros lo traemos de serie.

La Ley 10/2025 de España y el AI Act de la UE exigen que las IA que llaman se identifiquen, ofrezcan transferencia a una persona y mantengan registros. letsylabs lo incluye como infraestructura: aviso automático de IA al inicio de la llamada, transferencia garantizada a una persona, marcado de audio sintético y un registro de auditoría exportable y certificado por llamada.

Aviso de IA

Se informa a quien llama de que habla con una IA desde el inicio. Automático, registrado, verificable.

Transferencia a humano

Una vía garantizada de transferencia a una persona, a petición o por regla.

Registro de auditoría

Un registro de eventos certificado y exportable por llamada. Cada aviso, cada transferencia.

Controles de retención

Retención de grabaciones, borrado y rectificación — configurados, no programados.

AUTOALOJAMIENTO Y SOBERANÍA

Tu infraestructura. Tus datos. Un solo comando.

Ejecuta toda la plataforma en tus servidores con docker compose — incluidos los modelos de STT y TTS de pesos abiertos, así el audio nunca sale de tu infraestructura. La misma pila que ejecutamos en nuestro cloud.

Autoalojado(CON LICENCIA)
Misma API, misma pila.
Cloud gestionado
Misma API, misma pila.
your-server
$ docker compose up -d
✔ letsy-gateway Started 0.4s
✔ letsy-stt Started 1.1s · voxtral, open weights
✔ letsy-tts Started 1.3s · open weights
✔ letsy-trace Started 0.6s
runtime ready wss://0.0.0.0:8443/audio
CÓDIGO ABIERTO

Abierto donde importa.

Los contratos principales, VAD y los adaptadores de modelos de pesos abiertos son Apache 2.0. Construye con los mismos tipos que usamos nosotros — hoy en Rust, pronto en Python.

letsy-types

Contratos de sesión, eventos y fotogramas de audio. Los tipos que todo el sistema habla.

Apache-2.0Rust
letsy-vad

Detección de actividad de voz afinada para la conversación, no para el dictado.

Apache-2.0Rust
letsy-adapters

Adaptadores de modelos de pesos abiertos — Voxtral y compañía.

Apache-2.0Rust
BINDINGS DE PYTHON: 2027
DESARROLLADORES

Del primer stream a producción.

ILUSTRATIVO · SNIPPETS FINALES EN GA
# 1. create a session bound to your connector
curl -X POST https://api.letsylabs.com/v1/sessions \
  -H "Authorization: Bearer $LETSY_KEY" -d '{ "connector": "my-agent" }'

# 2. stream audio over the returned ws_url
websocat "wss://api.letsylabs.com/v1/audio?session=01JD…"
let session = letsy::Session::create("my-agent").await?;
let mut events = session.connect().await?;
while let Some(ev) = events.next().await {
    if let Event::TranscriptFinal(t) = ev {
        agent.reply(&t.text).await?;
    }
}
# letsy-py lands in 2027 — same contracts, same events
session = letsy.Session.create(connector="my-agent")
async for ev in session.events():
    if ev.type == "transcript.final":
        await agent.reply(ev.text)
<1s
voz a vozOBJETIVO
20ms
fotogramas de audioOBJETIVO
100%
eventos trazadosOBJETIVO

La voz es el primer sentido.

VozMedios en tiempo realVisiónAvataresDispositivosPRÓXIMAMENTE

letsylabs está construido como la capa de interacción entre el software inteligente y el mundo real. La estamos lanzando un sentido cada vez.

Construye IA de voz que aguante en producción — y en una auditoría.

Acceso anticipado

Todavía no hay formulario en línea — esto abre tu cliente de correo.

{PRIVACY_NOTICE} Política de privacidad

GA llega en marzo de 2027 · los pilotos de acceso anticipado obtienen condiciones fundacionales