Skip to content
Yapr
GratisTecnologíaCasos de usoCómo funcionaAyuda
Iniciar sesiónTry for free
Yapr

La transcripción de voz más rápida y precisa del mundo. Gratis.

Yapr Inc. 131 Hazelton Avenue, Yorkville Toronto, ON M5R 2E4, Canadá

Producto

Abrir app

Explorar

GratisTecnologíaCasos de UsoCómo FuncionaCentro de AyudaCompararHerramientas

Legal

PrivacidadTérminosCookies

© 2026 Yapr Inc. Todos los derechos reservados.

Hecho a todo volumen por Meridii

Tecnología

EL MOTOR.

Stack de IA de nivel enterprise. Velocidad, precisión y privacidad, sin ceder ni un milímetro.

DeepInfra GPU · IA de voz de otro nivel · TLS 1.3 + AES-256 · audio eliminado al instante

Empezar gratis
Infraestructura

POWERED
BY
DEEPINFRA

01

Clusters GPU globales

DeepInfra opera una red global de GPUs dedicadas. Cada request va al nodo más cercano, latencia baja, siempre, estés donde estés.

02

SLA enterprise, sin letra pequeña

La infra de DeepInfra está construida a nivel enterprise, la misma que usan empresas que procesan cientos de millones de requests de IA al día.

03

Cold starts, eliminados

Corremos exclusivamente en endpoints dedicados siempre calientes. Sin cold starts, sin esperas, sin colas. Tu request llega y el modelo ya está listo.

04

Escala sin perder pisada

Seas el primero del día o el diez mil, el sistema escala horizontal sin degradación. Punto.

Modelo

Modelos de última generación.
El estándar de oro.

Arquitectura

Transformer

Arquitectura profunda encoder-decoder basada en Transformer, entrenada end-to-end con cientos de miles de horas de audio multilingüe real.

Parámetros

1.5B+

1.500 millones de parámetros aprendidos, entrenados en 680.000 horas de audio multilingüe, uno de los datasets de entrenamiento de voz más grandes jamás reunidos.

Idiomas

100+

Comprende nativamente más de 100 idiomas hablados. Sin configuración, el idioma se detecta automáticamente, incluso si cambias a mitad de frase.

WER (inglés)

2.7%

Tasa de error de palabras del 2,7% en benchmarks estándar, acercándose a la precisión humana en acentos, dialectos y ruido ambiental.

Pipeline

De voz a texto
en menos de 2 segundos.

Seis etapas. Todas al máximo. El audio entra, el texto sale, nada se queda.

MIC

Capturado

CODIF.

WebM/Opus

BUFFER

API Path

INFERIR

DeepInfra

RETORNO

< 1,8s

BORRAR

Permanente

01

Captura en el navegador

El audio se captura nativamente en tu navegador usando la WebAudio API. Sin plugins, sin extensiones, sin descargas. Funciona en cualquier dispositivo moderno.

02

Codificación eficiente

El audio se codifica en formato WebM/Opus, un códec diseñado específicamente para voz. Minimiza el tamaño y el tiempo de subida preservando cada fonema.

03

Staging temporal

Los archivos pasan brevemente por Yapr API antes de la inferencia. Esto permite procesar grabaciones de cualquier duración sin restricciones de timeout.

04

Inferencia IA

Tu audio se envía al endpoint dedicado de DeepInfra. Modelos de voz de punta corriendo en GPU dedicadas, sin colas compartidas, sin cold start, sin demora.

05

Retorno instantáneo

El texto transcrito vuelve directo a tu navegador vía nuestra API. El tiempo medio de ida y vuelta es menor a 1,8 segundos para grabaciones de menos de 60 segundos.

06

Eliminación permanente

En el instante que termina la transcripción, el audio se borra de Yapr API. La eliminación es automática, irreversible e inmediata.

0.2%

precisión de palabras

0K hrs

datos de entrenamiento

0+

idiomas

0-bit

cifrado AES

0.9%

SLA de uptime

0bytes

audio retenido

Precisión

99,2%
Precisión
en palabras.

Benchmarkeado de forma independiente. Medido en acentos, ruidos, velocidades y contextos. No es copy de marketing, es una medición verificada.

Hablantes nativos de inglés

99.4%

Hablantes no nativos de inglés

98.8%

Vocabulario técnico

98.1%

Entornos ruidosos

97.2%

Cambio de idioma (2 idiomas)

96.9%

Arquitectura de privacidad

Cero retención.
No es política.
Es arquitectura.

01

Sin capa de almacenamiento de audio

El sistema está diseñado sin una capa de almacenamiento de audio. El audio entra al pipeline solo para generar texto. No hay bucket de largo plazo, no hay tier de archivo, no hay backup de archivos de audio.

02

Eliminación inmediata

Una arquitectura sin capa de almacenamiento de audio asegura que todos los archivos de audio se eliminen inmediatamente después de la transcripción: sin archivo, sin base de grabaciones, sin capa de retención.

03

TLS 1.3 en tránsito

Todos los datos en tránsito usan TLS 1.3, el estándar de oro actual en cifrado de transporte. Cubre tu navegador, nuestra API y nuestra infraestructura de IA.

04

AES-256 en reposo

El texto de las transcripciones y los datos de cuenta se almacenan en particiones de base de datos cifradas con AES-256-GCM con rotación de claves. El cifrado se aplica a nivel de infraestructura, no de aplicación.

05

Autenticación segura

La autenticación está disponible vía OAuth 2.0 (Google, GitHub), email con hash de contraseña cifrado, o passkeys (WebAuthn). Las contraseñas nunca se almacenan en texto plano. Tus datos biométricos nunca salen de tu dispositivo.

06

Headers de seguridad reforzados

Cada respuesta incluye HSTS, Content-Security-Policy, X-Frame-Options y SameSite=Strict cookies, previniendo XSS, clickjacking y secuestro de sesión por defecto.

07

Separación de metadatos

Los únicos datos almacenados permanentemente son metadatos de uso: timestamps y texto de transcripciones (solo si activas el historial, está desactivado por defecto). El contenido de audio nunca se persiste bajo ninguna condición.

08

Conformidad GDPR + CCPA

Cumplimiento total con GDPR y CCPA. Puedes exportar o eliminar todos tus datos en cualquier momento desde Ajustes. Las solicitudes de eliminación se procesan en un máximo de 30 días.

¿LISTO?
VAMOS.

Sin tarjeta. Gratis desde el primer segundo.

Empezar gratis Cómo funciona