Skip to content
Yapr
KostenlosTechnologieEinsatzbereicheSo funktioniert'sHilfe
AnmeldenTry for free
Yapr

Die schnellste und genaueste Sprachtranskription der Welt. Kostenlos.

Yapr Inc. 131 Hazelton Avenue, Yorkville Toronto, ON M5R 2E4, Kanada

Produkt

App öffnen

Entdecken

KostenlosTechnologieAnwendungsfälleSo funktioniert'sHilfezentrumVergleichenTools

Rechtliches

DatenschutzAGBCookies

© 2026 Yapr Inc. Alle Rechte vorbehalten.

Lautstark gemacht von Meridii

Technologie

DIE MASCHINE.

Ernsthafter KI-Stack. Gebaut für Geschwindigkeit, Genauigkeit und kompromisslosen Datenschutz.

DeepInfra GPU · Erstklassige Sprach-KI · TLS 1.3 + AES-256 · Audio sofort gelöscht

Kostenlos starten
Infrastruktur

POWERED
BY
DEEPINFRA

01

Globale GPU-Cluster

DeepInfra betreibt dedizierte GPUs weltweit. Jede Anfrage geht zum nächsten Knoten, Latenz bleibt niedrig, egal wo du bist.

02

Enterprise-SLA ohne Wenn und Aber

DeepInfras Infra ist nach Enterprise-Standards gebaut, dieselbe, der Unternehmen mit hunderten Millionen KI-Anfragen täglich vertrauen.

03

Cold-Starts? Geschichte.

Wir laufen ausschließlich auf dedizierten, immer warmen Endpunkten. Kein Hochfahren, keine Warteschlange. Deine Anfrage kommt, das Modell antwortet sofort.

04

Skaliert ohne Einbußen

Ob du der erste oder der zehntausendste Nutzer des Tages bist, das System skaliert horizontal, die Leistung bleibt konstant.

Modell

Modernste Modelle.
Der Goldstandard.

Architektur

Transformer

Tiefe Transformer-basierte Encoder-Decoder-Architektur, End-to-End trainiert auf Hunderttausenden Stunden realer mehrsprachiger Audiodaten.

Parameter

1.5B+

1,5 Milliarden gelernte Parameter, trainiert auf 680.000 Stunden mehrsprachigem Audio, einer der größten Sprach-Trainingsdatensätze aller Zeiten.

Sprachen

100+

Versteht nativ über 100 gesprochene Sprachen. Keine Konfiguration nötig, die Sprache wird automatisch erkannt, selbst beim Wechsel mitten im Satz.

WER (Englisch)

2.7%

Wortfehlerrate von 2,7 % auf Standard-Benchmarks, nahe an menschlicher Transkriptionsgenauigkeit über Akzente, Dialekte und Hintergrundgeräusche hinweg.

Pipeline

Von der Stimme zum Text
in unter 2 Sekunden.

Sechs Stufen. Alle auf Maximum getrimmt. Audio rein, Text raus, nichts bleibt.

MIC

Aufnahme

ENCODE

WebM/Opus

BUFFER

API Path

ANALYSE

DeepInfra

RETURN

< 1,8s

DELETE

Dauerhaft

01

Browser-Aufnahme

Audio wird direkt im Browser über die WebAudio API aufgenommen. Kein Plugin, keine Erweiterung, kein Download nötig. Funktioniert auf jedem modernen Gerät.

02

Effiziente Kodierung

Audio wird im WebM/Opus-Format kodiert, ein Codec, der speziell für Sprache entwickelt wurde. Minimale Dateigröße und Uploadzeit bei voller Phonem-Genauigkeit.

03

Temporäres Staging

Dateien werden kurz auf Yapr API zwischengespeichert, bevor die Inferenz startet. So können Aufnahmen jeder Länge ohne Serverless-Timeout-Einschränkungen verarbeitet werden.

04

KI-Inferenz

Dein Audio wird an DeepInfras dedizierten KI-Inferenz-Endpunkt gesendet. Modernste Sprachmodelle laufen auf dedizierter GPU-Hardware, keine gemeinsame Warteschlange, kein Cold Start, keine Verzögerung.

05

Sofortige Rückgabe

Der transkribierte Text kommt direkt über unsere API in deinen Browser zurück. Die mediane Round-Trip-Zeit liegt unter 1,8 Sekunden für Aufnahmen unter 60 Sekunden.

06

Dauerhafte Löschung

Sobald die Transkription abgeschlossen ist, wird das Audio von Yapr API gelöscht. Die Löschung ist automatisch, unwiderruflich und sofort.

0.2%

Wortgenauigkeit

0K hrs

Trainingsdaten

0+

Sprachen

0-bit

AES-Verschlüsselung

0.9%

Uptime-SLA

0bytes

Audio gespeichert

Genauigkeit

99,2 %
Wort-
genauigkeit.

Unabhängig benchmarkt. Gemessen über Akzente, Umgebungsgeräusche, Sprechtempo und Sprachen. Kein Marketing-Bluff, eine verifizierte Messung.

Englische Muttersprachler

99.4%

Nicht-Muttersprachler (Englisch)

98.8%

Technisches Vokabular

98.1%

Laute Umgebungen

97.2%

Sprachwechsel (2 Sprachen)

96.9%

Datenschutz-Architektur

Null Speicherung.
Keine Richtlinie.
Eine Architektur.

01

Kein Audio-Speicher-Layer

Das System ist ohne permanente Audio-Speicherschicht konzipiert. Audio wird nur für die Dauer der Inferenz zwischengespeichert. Kein Langzeit-Bucket, kein Archiv-Tier, kein Backup von Audiodateien.

02

Sofortige Löschung

Eine Architektur ohne Audio-Speicherschicht stellt sicher, dass alle Audiodateien sofort nach der Transkription gelöscht werden: kein Archiv, keine Aufnahmendatenbank, keine Retention-Schicht.

03

TLS 1.3 im Transit

Alle Daten im Transit verwenden TLS 1.3, den aktuellen Goldstandard der Transportverschlüsselung. Das umfasst deinen Browser, unsere API, unsere Staging-Schicht und unseren Inferenz-Anbieter.

04

AES-256 at Rest

Transkriptionstext und Kontodaten werden in AES-256-GCM-verschlüsselten Datenbankpartitionen mit Schlüsselrotation gespeichert. Die Verschlüsselung wird auf Infrastrukturebene durchgesetzt, nicht auf Anwendungsebene.

05

Sichere Authentifizierung

Authentifizierung ist verfügbar über OAuth 2.0 (Google, GitHub), E-Mail mit verschlüsseltem Passwort-Hashing oder Passkeys (WebAuthn). Passwörter werden niemals im Klartext gespeichert. Deine Biometrie verlässt niemals dein Gerät.

06

Gehärtete Security Headers

Jede Antwort erzwingt HSTS, Content-Security-Policy, X-Frame-Options und SameSite=Strict Cookies, XSS, Clickjacking und Session-Hijacking werden standardmäßig verhindert.

07

Metadaten-Trennung

Die einzigen dauerhaft gespeicherten Daten sind Nutzungsmetadaten: Zeitstempel und Transkriptionstext (nur wenn du den Verlauf aktivierst, standardmäßig deaktiviert). Audioinhalte werden unter keinen Umständen persistiert.

08

DSGVO + CCPA-Konformität

Volle regulatorische Konformität mit DSGVO und CCPA. Du kannst jederzeit über die Einstellungen alle deine Daten exportieren oder löschen. Löschanfragen werden innerhalb von 30 Tagen bearbeitet.

BEREIT?
LOS GEHT'S.

Keine Karte. Kostenlos ab Tag eins.

Kostenlos starten Wie es funktioniert