{"omc_version":"0.1","id":"nvidia-parakeet-tdt-0-6b-v3","name":"Parakeet TDT 0.6b v3","provider":"NVIDIA","released":"2025-08-04","licence":"Creative Commons Attribution 4.0","url":"https://huggingface.co/nvidia/parakeet-tdt-0.6b-v3","description":"Parakeet TDT is a tiny downloadable speech-to-text model from NVIDIA that turns audio into written words at extraordinary speed — an hour of audio in under a second on benchmark hardware. It is extremely accurate on clean read-aloud content but far less so on accented speech or recorded meetings, and it must be self-hosted as no commercial providers currently offer it.","modalities":["audio"],"context_window":null,"capabilities":{"transcription":3},"x_llmap_capability_sources":{"transcription":{"suite":"asr-wer","suite_name":"Open ASR WER","rank":34,"of":74,"score":5.661428571,"higher_is_better":false,"variant":null}},"relationships":[{"type":"successor-of","id":"nvidia-parakeet-tdt-0-6b-v2"},{"type":"same-family","id":"nvidia-parakeet-tdt-1-1b"},{"type":"same-family","id":"nvidia-parakeet-tdt-0-6b-v2"}],"card_meta":{"created":"2026-08-01T22:45:52.329Z","created_by":"LLMap pipeline","last_updated":"2026-08-03T20:17:37.469Z","source":"https://llmap.ai/models/nvidia-parakeet-tdt-0-6b-v3","omc_spec":"https://github.com/openmodelcard/spec"}}