{"omc_version":"0.1","id":"nvidia-canary-1b-v2","name":"Canary 1b v2","provider":"NVIDIA","released":"2025-08-04","licence":"Creative Commons Attribution 4.0","url":"https://huggingface.co/nvidia/canary-1b-v2","description":"Canary 1b v2 is a small downloadable speech-to-text model from NVIDIA that turns audio into written text. It is extremely fast and accurate on clean read-aloud audio, but its accuracy drops sharply in noisy or conversational settings.","modalities":["audio"],"context_window":null,"capabilities":{"transcription":2.5},"x_llmap_capability_sources":{"transcription":{"suite":"asr-wer","suite_name":"Open ASR WER","rank":51,"of":74,"score":6.391428571,"higher_is_better":false,"variant":null}},"relationships":[{"type":"same-family","id":"nvidia-canary-1b"}],"card_meta":{"created":"2026-08-01T22:45:49.359Z","created_by":"LLMap pipeline","last_updated":"2026-08-03T20:17:36.059Z","source":"https://llmap.ai/models/nvidia-canary-1b-v2","omc_spec":"https://github.com/openmodelcard/spec"}}