nemotron-3.5-asr-streaming-0.6b-gguf

0.6B open-weight model from handy-computer for local AI inference.

Run nemotron-3.5-asr-streaming-0.6b-gguf locally with Ollama: ollama pull nemotron-3.5-asr-streaming-0.6b:0.6b

Minimum 2GB RAM. Context length: 4096 tokens.