kapynAI / Models

Meta's new real-time audio model is the foundation for AI assistants that never stop listening

Muse Voice Transcribe is Meta’s new real‑time audio model that transcribes speech in 80‑millisecond chunks. The model distinguishes speakers, detects sentence boundaries, and claims the most accurate streaming transcription at the lowest price, positioning it as a core component for always‑listening AI assistants on devices like Meta’s camera glasses. This advancement could lower latency and cost for developers building conversational agents that need continuous audio input.

The Decoder·Sep 6, 2026

Opening Kapyn…