Passei meses pagando o Whispr Flow porque não sabia disso antes.
O macOS 26 abriu o Apple Speech pra qualquer app a bastante tempo, sim, o mesmo motor de transcrição que a Apple usa no sistema. Swift puro, on-device, sem API key, sem servidor. Escrevi o meu em cima dele.
M5, pt-BR: 27,7s de áudio em 0,37s. 75x tempo real.
Reformatar o texto em Markdown com Foundation Models: +0,6s, local também.
Reunião sobe dois SpeechAnalyzer em paralelo: um no microfone, outro no ScreenCaptureKit pro áudio do sistema. Dois streams, transcrição lado a
lado ao vivo.
Se você também tava pagando por isso, roda em Apple Silicon, repo no primeiro comentário.