Speech AI models for Apple Silicon via MLX. ASR, TTS, VAD, diarization, speaker embedding.
-
aufklarer/WeSpeaker-ResNet34-LM-MLX
Audio Classification • 6.63M • Updated • 83.7k • 4 -
aufklarer/Qwen3-ASR-0.6B-MLX-4bit
0.3B • Updated • 79.4k • 5 -
aufklarer/Silero-VAD-v5-MLX
Voice Activity Detection • 309k • Updated • 51.5k • 3 -
aufklarer/Qwen3-ForcedAligner-0.6B-4bit
Audio Classification • 0.4B • Updated • 36.7k • 1