Speech AI models for Apple Silicon via MLX. ASR, TTS, VAD, diarization, speaker embedding.
-
aufklarer/WeSpeaker-ResNet34-LM-MLX
Audio Classification • 6.63M • Updated • 85.3k • 4 -
aufklarer/Silero-VAD-v5-MLX
Voice Activity Detection • 309k • Updated • 50.5k • 3 -
aufklarer/Qwen3-ASR-0.6B-MLX-4bit
0.3B • Updated • 23.2k • 5 -
aufklarer/Silero-VAD-v6.2.1-MLX
Audio Classification • 309k • Updated • 22.3k • 1