Python
Apple Silicon上でローカルLLMを最大2倍高速化するMTPLX
MTPLXは、Qwen 3.5-3.8のような最新モデルの組み込みMTPヘッドを活用し、Apple Siliconで最大2.24倍の高速化を達成します。ドラフトモデルが不要です。
言語
ホーム言語
セクション
MTPLXは、Qwen 3.5-3.8のような最新モデルの組み込みMTPヘッドを活用し、Apple Siliconで最大2.24倍の高速化を達成します。ドラフトモデルが不要です。
エンジニアのAndrey Mikhailovが、Swift/Metalで書かれたカスタムランタイムTurboFieldfareを構築しました。これは基本的なMacBook Air M2の上でわずか2 GBのRAMでGoogleのGemma 4 26B-A4Bモデルを実行します。
MLX-AudioがApple Silicon Macに超高速のTTS、STT、STS機能をもたらします。AppleのMLXフレームワーク 기반으로、Whisper、Kokoro、声のクローンなどに対応し、クラウドコストなしでローカル実行。