Python
SGLang-Omniで音声・マルチモーダルモデルの高速推論を設定する方法
SGLang-Omniは、音声エンコーディングから音声合成までの複雑なパイプラインを処理する、音声・マルチモーダルモデルのマルチステージ推論に特化したランタイムを提供します。
言語
ホーム言語
セクション
SGLang-Omniは、音声エンコーディングから音声合成までの複雑なパイプラインを処理する、音声・マルチモーダルモデルのマルチステージ推論に特化したランタイムを提供します。
transcribe.cppは、Python依存なしで任意のハードウェアで動作する軽量なC/C++音声認識ライブラリです。16のモデルファミリー、複数のバックエンド、GGUF量子化をサポートしています。