vLLMプロジェクトが開発・維持する、オープンソースの「プログラムで制御できるMixture-of-Models(用途ごとに複数モデルを使い分ける方式)ルーター」です。リクエストの信号やユーザー設定、アプリケーションポリシーを評価し、GPU・アクセラレータ・エッジ・クラウドなど異なるコンピュート環境の中から各リクエストに最適なモデルパスを選択・構成します。複数モデルを専門性に応じて組み合わせたり、エッジ・プライベート・クラウド間でのデータ配置を管理したりする機能を持ち、PyTorch、Kubernetes、LoRA、OpenVINO、ONNXなどに対応しています。
ライセンスはApache-2.0で、AMDがGPUリソースとROCmソフトウェアをスポンサーとして提供しています。GitHub上のスター数は5.5k、フォーク数は892、Issue数は299、プルリクエスト数は129、メインブランチのコミット数は2,021件です。現在はコードネーム「Themis」のv0.3までリリースされています。
出典が伝えている要点
- vllm-project/semantic-router は vLLM プロジェクトが開発・維持している。
- AMD が GPU リソースと ROCm ソフトウェアをスポンサーとして提供している。
- ライセンスは Apache-2.0。
- プロジェクトは「プログラムで可能な Mixture-of-Models ルーター」と説明されている。
- リクエスト信号、ユーザー設定、アプリケーションポリシーを評価して各リクエストに適切なモデルパスを選択・構成する機能を持つ。
- GPU、アクセラレータ、エッジ、クラウドなど異なるコンピュート環境間でのルーティングに対応する。
- エッジ、プライベート、クラウド間でのデータ位置管理機能を持つ。
- PyTorch、Kubernetes、LoRA、OpenVINO、ONNXなどの技術・バインディングに対応している。
- GitHub上でのスター数は5.5k、フォーク数は892。
- Issue数は299、Pull Request数は129。
- メインブランチのコミット数は2,021。
- v0.3(コードネーム「Themis」)までリリースされている。
原文より
リクエスト信号、ユーザー設定、アプリケーションポリシーを評価して、各リクエストに適切なモデルパスを選択または構成する
出典: github.com