vLLMプロジェクトが開発・維持する、オープンソースの「プログラムで制御できるMixture-of-Models(用途ごとに複数モデルを使い分ける方式)ルーター」です。リクエストの信号やユーザー設定、アプリケーションポリシーを評価し、GPU・アクセラレータ・エッジ・クラウドなど異なるコンピュート環境の中から各リクエストに最適なモデルパスを選択・構成します。複数モデルを専門性に応じて組み合わせたり、エッジ・プライベート・クラウド間でのデータ配置を管理したりする機能を持ち、PyTorch、Kubernetes、LoRA、OpenVINO、ONNXなどに対応しています。

ライセンスはApache-2.0で、AMDがGPUリソースとROCmソフトウェアをスポンサーとして提供しています。GitHub上のスター数は5.5k、フォーク数は892、Issue数は299、プルリクエスト数は129、メインブランチのコミット数は2,021件です。現在はコードネーム「Themis」のv0.3までリリースされています。

出典が伝えている要点

  • vllm-project/semantic-router は vLLM プロジェクトが開発・維持している。
  • AMD が GPU リソースと ROCm ソフトウェアをスポンサーとして提供している。
  • ライセンスは Apache-2.0。
  • プロジェクトは「プログラムで可能な Mixture-of-Models ルーター」と説明されている。
  • リクエスト信号、ユーザー設定、アプリケーションポリシーを評価して各リクエストに適切なモデルパスを選択・構成する機能を持つ。
  • GPU、アクセラレータ、エッジ、クラウドなど異なるコンピュート環境間でのルーティングに対応する。
  • エッジ、プライベート、クラウド間でのデータ位置管理機能を持つ。
  • PyTorch、Kubernetes、LoRA、OpenVINO、ONNXなどの技術・バインディングに対応している。
  • GitHub上でのスター数は5.5k、フォーク数は892。
  • Issue数は299、Pull Request数は129。
  • メインブランチのコミット数は2,021。
  • v0.3(コードネーム「Themis」)までリリースされている。

原文より

リクエスト信号、ユーザー設定、アプリケーションポリシーを評価して、各リクエストに適切なモデルパスを選択または構成する

出典: github.com

← 2026.09.03 の号を通しで読む