FastAPI
vLLM
Part 1:翻訳推論サーバーのスケールを阻むボトルネック
FastAPI + マルチプロセッシング構成における、GPU効率化を妨げるアーキテクチャ上のボトルネックの特定と分析
Ashar Mirza - VoicePing
3 min
VoicePingのベンチマーク、評価手法、モデル評価、プロダクト研究をご紹介します。
30件の記事
FastAPI + マルチプロセッシング構成における、GPU効率化を妨げるアーキテクチャ上のボトルネックの特定と分析

Python、aiohttp、BeautifulSoupを用いた、大規模データ収集向け効率的な非同期Webクローラーの開発

顔分析、姿勢推定、感情検出のための動画前処理パイプラインの構築に関する研究レポートです。

Llama 3.1を用いた中英翻訳のファインチューニングとハルシネーション軽減戦略に関する研究

Llama 3.1を用いた英中双方向翻訳におけるRAFT手法の検証

AISHELL-3データセットとBert-VITS2フレームワークを活用した中国語音声合成システムの開発に関する研究レポートです。