TorchServe は保守されなくなり、チームが GPU 推論スタック全体を所有することになります。 AWS Ray Serve Deep Learning Container は、フレームワーク、GPU ドライバー、およびサービス層を備えた、サポートされ、事前にテストされたコンテナです。
コンピューティングの供給、エネルギー、データセンターの容量によって、AI をいかに安価に実行できるかが決まります。インフラストラクチャの変化は数週間後に推論コストに現れます。
概要は情報提供のみを目的としてまとめられています。全文についてはソース リンクを参照してください。デモのエントリは一例です。