Presentation Information

[B-6-54]Cost-Efficiency Evaluation of Node Configurations in Distributed LLM Inference Using Cloud GPUs

◎△Takeru Kono1, Atuya Kanno2, Nagisa Nasu2, Kaichi Taguti2, Takahiro Koita2, Akihito Kohiga1 (1. Doshisha Univ., 2. Graduate School of Doshisha Univ.)

Keywords:

Mesh-LLM,AmazonWebService,Large Language Model / LLM,Distributed Inference,EC2Instance

Password required to view