Presentation Information
[B-6-54]Cost-Efficiency Evaluation of Node Configurations in Distributed LLM Inference Using Cloud GPUs
◎△Takeru Kono1, Atuya Kanno2, Nagisa Nasu2, Kaichi Taguti2, Takahiro Koita2, Akihito Kohiga1 (1. Doshisha Univ., 2. Graduate School of Doshisha Univ.)
Keywords:
Mesh-LLM,AmazonWebService,Large Language Model / LLM,Distributed Inference,EC2Instance
