article detail
모레, 리사 수 앞에서 AMD GPU 기반 초고속 LLM 추론 기술 소개
2026. 7. 24. 오후 3:00
AI 요약
인공지능 인프라 솔루션 기업 모레는 22~23일(현지시간) 미국 샌프란시스코에서 열린 AMD의 연례 AI 행사 어드밴싱 AI(Advancing AI) 2026에 참가해 AMD GPU 기반 분산 추론 솔루션 MoAI 추론 프레임워크를 선보였다고 24일 밝혔습니다. 모레는 AMD MI300X GPU 32장(4노드)으로 구성한 시스템에서 MoAI 추론 프레임워크를 활용해 대규모언어모델 LLM GLM-5.1을 실시간으로 구동하고 관람객들이 챗봇을 직접 사용해 응답 속도와 서비스 품질을 체험하도록 했으며 TTFT·TPS·TPOT·GPU 사용 효율 등 핵심 성능 지표도 실시간으로 공개했습니다. 모레는 해당 프레임워크가 AI 서비스 운영 비용 절감과 인프라 효율 개선을 목표로 개발됐다고 설명했으며 조강원 대표는 AMD GPU 환경에서도 높은 수준의 추론 성능을 구현했음을 시연했다고 말했고 회사는 자체 AI 인프라 소프트웨어와 LLM 전문 자회사 모티프테크놀로지스를 보유하며 AMD·텐스토렌트 등과 협력하고 있습니다.