IT뉴스모아news terminal

article detail

노타, 이기종 컴퓨팅 기반 AI 추론 기술 개발..."GPU·NPU 역할 분배가 핵심"

AI타임스AIPCAI추론GPULLMNPU에너지효율온디바이스이기종컴퓨팅
2026. 6. 4. 오후 12:27
노타, 이기종 컴퓨팅 기반 AI 추론 기술 개발..."GPU·NPU 역할 분배가 핵심"

AI 요약

노타(대표 채명수)는 AI PC 환경에서 GPU와 NPU 등을 동시 활용하는 이기종 컴퓨팅 기반 대형언어모델(LLM) 추론 최적화 기술을 구현했다고 4일 밝혔습니다. 인텔 루나 레이크 기반 AI PC에 입력 처리 연산은 GPU에서, 답변 생성 연산은 NPU에서 실행하는 분리형 추론 방식을 적용해 단일 GPU 대비 토큰당 에너지 소비를 약 32% 줄이고 생성 처리량을 약 12% 높였으며 단일 NPU 대비 첫 응답 지연시간을 약 89% 단축했다고 설명했습니다. 노타는 모델 경량화와 런타임·하드웨어 최적화를 통해 AI PC 환경에서 온디바이스 AI 사용자 경험을 개선하겠다고 강조했습니다.

원문보기
feed://articles/related관련 기사
노타, 이기종 컴퓨팅 기반 LLM 최적화 구현…"실행효율 제고 노력"네이트
2026. 6. 4. 오전 8:53

노타, 이기종 컴퓨팅 기반 LLM 최적화 구현…"실행효율 제고 노력"

LLM이기종컴퓨팅추론최적화AIPCNPUGPU온디바이스AI에너지효율
[테크스냅] AI PC서 GPU·NPU 분산 활용…노타, LLM 추론 효율 높인다네이트
2026. 6. 4. 오전 9:10

[테크스냅] AI PC서 GPU·NPU 분산 활용…노타, LLM 추론 효율 높인다

AIPCGPUNPULLM추론최적화이기종컴퓨팅에너지효율벤치마크
노타, GPU·NPU 동시 활용 AI 추론 기술 구현에 13%↑[특징주]이데일리
2026. 6. 4. 오전 9:11

노타, GPU·NPU 동시 활용 AI 추론 기술 구현에 13%↑[특징주]

AI추론GPUNPULLM이기종컴퓨팅에너지효율온디바이스AI추론최적화
노타, GPU·NPU 분산 추론으로 AI PC LLM 효율 개선e4ds news
2026. 6. 4. 오후 1:57

노타, GPU·NPU 분산 추론으로 AI PC LLM 효율 개선

AIPCLLMGPUNPU추론최적화이기종컴퓨팅에너지효율시스템최적화
노타, 'AI PC' GPU·NPU 동시 활용 최적화 기술 구현전자신문
2026. 6. 4. 오전 10:22

노타, 'AI PC' GPU·NPU 동시 활용 최적화 기술 구현

AIPCGPUNPULLM추론최적화이기종컴퓨팅온디바이스AI에너지효율
[테크스냅] AI PC서 GPU·NPU 분산 활용…노타, LLM 추론 효율 높인다네이트
2026. 6. 4. 오전 9:10

[테크스냅] AI PC서 GPU·NPU 분산 활용…노타, LLM 추론 효율 높인다

AIPCGPUNPULLM추론에너지효율벤치마크디지털트윈
노타, 이기종 컴퓨팅 기반 LLM 최적화 기술 구현네이트
2026. 6. 4. 오전 9:12

노타, 이기종 컴퓨팅 기반 LLM 최적화 기술 구현

LLM최적화이기종컴퓨팅AIPCGPUNPU추론기술에너지효율처리량
노타, 이기종 컴퓨팅 기반 거대언어모델 최적화…AI PC 효율 제고네이트
2026. 6. 4. 오전 8:53

노타, 이기종 컴퓨팅 기반 거대언어모델 최적화…AI PC 효율 제고

거대언어모델AIPC분리형추론이기종컴퓨팅NPUGPU에너지효율추론최적화
노타, 이기종 컴퓨팅 기반 거대언어모델 최적화…AI PC 효율 제고네이트
2026. 6. 4. 오전 8:53

노타, 이기종 컴퓨팅 기반 거대언어모델 최적화…AI PC 효율 제고

AI최적화이기종컴퓨팅거대언어모델분리형추론에너지효율AIPCNPUGPU
노타, GPU·NPU 역할 분담으로 온디바이스 AI 효율 높인다네이트
2026. 6. 4. 오후 2:12

노타, GPU·NPU 역할 분담으로 온디바이스 AI 효율 높인다

온디바이스AIGPUNPU이기종컴퓨팅LLM추론최적화분리형추론에너지효율
[테크스냅] AI PC서 GPU·NPU 분산 활용…노타, LLM 추론 효율 높인다연합뉴스
2026. 6. 4. 오전 9:09

[테크스냅] AI PC서 GPU·NPU 분산 활용…노타, LLM 추론 효율 높인다

AIPCGPUNPULLM추론에너지효율D데이터디지털트윈
[테크스냅] AI PC서 GPU·NPU 분산 활용…노타, LLM 추론 효율 높인다연합뉴스
2026. 6. 4. 오전 9:09

[테크스냅] AI PC서 GPU·NPU 분산 활용…노타, LLM 추론 효율 높인다

AIPCGPUNPULLM추론에너지효율디지털트윈D