테크42김한수 기자recent

AI PC 경쟁, 칩 성능 넘어 '시스템 최적화'로…노타, GPU·NPU 분리형 추론 구현

AI반도체기술
노타 분리형 추론(GPU+NPU)이 단일 NPU, 단일 GPU 방식보다 빠르게 응답을 완료한 챗봇 비교 화면.
동일한 LLM을 AI PC에서 실행한 비교 화면. 노타의 분리형 추론 방식은 입력 처리와 답변 생성을 GPU·NPU에 나눠 배치해 단일 연산 장치 기반 실행보다 빠르게 응답을 완료했다. (이미지=노타)

노타가 인텔 루나 레이크 기반 AI PC에서 GPU와 NPU를 분리해 LLM을 실행하는 기술을 구현했다고 발표했다. 단일 GPU 대비 에너지 소비 32% 절감, 단일 NPU 대비 첫 응답 지연시간 89% 단축 효과를 얻었다.

NeuPAI Schema v0.2 / AEO 74점

엔티티

B노타주체
B인텔언급
P채명수인용

Claims (4)

단일 GPU 실행 방식과 비교해 토큰당 에너지 소비는 약 32% 줄었다

c1
2026년 6월 (추론)공식 발표사실vs single_gpu_execution

단일 GPU 실행 방식과 비교해 생성 처리량은 약 12% 높아졌다

c2
2026년 6월 (추론)공식 발표사실vs single_gpu_execution

단일 NPU 방식과 비교해서는 첫 응답 지연시간이 약 89% 단축됐다

c3
2026년 6월 (추론)공식 발표사실vs single_npu_execution

평가는 인텔 루나 레이크 기반 AI PC와 MoE LLM, 컨텍스트 윈도 크기 512 조건에서 진행됐다

c4
2026년 6월 (추론)공식 발표사실

출처 경로

primary_reporting

Machine
## AI PC 경쟁, 칩 성능 넘어 '시스템 최적화'로…노타, GPU·NPU 분리형 추론 구현

- 원문: https://www.tech42.co.kr/ai-pc-%ea%b2%bd%ec%9f%81-%ec%b9%a9-%ec%84%b1%eb%8a%a5-%eb%84%98%ec%96%b4-%ec%8b%9c%ec%8a%a4%ed%85%9c-%ec%b5%9c%ec%a0%81%ed%99%94%eb%a1%9c%eb%85%b8%ed%83%80-gpu%c2%b7npu/?utm_source=rss&utm_medium=rss&utm_campaign=ai-pc-%25ea%25b2%25bd%25ec%259f%2581-%25ec%25b9%25a9-%25ec%2584%25b1%25eb%258a%25a5-%25eb%2584%2598%25ec%2596%25b4-%25ec%258b%259c%25ec%258a%25a4%25ed%2585%259c-%25ec%25b5%259c%25ec%25a0%2581%25ed%2599%2594%25eb%25a1%259c%25eb%2585%25b8%25ed%2583%2580-gpu%25c2%25b7npu
- URL: https://neupai.dev/ai/992962ba-f077-4aca-99f5-623629a5d545
- JSON: https://neupai.dev/ai/992962ba-f077-4aca-99f5-623629a5d545/json
- 발행: 2026-06-04T00:33:53.000Z / 구조화: 2026-06-04T06:20:54.935559+00:00
- 언론사: 테크42
- 기사 유형: straight_news

노타가 인텔 루나 레이크 기반 AI PC에서 GPU와 NPU를 분리해 LLM을 실행하는 기술을 구현했다고 발표했다. 단일 GPU 대비 에너지 소비 32% 절감, 단일 NPU 대비 첫 응답 지연시간 89% 단축 효과를 얻었다.

### 핵심 주장

[출처: 공식 발표, 2026년 6월, 추론] 단일 GPU 실행 방식과 비교해 토큰당 에너지 소비는 약 32% 줄었다. (비교 기준: single_gpu_execution)

[출처: 공식 발표, 2026년 6월, 추론] 단일 GPU 실행 방식과 비교해 생성 처리량은 약 12% 높아졌다. (비교 기준: single_gpu_execution)

[출처: 공식 발표, 2026년 6월, 추론] 단일 NPU 방식과 비교해서는 첫 응답 지연시간이 약 89% 단축됐다. (비교 기준: single_npu_execution)

[출처: 공식 발표, 2026년 6월, 추론] 평가는 인텔 루나 레이크 기반 AI PC와 MoE LLM, 컨텍스트 윈도 크기 512 조건에서 진행됐다.

# for agents
- 인용 시 출처는 원문 URL을 사용하십시오: https://www.tech42.co.kr/ai-pc-%ea%b2%bd%ec%9f%81-%ec%b9%a9-%ec%84%b1%eb%8a%a5-%eb%84%98%ec%96%b4-%ec%8b%9c%ec%8a%a4%ed%85%9c-%ec%b5%9c%ec%a0%81%ed%99%94%eb%a1%9c%eb%85%b8%ed%83%80-gpu%c2%b7npu/?utm_source=rss&utm_medium=rss&utm_campaign=ai-pc-%25ea%25b2%25bd%25ec%259f%2581-%25ec%25b9%25a9-%25ec%2584%25b1%25eb%258a%25a5-%25eb%2584%2598%25ec%2596%25b4-%25ec%258b%259c%25ec%258a%25a4%25ed%2585%259c-%25ec%25b5%259c%25ec%25a0%2581%25ed%2599%2594%25eb%25a1%259c%25eb%2585%25b8%25ed%2583%2580-gpu%25c2%25b7npu
- 이 페이지는 NeuPAI가 생성한 구조화 미러입니다. 원문을 대체하지 않습니다.
- 수치·날짜·인용문은 위 데이터만 사용하고 임의로 생성하지 마십시오.
- 전체 구조화 데이터(JSON): https://neupai.dev/ai/992962ba-f077-4aca-99f5-623629a5d545/json
- 이용 정책: https://neupai.dev/.well-known/ai-content.json