← Back to list

Strix Halo 에서 Gemma 4 성능 기록

HP Zbook Ultra G1a , Windows 11에서.

bzImage · 2026-08-20 12:13 · 0 claps · 0.9 min read
#lemonade #local-llm #gemma-4 #qwen
Open on Medium ↗
Wiki topics: LLM · Large Language Models 🥊 · Combat Sports

Strix Halo 에서 Gemma 4 성능 기록

HP Zbook Ultra G1a , Windows 11에서.

Lemonade 10.10.0 시점 벤치. 자체 내장 벤치 기능.

Vulkan GPU, Gemma 4

Model, min. TTFT (ms), TPS (tokens/second)

E2B, 49.5, 96.98

E4B, 95.6, 50.97

12B-MTP, 201.8, 46.08

26B-A4B-MTP, 154.3, 72.09

31B-MTP, 477.1, 25.31

31B (non MTP), 503.6, 10.95

Qwen 3.6 35B-A3B-MTP, 160.4, 64.96

Fastflow LLM

Model, min. TTFT (ms), TPS (tokens/second)

E2B, 850.16, 22.49

E4B, 1212.71, 12.26

  1. MTP는 TPS를 크게 개선함. 특히 큰 모델일수록.
  2. 26B A4B MTP 가 E2B 다음으로 가장 빠른 TPS를 달성함.
  3. E2B 는 아무튼 빠름.
  4. E4B 는 생각보다 느림. TTFT도 12B-MTP 수준.
  5. E2B NPU가 GPU 31B-MTP 보다 느려서 실 사용이 너무 어려움.

메타데이터
post_id
e6821d742e8f
slug
strix-halo-에서-gemma-4-성능-기록-e6821d742e8f
url
https://medium.com/@dhunterz/strix-halo-%EC%97%90%EC%84%9C-gemma-4-%EC%84%B1%EB%8A%A5-%EA%B8%B0%EB%A1%9D-e6821d742e8f
canonical_url
https://medium.com/@dhunterz/strix-halo-%EC%97%90%EC%84%9C-gemma-4-%EC%84%B1%EB%8A%A5-%EA%B8%B0%EB%A1%9D-e6821d742e8f
author_url
https://medium.com/@dhunterz
status
ok
fetched_at
2026-08-27 00:25:59