Strix Halo LLM Benchmark

10 lokale LLMs auf AMD Ryzen AI MAX+ 395 (Strix Halo) getestet — 14 Tasks, 222 A/B-Vergleiche. Welches Modell für welchen Zweck?

10
Modelle
14
Tasks
222
Vergleiche
128GB
RAM
ROCm
gfx1151

🏆 Leaderboard

Sortiert nach Ø Platzierung, bei Gleichstand nach ELO. Cloud-Modelle (Qwen 3 Max, GLM 5.2, Mistral Small 4) ausgeklammert.

#ModellØ PlatzTasksELO#1 SiegeBeste Kategorie

📊 Top 3 pro Kategorie

💡 Wann welches Modell?

🔍 Outputs ansehen

Wähle Task und Modell — der Output erscheint direkt hier.

Task und Modell wählen, um Output zu sehen…

📋 Alle Per-Task Ergebnisse

Methodik: Alle Modelle liefen über LM Studio (Q4_K_M, MTP wo verfügbar) oder Cloud-Provider (OpenRouter, NIM, Ollama). Jeder Task wurde einmal pro Modell ausgeführt — keine Retries, keine Nachbesserung. Research-Tasks wurden per A/B-Ranking bewertet, visuelle Tasks manuell per Side-by-Side. ELO-System mit K=32, Swiss Pairing. Unvollständige Outputs als [INCOMPLETE] markiert — das IST das Benchmark-Ergebnis.