VZMORE AX9 Max im Test: 29 Tokens pro Sekunde mit lokaler KI

Eine KI wie ChatGPT, die komplett auf dem eigenen Rechner läuft: Der VZMORE AX9 Max schafft das mit rund 29 Tokens pro Sekunde, also schneller, als man mitlesen kann. Wir haben geprüft, wie gut die Antworten sind, wie laut der Mini-PC dabei wird und für wen sich der Kauf lohnt.

VZMORE AX9 Max im Test: 29 Tokens pro Sekunde mit lokaler KI

Eine KI wie ChatGPT, die komplett auf dem eigenen Rechner läuft: Der VZMORE AX9 Max schafft das mit rund 29 Tokens pro Sekunde, also schneller, als man mitlesen kann. Wir haben geprüft, wie gut die Antworten sind, wie laut der Mini-PC dabei wird und für wen sich der Kauf lohnt.

Das Wichtigste in Kürze

  • Für wen: Leiser, sparsamer Heimserver oder Büro-PC mit viel Leistung, auf dem sich KI lokal nutzen lässt. Dank V-Cooling bricht die Leistung auch unter Dauerlast nicht ein.
  • Lokale KI: Das Sprachmodell antwortet mit rund 29 Tokens pro Sekunde und erreicht fast Cloud-Qualität (Note 1,8 gegenüber 1,2). Bei KI-Last ist das Gerät mit 47 dB(A) aber deutlich hörbar.
  • Kauf: 1.549 Euro, nur mit 32 GB und 1 TB erhältlich. Mit unserem Code AX9MVZMS gibt es bis 30.11.2026 15 Prozent Rabatt. Der Arbeitsspeicher lässt sich aufrüsten, die Garantie läuft 3 Jahre (Stand: 28.09.2026).
VZMORE AX9 Max

VZMORE AX9 Max

Mini-PC mit Ryzen AI 9 HX 470, 32 GB RAM und 1 TB SSD für lokale KI

Sehr Gut
1.549 € bei Amazon
Stand: 30.09.26

Technische Daten des VZMORE AX9 Max

MerkmalVZMORE AX9 Max
ProzessorAMD Ryzen AI 9 HX 470, 12 Kerne, bis 5,2 GHz
GrafikAMD Radeon 890M (im Prozessor integriert)
Arbeitsspeicher32 GB DDR5, aufrüstbar bis 256 GB
SSD1 TB, zweiter Steckplatz frei
Netzwerk2× 2,5-Gbit-LAN, WLAN 7, Bluetooth 5.4
Anschlüsse2× USB4, 2× HDMI 2.1, 6× USB-A, SD-Kartenleser, Klinke
Maße / Gewicht135 × 132 × 58 mm / 778 g
Garantie3 Jahre
Preis1.549 Euro (Stand: 28.09.2026)

Design, Verarbeitung und Lieferumfang

Der AX9 Max ist ein flacher Würfel mit gut 13 Zentimetern Kantenlänge. Das silberne Gehäuse fühlt sich sehr hochwertig an, Mängel an der Verarbeitung haben wir keine gefunden. Im Karton liegen ein 120-Watt-Netzteil, ein HDMI-Kabel und eine Halterung, mit der sich der Mini-PC hinter einen Monitor schrauben lässt.

Lieferumfang: Mini-PC, 120-W-Netzteil, HDMI-Kabel, VESA-Halterung mit Schrauben.
Lieferumfang: Mini-PC, 120-W-Netzteil, HDMI-Kabel, VESA-Halterung mit Schrauben.

Wichtig für KI-Nutzer: Der Arbeitsspeicher steckt als zwei austauschbare Module im Gerät. Wer später größere KI-Modelle nutzen will, kann auf 64 GB oder mehr aufrüsten.

Anschlüsse und Konnektivität

Bei den Anschlüssen fehlt kaum etwas. Vorn sitzen vier schnelle USB-A-Buchsen, an der Seite ein SD-Kartenleser. Hinten gibt es zwei USB4-Ports, zwei HDMI-Ausgänge und zwei Netzwerkbuchsen mit 2,5 Gbit/s. Einen Anschluss für externe Grafikkarten (OCuLink) hat der AX9 Max nicht.

Rückseite: 2× USB4, 2× HDMI 2.1, 2× 2,5-Gbit-LAN, 2× USB-A. Darüber der Luftauslass des V-Cooling-Systems.
Rückseite: 2× USB4, 2× HDMI 2.1, 2× 2,5-Gbit-LAN, 2× USB-A. Darüber der Luftauslass des V-Cooling-Systems.

Kühlung: So funktioniert V-Cooling

In kleinen Rechnern staut sich schnell die Wärme. Der Prozessor wird dann langsamer, und der Lüfter dreht laut hoch. VZMORE begegnet dem mit einem eigenen Kühlsystem namens V-Cooling:

  • Vapor Chamber: Eine flache Dampfkammer verteilt die Wärme des Prozessors schnell auf eine große Fläche. Laut VZMORE ist diese Fläche 40 Prozent größer als bei üblichen Heatpipes.
  • Lufteinlass rundum: Kühle Luft strömt über einen umlaufenden Einlass an der Unterseite ins Gehäuse.
  • Luftstrom durchs ganze Gerät: Die Luft kühlt nicht nur den Prozessor, sondern auch Arbeitsspeicher und SSD.
  • Gedämpfter Lüfter: Spezielle Materialien sollen Vibrationen und Geräusche verringern. VZMORE gibt 38 dB unter Last an.

Unser Ergebnis: Die Kühlung hält, was sie verspricht. Auch nach zehn Minuten Volllast lief der Prozessor mit voller Dauerleistung und rund 72 °C, ohne zu drosseln. Leiser als angegeben ist der AX9 Max unter Last aber nicht: Wir haben 41 bis 47 dB(A) gemessen.

So haben wir getestet

Wir nutzen den AX9 Max nicht als Windows-PC, sondern als KI-Server im Heimnetz. Darauf läuft das Server-Betriebssystem Proxmox, darin in einem abgetrennten Bereich (Container) das Programm Ollama mit dem KI-Modell Qwen3.6-35B-A3B. Die Rechenarbeit übernimmt die im Prozessor eingebaute Grafik. Leistung, Temperatur und Stromaufnahme haben wir jede Sekunde mitprotokolliert.

Das Modell haben wir bewusst gewählt: Es hat zwar 35 Milliarden Parameter, nutzt pro Wort aber nur rund 3 Milliarden davon. Solche Modelle heißen Mixture of Experts (MoE) und laufen auf Mini-PCs ohne eigene Grafikkarte deutlich schneller als klassische Modelle gleicher Größe.

Für Bastler: Die Grafik läuft unter Linux über Vulkan, nicht über AMDs KI-Plattform ROCm, die diesen Chip offiziell nicht unterstützt. Damit das 22 GB große Modell vollständig in den Grafikspeicher passt, braucht es einen zusätzlichen Kernel-Parameter.

Unser Monitoring (Beszel): Ab 21:50 Uhr läuft der Prozessor zehn Minuten unter Volllast; wird das KI-Modell geladen, belegt es rund 28 GB Arbeitsspeicher.
Unser Monitoring (Beszel): Ab 21:50 Uhr läuft der Prozessor zehn Minuten unter Volllast; wird das KI-Modell geladen, belegt es rund 28 GB Arbeitsspeicher.

Leistung des VZMORE AX9 Max

TestVZMORE AX9 MaxDurchschnitt HX 470
Geekbench 6 Single-Core3.0952.941
Geekbench 6 Multi-Core15.84214.689
Geekbench 6 Grafik (Vulkan)50.912–
SSD lesen / schreiben6.038 / 5.020 MB/s–
Vergleich: Durchschnitt öffentlich dokumentierter Geekbench-6.7.1-Ergebnisse, Quelle Notebookcheck (Abruf 27.09.2026). Unsere Messung lief unter Linux.

Der AX9 Max liegt fünf bis acht Prozent über dem Durchschnitt anderer Geräte mit demselben Prozessor. Ein Grund: VZMORE erlaubt dem Chip bis zu 65 Watt. Unter Dauerlast regelt er nach etwa zwei Minuten auf 54 Watt herunter und hält dieses Niveau dann stabil.

Leistungsaufnahme und Temperatur über den gesamten Test: 10 Minuten Dauerlast ab 21:50 Uhr, danach die KI-Anfragen.
Leistungsaufnahme und Temperatur über den gesamten Test: 10 Minuten Dauerlast ab 21:50 Uhr, danach die KI-Anfragen.

Lautstärke und Stromverbrauch

SituationLautstärke (30 cm)Leistung des Chips
Leerlaufkaum wahrnehmbarca. 4 W
Volllast Prozessor41 dB(A)54 W (dauerhaft)
KI beantwortet eine Frage47 dB(A)55–61 W
Leistung per Software gemessen, ohne Netzteil, Arbeitsspeicher und SSD. An der Steckdose liegen die Werte höher.
Leistungsaufnahme des Chips je Szenario (Median): 4 W im Leerlauf, 61 W bei einer KI-Antwort, 54 W bei Dauerlast.
Leistungsaufnahme des Chips je Szenario (Median): 4 W im Leerlauf, 61 W bei einer KI-Antwort, 54 W bei Dauerlast.

Im Leerlauf ist der Mini-PC kaum zu hören und sehr sparsam. Das ist gut für ein Gerät, das rund um die Uhr läuft. Bei KI-Anfragen arbeitet der Chip dagegen an seinem Limit, und der Lüfter wird deutlich hörbar. Wer den AX9 Max regelmäßig für lokale KI nutzt, stellt ihn besser nicht auf den Schreibtisch, sondern ins Regal oder in einen Nebenraum.

Lokale KI: So schnell antwortet der Mini-PC

Wir haben dem Modell drei unterschiedlich lange Aufgaben gestellt: eine kurze Frage, eine Tabelle mit Messwerten und eine lange Messreihe über einen ganzen Tag.

kurze FrageTabellelange Messreihe
Länge der Eingabe38 Tokens~1.000 Tokens~6.200 Tokens
Wartezeit bis zum ersten Wort0,1 s2,5 s15,5 s
Antworttempo29 Tokens/s30 Tokens/s29 Tokens/s
Das Antworttempo bleibt auch bei langen Eingaben stabil bei rund 29 Tokens pro Sekunde.
Das Antworttempo bleibt auch bei langen Eingaben stabil bei rund 29 Tokens pro Sekunde.

Die Antwort baut sich schneller auf, als man sie lesen kann, und das Tempo bleibt auch bei langen Texten gleich. Nur das Einlesen langer Eingaben dauert: Bei einer Messreihe über einen Tag vergehen gut 15 Sekunden, bis die Antwort beginnt. Fragt man danach zum selben Text nach, geht es sofort weiter, weil Ollama die Eingabe zwischenspeichert.

Ohne die eingebaute Grafik geht es kaum: Nur mit dem Prozessor kamen wir auf 1 bis 2 Tokens pro Sekunde. Die Grafikeinheit ist also der Grund, warum der AX9 Max als KI-Rechner taugt.

Unser Monitoring (Beszel): Während der KI-Anfragen ab 22:07 Uhr ist die Grafik zu rund 80 Prozent ausgelastet, der Grafikspeicher mit 24 GB fast voll.
Unser Monitoring (Beszel): Während der KI-Anfragen ab 22:07 Uhr ist die Grafik zu rund 80 Prozent ausgelastet, der Grafikspeicher mit 24 GB fast voll.

Wie gut sind die Antworten?

Wir haben der lokalen KI acht Alltagsaufgaben gestellt, von der Reklamations-Mail über eine Übersetzung bis zur Smart-Home-Automation. Dieselben Aufgaben hat das Cloud-Modell Claude Sonnet 5 gelöst. Bewertet hat ein weiteres KI-Modell, ohne zu wissen, welche Antwort von wem stammt. Drei Bewertungen haben wir von Hand nachgeprüft und eine korrigiert.

AufgabeLokale KICloud (Sonnet 5)
Übersetzung1,01,0
Logik und Rechnen1,21,0
Kleines Programm (Python)1,31,5
Text zusammenfassen1,81,2
Faktenfrage (Zigbee, Thread)1,81,0
Mail formulieren2,01,0
Datenschutz-Frage2,51,0
Smart-Home-Automation3,21,5
Durchschnitt1,81,2
Schulnoten von 1 (sehr gut) bis 5 (mangelhaft). Bewerter und Vergleichsmodell stammen vom selben Anbieter; das kann die Cloud-Antworten leicht bevorzugen.

Unser Fazit zur Qualität: Für Übersetzungen, Rechenaufgaben, Mails und Zusammenfassungen ist die lokale KI gut zu gebrauchen. Das Python-Programm war sogar besser als die Cloud-Lösung. Bei Spezialwissen wird es unzuverlässig: Die Smart-Home-Automation hätte so nicht funktioniert, und bei der Datenschutz-Frage war die Antwort zu optimistisch. Mit Denkphase erfand das Modell dort sogar rechtliche Belege.

Qwen3.6 kann vor jeder Antwort eine Denkphase einlegen. Im Test hat das nicht geholfen: Die Antworten wurden nicht besser, dauerten aber viermal so lange. Wir empfehlen, die Denkphase abzuschalten.

Testergebnis

VZMORE AX9 Max im Test
TESTNOTE
Sehr Gut
90/100 Punkte • 09/2026
lokale KI mit rund 29 Tokens pro Sekunde
sehr hochwertige Verarbeitung
V-Cooling hält die Leistung ohne Drosselung
im Leerlauf leise und sparsam
Arbeitsspeicher aufrüstbar, 3 Jahre Garantie
bei KI-Anfragen deutlich hörbar (47 dB)
Einrichtung der KI braucht Linux-Kenntnisse
kein Anschluss für externe Grafikkarten
ab 1.549,00 €
TESTNOTE
Sehr Gut
90/100 Punkte • 09/2026
Stand: 29.09.2026

Fazit

Der VZMORE AX9 Max ist ein hochwertig verarbeiteter Mini-PC, der dank V-Cooling auch unter Dauerlast nicht einbricht. Als lokaler KI-Server überzeugt er mit flüssigen Antworten, ohne dass Daten in die Cloud gehen. Für Mails, Zusammenfassungen und Übersetzungen reicht die Qualität, Rechtsfragen und Smart-Home-Code sollte man prüfen. Wer den Mini-PC oft für KI nutzt, sollte ihn außer Hörweite aufstellen und über 64 GB Arbeitsspeicher nachdenken.

Preis und Verfügbarkeit

Der VZMORE AX9 Max kostet 1.549 Euro und ist nur in der Ausstattung mit 32 GB Arbeitsspeicher und 1 TB SSD erhältlich. Neben Amazon verkauft der Hersteller den Mini-PC auch direkt im VZMORE-Shop, mit Versand aus Deutschland (Preise abgerufen am 27.09.2026).

VZMORE AX9 Max

VZMORE AX9 Max

Mini-PC mit Ryzen AI 9 HX 470, 32 GB RAM und 1 TB SSD für lokale KI

Sehr Gut
1.549 € bei Amazon
Stand: 30.09.26

Häufige Fragen zum VZMORE AX9 Max

Welche KI-Modelle laufen auf dem VZMORE AX9 Max?

Mit 32 GB Arbeitsspeicher laufen Modelle bis etwa 22 GB Größe. Am besten eignen sich sogenannte MoE-Modelle wie Qwen3.6-35B-A3B, die pro Wort nur einen kleinen Teil ihrer Parameter nutzen.

Ist lokale KI so gut wie ChatGPT oder Claude?

Nicht ganz. Im Blindtest erreichte die lokale KI die Note 1,8, das Cloud-Modell Claude Sonnet 5 eine 1,2. Bei Übersetzungen und Rechenaufgaben war kaum ein Unterschied zu sehen, bei Rechtsfragen ein deutlicher.

Was ist V-Cooling?

V-Cooling ist das Kühlsystem des AX9 Max mit einer Dampfkammer (Vapor Chamber), einem Lufteinlass rundum am Boden und einem gedämpften Lüfter. Im Test hielt es die Leistung auch unter Dauerlast, ohne dass der Prozessor drosselte.

Wie laut ist der VZMORE AX9 Max?

Im Leerlauf ist er kaum wahrnehmbar. Unter Volllast haben wir 41 dB(A) gemessen, bei KI-Anfragen 47 dB(A), jeweils in 30 Zentimetern Abstand.

Lässt sich der Arbeitsspeicher aufrüsten?

Ja. Die zwei Module sind austauschbar, laut Hersteller sind bis zu 256 GB möglich. Mehr Speicher erlaubt größere Modelle, macht die KI aber nicht schneller.

Neues zu Smart Home

Neueste Artikel