Das Mac Studio mit M5 Ultra ist da. Apple hat es am 25. August 2026 angekündigt, per Pressemitteilung statt per Event, und es kommt am 22. September in den Handel. Die Schlagzeile für lokale KI ist nicht der Chip. Sie lautet, dass die Speicherobergrenze, die Apple im ersten Halbjahr zusammengestrichen hat, wieder da ist: Das Mac Studio lässt sich erneut mit bis zu 512 GB vereinheitlichtem Speicher konfigurieren, nach Monaten, in denen 96 GB die einzige kaufbare Option war.

Das dreht den Rat um, den diese Seite vor drei Monaten gegeben hat. Der M5 Ultra startet bei $5.499 mit 96 GB, das Upgrade auf 256 GB kostet $4.000 obendrauf, und die Konfiguration mit 512 GB kommt erst Ende Oktober. Unten gehen wir durch die Spezifikationen, die Apple tatsächlich veröffentlicht hat, was jede Speicherstufe fasst, warum die größten Open-Weight-Modelle noch immer in keinen Mac passen und warum der nächste Ultra-Chip erst 2028 ansteht.

Die wichtigsten Punkte

  • Das Mac Studio mit M5 Ultra kommt am 22. September 2026. Es startet bei $5.499 mit 30-Core-CPU, 64-Core-GPU und 96 GB vereinheitlichtem Speicher
  • 512 GB sind zurück. Apple hatte die 512-GB-Option im März und die 256-GB-Option im Mai gestrichen; der M5 Ultra bietet 96 GB, 256 GB und 512 GB, wobei die 512-GB-Variante auf Ende Oktober rutscht
  • Teuer ist der Speicher. Von 96 GB auf 256 GB kostet $4.000 extra, und ein voll ausgestattetes Mac Studio mit 256 GB und 16 TB Speicher landet bei $18.299
  • Der eigentliche Generationssprung ist die Bandbreite: 1,2 TB/s beim M5 Ultra, 50 % über den 819 GB/s des M3 Ultra, wobei UltraFusion jetzt über 4,4 TB/s zwischen den beiden Dies bewegt
  • Einen M6 Ultra gibt es weiterhin nicht. Der nächste Ultra nach diesem ist der M7 Ultra im Jahr 2028, damit ist der M5 Ultra für rund zwei Jahre das einzige Upgrade der Ultra-Klasse

Was Apple tatsächlich angekündigt hat

Vom Herausgeber

Jedes KI-Modell in einer App

Fello AI vereint GPT-5.6, Claude 5, Gemini 3.6, Grok 4.5 und mehr in einer nativen App für Mac und iPhone.

Jetzt herunterladen!

Apple hat das neue Mac Studio am 25. August 2026 zusammen mit einem neuen Mac mini mit M6 und M5 Pro vorgestellt. Es gab keine Keynote; es kam als Newsroom-Beitrag. Die Vorbestellungen öffneten am selben Tag in 30 Ländern, und die Geräte erreichen Kunden und Apple Stores am 22. September, mit einer Ausnahme, die weiter unten steht.

Die Reihe besteht aus zwei Chips. Das Mac Studio mit M5 Max startet bei $2.499 mit 18-Core-CPU, 32-Core-GPU und 36 GB Speicher. Der M5 Ultra startet bei $5.499 mit 30-Core-CPU, 64-Core-GPU und 96 GB. Der Bildungspreis liegt bei $2.299 und $5.099. Beide lassen sich weit über diese Startpreise hinaus konfigurieren, und das Geld verschwindet im Speicher.

Das Gehäuse hat sich nicht verändert, das hatten die Berichte vor dem Start richtig. Innen hat sich mehr getan als der gerüchteweise bessere Kühlkörper: Thunderbolt 5 im ganzen Gerät, erstmals Wi-Fi 7 und Bluetooth 6 in einem Mac Studio über Apples eigenen N1-Chip, und eine SSD der nächsten Generation, der Apple bis zur doppelten Geschwindigkeit der M3-Ultra-Generation zuschreibt.

Die Speicherobergrenze fiel auf 96 GB, und jetzt ist sie zurück

Das ist das Wichtigste auf dieser Seite, und es wird leicht falsch gelesen, weil es sich inzwischen zweimal bewegt hat, jeweils in die andere Richtung. Apple brachte das Mac Studio mit M3 Ultra mit bis zu 512 GB vereinheitlichtem Speicher, für einen Desktop eine ungewöhnliche Menge und der Grund, warum das Gerät für lokale KI beliebt wurde. Dann strich Apple im März 2026 die 512-GB-Option und im Mai die 256-GB-Option, sodass nur noch 96 GB im Verkauf standen. Der M5 Ultra stellt die komplette Leiter wieder her.

DatumWas sich geändert hatMax. vereinheitlichter Speicher
März 2025Mac Studio mit M3 Ultra erscheint, beworben mit bis zu 512 GB512 GB
5. März 2026512-GB-Option gestrichen. Sie kostete $4.000. Das 256-GB-Upgrade steigt von $1.600 auf $2.000256 GB
5. Mai 2026256-GB-Option gestrichen96 GB
25. Juni 2026Apple erhöht die Mac-Preise auf ganzer Linie96 GB
25. August 2026Mac Studio mit M5 Ultra angekündigt, mit 96 GB, 256 GB und 512 GB512 GB

MacRumors berichtete über den ersten Schnitt an dem Tag, an dem die 512-GB-Option verschwand, zusammen mit der Erhöhung des 256-GB-Upgrades von $1.600 auf $2.000. Zwei Monate später berichtete 9to5Mac, dass auch das letzte verbliebene Upgrade fällt, und formulierte es damals unmissverständlich.

This leaves the M3 Ultra Mac Studio with a single memory configuration: 96GB.

Apples Seite mit den technischen Daten liest sich heute andersherum. Die M5-Max-Zeile nennt 36 GB vereinheitlichten Speicher, konfigurierbar auf 48 GB, 64 GB oder 128 GB. Die M5-Ultra-Zeile nennt 96 GB, konfigurierbar auf 256 GB oder 512 GB, wobei diese beiden oberen Stufen an die Chipvariante mit 36-Core-CPU und 80-Core-GPU gebunden sind. Die Zeile zur Konfigurierbarkeit, die beim M3 Ultra verschwunden war, ist zurück, und sie reicht weiter als je zuvor.

Apple hat die Streichungen nie begründet. Der Zeitpunkt passte zur weltweiten Speicherknappheit, die auch die Preiserhöhung vom 25. Juni über alle Macs hinweg trieb, und sowohl 9to5Mac als auch MacRumors nannten die DRAM-Nachfrage von KI-Servern als Ursache. Diese Knappheit hat so weit nachgelassen, dass Apple die Kapazität wieder verkauft. Sie hat nicht so weit nachgelassen, dass sie günstig wäre, was die Upgrade-Preise unten deutlich machen.

Was der Mac Studio jetzt kostet

Die Startpreise hat Apple mit der Ankündigung veröffentlicht. Ob dieses Gerät für lokale KI Sinn ergibt, entscheiden aber die Upgrade-Preise, denn beim Ultra kann der Speicher mehr kosten als der Computer, in den er kommt.

KonfigurationSpeicherMassenspeicherPreis
M5 Max, 18-Core-CPU, 32-Core-GPU36 GB512 GB$2.499
M5 Ultra, 30-Core-CPU, 64-Core-GPU96 GB1 TB$5.499
M5 Ultra, 36-Core-CPU, 80-Core-GPU, voll ausgestattet256 GB16 TB$18.299

Die Leitern unterscheiden sich je nach Chip. Der M5 Max nimmt 36 GB, 48 GB, 64 GB oder 128 GB. Der M5 Ultra nimmt 96 GB, 256 GB oder 512 GB, und die Stufen 256 GB und 512 GB verlangen den Chip mit 36-Core-CPU und 80-Core-GPU statt der 30-Core-Basis. Der Massenspeicher reicht bis 8 TB beim Max und 16 TB beim Ultra.

Die eine Zahl, die du dir merken solltest, ist das Speicher-Upgrade. Einen M5 Ultra von 96 GB auf 256 GB zu bringen kostet $4.000, also mehr als drei Viertel des Preises der Basismaschine. Für die 512-GB-Variante hat Apple noch keinen Preis genannt; sie kommt Ende Oktober. Leasing verändert diese Entscheidung, und unser Ratgeber dazu, was das Apple Upgrade Program wirklich kostet, rechnet den Rückkauf für das Mac Studio und jedes andere infrage kommende Gerät durch.

Du kannst den Spielraum wieder kaufen. Apple hat ihn entsprechend bepreist.

M5-Ultra-Spezifikationen

Die Form, die die Leaks vorhergesagt haben, stimmte. Der M5 Ultra verbindet zwei M5-Max-Dies über Apples UltraFusion, das Verfahren hinter jedem Ultra-Chip seit dem M1, und endet bei 36 CPU-Kernen und 80 GPU-Kernen. Was die Leaks nicht hatten, ist die Verbindung selbst: Apple gibt an, dass die neue UltraFusion-Generation die Bandbreite zwischen den Dies auf über 4,4 TB/s hebt und die Verbindungsdichte um mehr als das Sechsfache.

ChipCPU-KerneGPU-KerneSpeicher (max)BandbreiteKI-HardwareStatus
M3 Ultra (Mac Studio)bis 32bis 8096 GB819 GB/s32-Core Neural EngineVorherige Generation
M4 Max (Mac Studio)bis 16bis 4064 GB546 GB/s16-Core Neural EngineVorherige Generation
M5 Max (Mac Studio)1832 oder 40128 GB460 oder 614 GB/sNeural Accelerator in jedem GPU-KernAb 22. September
M5 Ultra (Mac Studio)30 oder 3664 oder 80512 GB1,2 TB/sNeural Accelerator in jedem GPU-KernAb 22. September, 512 GB Ende Oktober

Zwei Details in dieser Tabelle überliest man leicht. Beide neuen Chips kommen in zwei Ausbaustufen, und die Stufe entscheidet über mehr als die Kernzahl: Der M5 Max mit 32 Kernen läuft mit 460 GB/s, die 40-Kern-Variante erreicht 614 GB/s, und über 96 GB hinaus lässt sich nur der M5 Ultra mit 36 CPU- und 80 GPU-Kernen konfigurieren. Wer wegen der Speicherkapazität kauft, für den ist das Upgrade auf die größere Ultra-Stufe nicht optional.

Der echte generationsübergreifende Gewinn liegt nicht bei der Kernzahl, da der M3 Ultra bereits 80 GPU-Kerne erreicht. Der Unterschied ist, dass die M5-Generation einen Neural Accelerator in jeden GPU-Kern einbaut, eine Matrix-Multiplikationseinheit direkt neben der Shader-Hardware statt einem separaten Neural Engine Block. Für LLM-Inference, die hauptsächlich aus großen Matrixmultiplikationen besteht, kommt die Beschleunigung genau daher.

Einen M4 Ultra gab es nie. Apple hat diese Generation komplett übersprungen, weshalb der M5 Ultra auf einen Chip von 2025 folgt und der Sprung in dieser Tabelle größer ausfällt, als eine einzelne Generation es normalerweise liefert.

512 GB ist die Zahl, auf die es ankommt

Am 25. Juni berichtete MacRumors über die Spezifikation, die entscheiden sollte, was dieses Gerät für lokale KI bedeutet, und der Vorbehalt dazu erwies sich als halb zutreffend.

Apple has tested support for up to 768GB of unified memory, but supply constraints could prevent it from launching with an option for that much memory.

Der Vorbehalt hat sich durchgesetzt, aber nur teilweise. Apple liefert keine 768 GB. Apple liefert 512 GB.

Das ist das Fünffache der 96-GB-Grenze, an der das Mac Studio drei Monate lang festhing, und bringt das Gerät dorthin zurück, wo es vor den Streichungen war. Für alle, die ein großes Modell im Speicher halten, ist das die Spezifikation, auf die es weit mehr ankommt als auf die Kernzahlen: Das Mac Studio mit M5 Ultra ist wieder der leistungsfähigste Desktop für lokale Inferenz, den Apple verkauft, mit großem Abstand zu allem anderen in der Mac-Reihe.

Die Preisfolge aus demselben Bericht hat sich bestätigt. Apple hat keinen Preis für die 512-GB-Konfiguration veröffentlicht, und diese kommt erst Ende Oktober. Bekannt ist nur, dass allein der Schritt auf 256 GB $4.000 kostet und dass ein voll ausgestattetes Gerät mit 256 GB und 16 TB Speicher bereits bei $18.299 liegt. Rechne damit, dass die 512-GB-Variante vor Massenspeicher deutlich über $10.000 liegt, und behandle jede konkrete Zahl vor Ende Oktober als Schätzung.

Was auf jeder Speicherstufe wirklich läuft

Die meisten Berichte über dieses Gerät nennen Modellgrößen aus dem Gedächtnis. Die Tabelle unten ist gemessen: Jede Zahl ist die tatsächliche Größe des MLX-Builds auf der Festplatte, aufsummiert aus den Gewichtsdateien selbst. Die Gewichte sind nicht die ganze Geschichte, denn du brauchst auch Platz für den KV-Cache und für macOS, also rechne mit rund 80 % deines vereinheitlichten Speichers als nutzbar.

Modell (MLX-Build)Gemessene GewichtePasst in 96 GB?
Qwen3.5 9B, 4-bit6,0 GBJa, problemlos
DeepSeek R1 Distill 14B, 4-bit8,3 GBJa, problemlos
Gemma 4 26B A4B, 4-bit15,6 GBJa, mit Platz für mehrere weitere
Qwen3.6 27B, 4-bit16,1 GBJa, mit Platz für mehrere weitere
Qwen3.6 27B, 8-bit29,5 GBJa, komfortabel
Llama 3.3 70B, 4-bit39,7 GBJa, komfortabel
Qwen3.6 27B, full precision55,6 GBJa, knapp
gpt-oss 120B, MXFP463,4 GBJa, aber das ist die Grenze

Auch die 96-GB-Basis bleibt damit eine leistungsfähige Maschine für lokale KI. Sie bewältigt alles bis etwa zur dichten 70B-Klasse mit 4 Bit, ein 27B-Modell in voller Präzision oder mehrere mittelgroße Modelle gleichzeitig für eine Agenten-Pipeline. Das deckt den Großteil der praktischen lokalen Arbeit ab und ist das ehrliche Argument für den Einstiegs-Ultra statt für Speicher, den du nie füllst.

Die oberen Stufen ändern eher die Rechnung als den Arbeitsablauf. Eine 4-Bit-Quantisierung kostet grob ein halbes Byte pro Parameter, also etwa 0,5 GB pro Milliarde Parameter plus Overhead. Auf dieser Basis fasst 256 GB bequem ein Modell der 405B-Klasse mit 4 Bit, das bei rund 230 GB landet, und 512 GB bringt dich in den Bereich, in dem Mixture-of-Experts-Modelle mit einer Billion Parametern diskutabel statt unmöglich werden. Zur Modellauswahl gehen wir in unserem Ratgeber zu den besten Open-Source-KI-Modellen tiefer.

Die besten offenen Modelle passen weiterhin in keinen Mac

Hier hat sich die Geschichte des Mac Studio unter ihm verändert, und die Rückkehr der 512 GB dreht das nicht zurück. Vor zwei Jahren lagen die größten Open-Weight-Modelle im 70B-Bereich, und ein Mac mit viel Speicher war der günstigste Weg, eines davon laufen zu lassen. Die Spitze ist seither zu Mixture-of-Experts-Modellen mit einer Billion Parametern gewandert, und sie wanderte schneller als Apples Speicherobergrenze. Das sind gemessene Download-Größen aus den jeweiligen Repositories.

Open-Weight-ModellParameterGewichte auf der FestplattePasst in 512 GB?
Kimi K32,8 Bio. gesamt, 104B aktiv1.561 GBNein
GLM-5.2744B gesamt, 40B aktiv1.507 GBNein
DeepSeek V4 Pro1,6 Bio. gesamt865 GBNein
Kimi K2.7 Code, 4 Bitnicht genannt641 GBNein

Keines davon passt. Weder in ein Mac Studio mit 96 GB noch in eines mit 512 GB. Am nächsten kommt Kimi K2.7 Code, und es überschreitet die maximale Konfiguration immer noch um rund 129 GB.

Allein die Gewichte von Kimi K3 belegen 1,56 TB. Das ist das Dreifache der 512 GB, die der M5 Ultra jetzt erreicht, und mehr als das Doppelte der 768 GB, die Apple Berichten zufolge getestet hat. Selbst die beste Version dieses Geräts führt das beste offene Modell von heute nicht aus, und keine Quantisierung schließt eine Lücke dieser Größe. Unsere ausführliche Analyse zu Kimi K3 beschreibt, was für den Betrieb nötig ist.

Das gehört deutlich gesagt, denn die Erzählung, die diese Seite einmal trug, dass Apple Silicon durch das Ausführen der größten Modelle gewinnt, stimmt an der absoluten Spitze weiterhin nicht. Was 512 GB bewirken, ist eine erhebliche Verbreiterung der Mitte. Apple Silicon deckt jetzt günstige, leise und private Inferenz von kleinen Modellen bis hinauf zur 405B-Klasse ab, mit einem vereinheitlichten Speicherpool, an den keine Consumer-Grafikkarte heranreicht. Das ist eine deutlich größere Aussage als im Juni und immer noch eine kleinere, als das Marketing nahelegt.

Wie UltraFusion funktioniert und warum es für lokale KI wichtig ist

Apples ursprüngliches UltraFusion-Design beim M1 Ultra nutzte einen Silizium-Interposer, um zwei M1-Max-Dies über mehr als 10.000 Signale zu verbinden, mit 2,5 TB/s Bandbreite dazwischen. Der M5 Ultra nutzt dasselbe Verfahren auf zwei M5-Max-Dies, und Apple gibt an, dass diese Generation die Bandbreite zwischen den Dies über 4,4 TB/s hebt, bei mehr als sechsfacher Verbindungsdichte.

Der Vorteil für KI-Arbeit: Software sieht einen Chip mit einem Arbeitsspeicher-Pool, nicht zwei Chips, die Gewichte über eine langsame Verbindung hin- und herschaufeln. Für ein Modell, das sich über Dutzende von Gigabyte erstreckt, ist das der Unterschied zwischen einmaligem Laden und dem Streamen von Teilen bei jedem Token.

Vereinheitlichter Speicher hebt außerdem die Trennung zwischen CPU-RAM und GPU-VRAM auf. In einer Workstation mit RTX 5090 hast du 32 GB VRAM getrennt vom Systemspeicher, und was nicht hineinpasst, muss ausgelagert oder härter quantisiert werden. In einem Mac Studio schöpfen CPU und GPU aus demselben Pool mit bis zu 1,2 TB/s. Bei der 96-GB-Basis ist das ein dreifacher Kapazitätsvorteil, bei 512 GB ein sechzehnfacher. Dieses Verhältnis ist das gesamte Argument für dieses Gerät.

Anschlüsse, Displays und der Rest des Geräts

Das Gehäuse wurde übernommen, die Anschlüsse sind also vertraut, aber die Konnektivität drumherum hat sich bewegt. Jedes Mac Studio mit M5 hat Thunderbolt 5 mit bis zu 120 Gb/s, 10-Gb-Ethernet, HDMI, einen SDXC-Kartenslot und eine Kopfhörerbuchse. Neu sind Funk und Massenspeicher: Wi-Fi 7 und Bluetooth 6 kommen über Apples N1-Chip erstmals ins Mac Studio, und die SSD-Architektur ist auf bis zu doppelten Durchsatz gegenüber der M3-Ultra-Generation umgebaut.

MerkmalMac Studio (M5 Max und M5 Ultra)
Thunderbolt 5Bis zu 120 Gb/s
DisplaysBis zu acht, oder vier Studio Display XDR in vollem 5K mit 120 Hz
FunkWi-Fi 7 und Bluetooth 6, über Apples N1-Chip
Ethernet10 Gb
MassenspeicherSSD der nächsten Generation, bis zu 2x schneller als die M3-Ultra-Generation

Bei der Displayunterstützung macht der Ultra seinem Namen Ehre. Das neue Mac Studio steuert bis zu acht Displays an, oder vier Studio Display XDR in vollem 5K mit 120 Hz. Apple hat außerdem Genlock über USB-C ergänzt, was eher für Mehrkameraproduktion zählt als für KI-Arbeit.

Was Apples eigene Benchmarks zur M5 KI-Leistung zeigen

Apples Machine Learning Research Team veröffentlichte im November 2025 gemessene MLX-Benchmarks für den M5, und das ist das beste First-Party-Beleg dafür, was die Neural Accelerators leisten. Beim Time-to-First-Token ist der M5 bis zu 4x schneller als der M4, mit modellspezifischen Beschleunigungen von 3,33x bis 4,06x bei Qwen-Modellen mit 1,7B, 8B, 14B und 30B Mixture-of-Experts sowie gpt-oss 20B.

Die anhaltende Token-Generierung, die eher durch Bandbreite als durch Rechenleistung begrenzt wird, verbesserte sich um bescheidenere 19 bis 27 %. Apple führt das auf eine Steigerung der Arbeitsspeicher-Bandbreite von 120 GB/s beim Basis-M4 auf 153 GB/s beim Basis-M5 zurück, ein Anstieg von 28 %.

Prompt-Verarbeitung skaliert mit Rechenleistung. Generierung skaliert mit Arbeitsspeicher-Bandbreite.

Diese Aufteilung ist die nützliche Lektion für Käufer eines Mac Studio. Die Neural Accelerators machen die Prompt-Verarbeitung dramatisch schneller, was du bei langen Dokumenten und großen Codebasen am deutlichsten spürst. Die Generierungsgeschwindigkeit skaliert dagegen mit der Bandbreite. Deshalb hielten sich die 819 GB/s des M3 Ultra so lange gegen viel neuere Chips, und deshalb ist die 1,2 TB/s des M5 Ultra die Spezifikation, auf die es zu achten gilt, und nicht die Kernzahl.

Apple hat mit der Ankündigung eigene Multiplikatoren veröffentlicht, und man sollte sie mit der jeweiligen Vergleichsbasis lesen, denn die leistet viel Arbeit. Jede M5-Ultra-Zahl wird am M3 Ultra gemessen, einem Chip von 2025, nicht am Vorjahresmodell, weil es keinen M4 Ultra zum Vergleichen gab.

Apples AngabeVerglichen mit
Bis zu 4,3x KI-SpitzenleistungM3 Ultra
Bis zu 4,3x schnellere Bildgenerierung aus TextM3 Ultra
Bis zu 1,8x schnellere GrafikM3 Ultra
Bis zu 1,3x höhere Multithread-CPU-LeistungM3 Ultra
9,8x mehr KI-RechenleistungM1 Ultra
Bis zu 3,9x schnellere KI-Leistung (M5 Max)M4 Max
Bis zu 3x schnellere KI-InferenzVier gekoppelte Mac Studio gegen eines

Die letzte Zeile ist neu und wirklich interessant. Apple unterstützt jetzt das Koppeln mehrerer Mac Studio über Thunderbolt 5 per RDMA, also direktem Speicherzugriff über das Netz, um ihren Speicher zu bündeln. Vier Geräte liefern bis zum Dreifachen des Inferenzdurchsatzes eines einzelnen. Das ist eine Teilantwort auf die Modelle aus der Tabelle oben, die nicht in 512 GB passen, es sind aber eben auch vier Mac Studio, und außerhalb von Apple hat das noch niemand gemessen.

Der Software-Stack: MLX, Ollama und LM Studio

Die Apple-Silicon-Software-Situation hat sich 2026 deutlich verbessert, und drei Tools decken fast jeden Anwendungsfall ab.

MLX

MLX ist Apples eigenes Machine-Learning-Framework, das darauf ausgelegt ist, Unified Memory und die Neural Accelerators direkt zu nutzen. Es ist der schnellste Weg auf Apple Silicon und die richtige Wahl, wenn du ein Produkt auf Basis lokaler Inference aufbaust, statt nur ein Modell auszuführen.

Ollama

Ollama ist der einfachste Weg, eine lokale API zum Laufen zu bringen: installieren, Modell herunterladen, fertig. Es hat am 30. März 2026 ein MLX-Backend in der Preview-Version veröffentlicht und seitdem hart daran gearbeitet. Das Engineering-Blog meldete im Juni die bisher höchste Apple Silicon Performance.

Sei vorsichtig mit den damit verbundenen Beschleunigungszahlen, einschließlich einiger, die wir als Pauschalzahl wiederholt gesehen haben. Olamas stärkster eigener Anspruch ist bis zu 90 % schneller beim Einsatz mit Coding Agents, gemessen am Aider Polyglot Benchmark, und bezieht sich auf eine spezifische Multi-Token-Prediction-Optimierung. Unabhängige Tests zeigen, dass die Gewinne sich stark auf Mixture-of-Experts-Modelle konzentrieren und bei einigen Dense-Modellen nahezu null betragen. Rechne mit einem großen Gewinn bei MoE, und teste, bevor du annimmst, dass es auf dein Modell zutrifft.

LM Studio

LM Studio ist eine GUI-App zum Herunterladen, Ausführen und Chatten mit Modellen, die auch MLX unterstützt. Wenn du noch nie ein lokales Modell betrieben hast, fang hier an, wechsle zu Ollama, wenn du es per Script aufrufen möchtest, und greife direkt auf MLX zurück, wenn du optimierst.

M5 Ultra vs RTX 5090 für lokale KI

Dieser Vergleich hat sich auf beiden Seiten bewegt. Die Speicherknappheit, die Apples Konfigurationen beschnitt und die Mac-Preise anhob, verteuerte auch GDDR7, und Nvidia hob die Preise für Boardpartner im Mai 2026 Berichten zufolge um rund $300 an. Der Unterschied ist, dass Apple seinen Kapazitätsvorteil seither wiederhergestellt hat und Nvidia seine Obergrenze nicht bewegt hat.

Die RTX 5090 startete zu einem Listenpreis von $1.999 und war lange nicht zuverlässig zu diesem Preis verfügbar. Die aktuellen Straßenpreise sind umstritten. Tracker zeigen Werte von einem Median von rund $2.150 im Juni bis zu rund $4.300 bei großen Händlern, mit Premium-Partnerkarten über $5.000. Wir nennen dir die Bandbreite, statt eine einzige Zahl vorzugeben.

In der Rohgeschwindigkeit gewinnt die 5090 bei allem, was in ihre 32 GB VRAM passt, und zieht dabei bis zu 575 Watt, bevor du CPU, Mainboard, Netzteil und Kühlung hinzufügst. Ein Mac Studio ist eine einzelne Box mit einem Bruchteil des Stromverbrauchs und dem MLX-Stack bereits installiert.

Dann stößt du an die Speicherwand.

Speicher ist weiterhin der entscheidende Unterschied

Ein 70B-Modell mit 4 Bit sind gemessene 39,7 GB. Das passt nicht auf eine einzelne RTX 5090, du fährst also zwei Karten, lagerst Schichten in den Systemspeicher aus und verlierst den Großteil deiner Geschwindigkeit, oder du quantisierst härter und verlierst Qualität. Selbst das Mac Studio mit 96 GB lädt es mit Platz für ein zweites Modell. Ein Gerät mit 256 GB oder 512 GB bewegt sich in einer ganz anderen Problemklasse.

Die ehrliche Regel: die 5090 für die schnellsten Tokens pro Sekunde bei Modellen, die in 32 GB passen, das Mac Studio, um Modelle zu halten, die das nicht tun, leise, auf einem Schreibtisch. Beachte, wie stark sich diese Aussage im August verbreitert hat. Bei 96 GB war der Kapazitätsvorteil des Mac dreifach. Bei 512 GB ist er sechzehnfach, breiter als je zuvor.

M5 Ultra vs M5 Max vs M3 Ultra: Wer kauft was

Die Kaufentscheidung hängt weiterhin am Speicher und nicht an der Chipgeneration, aber die Antwort hat sich gedreht. Warten ist nicht mehr der richtige Zug, weil das, worauf zu warten war, angekommen ist. Die Frage lautet jetzt, welche Stufe du brauchst, und die Abstände zwischen den Stufen bemessen sich in Tausenden von Dollar.

Wenn duTu dasWarum
Modelle über 70B lokal ausführstM5 Ultra, 256 GB oder mehrDer einzige Mac, der das schafft. Rechne mit $4.000 zusätzlich zu $5.499 für 256 GB
Modelle von 27B bis 70B ausführstM5 Ultra mit 96 GB, oder ein M5 Max mit 128 GBBeide schaffen das bequem. Der Max spart $3.000
Hauptsächlich Video, 3D oder allgemeine Profiarbeit machstM5 Max für $2.499Du bist nicht speicherbegrenzt, und der Ultra-Aufpreis beträgt $3.000
Mobilität willstMacBook Pro mit M5 MaxDieselbe KI-Architektur pro Kern und bis zu 128 GB, gleichauf mit dem M5-Max-Desktop
Mit lokaler KI anfängstMac miniEin Bruchteil des Preises und genug für mittelgroße Modelle
Einen M3 Ultra mit 96 GB hastNur bei Speichergrenze aufrüstenDer Chipgewinn ist real, aber 96 GB gegen 96 GB sind keine $5.499 wert
Auf einem Intel-Mac oder M1 Ultra bistJetzt aufrüstenmacOS 27 lässt Intel fallen, das ist nicht optional, nur eine Frage des Wann

Am stärksten verändert hat sich die vierte Zeile. Drei Monate lang war ein MacBook Pro mit M5 Max und 128 GB besser konfigurierbar als das Mac Studio für $5.299, ein absurder Zustand für eine Desktop-Workstation. Das ist vorbei: Der Desktop erreicht 512 GB, das Notebook endet bei 128 GB. Das Notebook nehmen wir in unserem Upgrade-Ratgeber zum M5 MacBook Pro auseinander, und die Reihe vergleichen wir im Ratgeber zum besten MacBook für KI. Für das günstigere Ende siehe unsere Analyse zum Mac mini für KI.

Einen M6 Ultra gibt es weiterhin nicht, das nächste Warten reicht also bis 2028

Wenn du überlegst, jetzt zu kaufen, lohnt es sich zu wissen, was danach kommt. Apple überspringt die M6-Generation am oberen Ende komplett. Es wird keinen M6 Pro und keinen M6 Max geben und folglich auch keinen M6 Ultra, denn ein Ultra-Chip entsteht durch das Verbinden zweier Max-Dies. Der diese Woche angekündigte M6 ist der Basischip im Mac mini und hat kein Ultra-Geschwister in Aussicht.

Ein Ultra braucht zwei Max-Dies. Kein M6 Max bedeutet keinen M6 Ultra.

AppleInsider berichtete im Juni, dass der nächste Ultra nach dem M5 der M7 Ultra ist, erwartet irgendwann 2028, und dieser Zeitplan hat den Start überstanden. Spätere Berichte nennen für den M7 Ultra ein Ziel von bis zu 1,5 TB vereinheitlichtem Speicher, wobei ein Speicherziel für 2028 ein Plan ist und keine Spezifikation.

Die Wahl ist also enger, als sie aussieht. Jetzt einen M5 Ultra kaufen, oder das behalten, was du hast, bis 2028. Es gibt keinen Zwischen-Ultra, auf den sich warten ließe, und das ist das stärkste Argument für diese Generation, stärker als der Chip selbst.

Was wir noch nicht wissen

Deutlich weniger als vor einem Monat, aber nicht nichts. Die Spezifikationen, Preise und die Speicherleiter auf dieser Seite stammen aus Apples eigener Ankündigung und den technischen Daten. Offen ist alles, wofür das Gerät in jemandes Händen sein muss, und es kommt erst am 22. September.

  • Der Preis der 512-GB-Variante. Apple hat keinen genannt, und diese Konfiguration kommt erst Ende Oktober
  • Echte Werte für Tokens pro Sekunde. Niemand hat bisher einen M5 Ultra vermessen, und Apples 4,3x-Angabe betrifft die KI-Spitzenleistung, nicht die Generierungsgeschwindigkeit
  • Ob die 512-GB-Variante erneut rutscht. Die Optionen mit 256 GB und 512 GB wurden dieses Jahr schon einmal zurückgezogen
  • Wie gut die RDMA-Kopplung in der Praxis funktioniert und ob die Werkzeuge sie außerhalb von Apples eigenen Demos unterstützen
  • Ob die Speicherpreise nachgeben. $4.000 für 160 GB sind ein Knappheitspreis, kein eingependelter

Behandle die vier noch nicht ausgelieferten Punkte oben als Wetter und nicht als Prognose, auf die sich ein Budget stützen lässt.

Wir haben bewusst weder einen Preis für 512 GB noch eine Schätzung für Tokens pro Sekunde bei Hardware gedruckt, die noch niemand laufen hatte. Wo diese Seite solche Schätzungen früher trug, waren es Extrapolationen, und die 96-GB-Episode zeigt gut, wie schlecht Extrapolation altert.

macOS 27 Golden Gate und das Ende von Intel

Das Mac Studio mit M5 Ultra kommt mit macOS 27 Golden Gate, angekündigt auf der WWDC 2026 am 8. Juni und für Ende 2026 erwartet. Es ist die erste macOS-Version, die nur auf Apple Silicon läuft, und die letzte mit vollem Rosetta 2. Ausführlich behandeln wir sie in unserem Ratgeber zu macOS 27 Golden Gate.

Intel Macs enden bei macOS 26 Tahoe. Wenn du einen 2019er Mac Pro, ein 2019er 16-Zoll MacBook Pro oder ein 2020er iMac nutzt, ist das das Ende der Linie für neue Mac-KI-Funktionen. Die Migration zu Apple Silicon ist eine Notwendigkeit geworden, kein optionales Upgrade mehr.

Eine Klarstellung, die sich lohnt, weil sie oft falsch dargestellt wird. Apples erweitertes Apple Intelligence Tier erfordert Mac-Modelle mit M3 und später sowie mindestens 12 GB Unified Memory, und diese Anforderung betrifft zwei spezifische Funktionen, die ausdrucksstarke Siri-Stimme und die hochpräzise On-Device-Diktierfunktion. Es sperrt Siris KI-Funktionen nicht als Ganzes, die auf jedem Apple-Silicon-Mac laufen. Jeder Mac Studio erfullt die 12-GB-Anforderung achtmal, daher ist das hier kein Thema.

Lokale Modelle auf dem Mac Studio, Frontier-Modelle über Fello AI

Ein Mac Studio ist hervorragend für private, ungetaktete Inferenz auf Open-Weight-Modellen, und mit 512 GB ist es darin besser als jeder Mac zuvor. Was keine lokale Maschine kann, ist das Ausführen der Frontier-Modelle mit geschlossenen Gewichten, denn diese Gewichte werden nie veröffentlicht. Und wie die Tabelle oben zeigt, reicht es für die größten offenen Modelle weiterhin nicht.

Diese Lücke schließt Fello AI. Die App läuft nativ auf Apple Silicon und stellt die führenden Frontier-Assistenten in einer einzigen Menüleisten-App für $9.99 im Monat zur Verfügung, sodass du keine einzelnen Abonnements benotigst, um Antworten zu vergleichen. Die Aufteilung funktioniert sauber: Open-Modelle laufen lokal auf deinem Mac über MLX oder Ollama, und Frontier-Modelle werden über Fello AI weitergeleitet, wenn eine Aufgabe die beste verfügbare Qualität erfordert. Fello AI hält eine 4,7-Sterne-Bewertung bei über 27.000 Rezensionen.

Wenn du lieber einzelne Clients installierst, haben wir Ratgeber für Claude auf dem Mac, ChatGPT für Mac, Gemini Desktop für Mac und Grok auf dem Mac. Um zu sehen, welches Cloud-Modell welchen Benchmark gerade anführt, beginne mit unserem besten KI-Modelle-Ratgeber.

Solltest du das Mac Studio mit M5 Ultra kaufen?

Für speicherbegrenzte lokale KI-Arbeit ja, und das ist eine festere Antwort, als diese Seite vor einem Monat geben konnte. Die 96-GB-Wand, die das Mac Studio den Sommer über schwer verkäuflich machte, ist weg. Wenn deine Arbeit ein Modell größer als 70B im Speicher halten muss, ist der M5 Ultra mit 256 GB der einzige Mac, der das schafft, und du solltest rund $9.500 dafür einplanen.

Wenn deine Arbeit nicht speicherbegrenzt ist, kauf den M5 Max für $2.499. Er ist ein starker Desktop für Video, 3D und allgemeine Profiarbeit, er erreicht 128 GB, und den Ultra-Aufpreis von $3.000 für Bandbreite zu zahlen, die du nie ausschöpfst, war noch nie ein guter Handel.

Wenn du Mobilität brauchst, erreicht das MacBook Pro mit M5 Max dieselben 128 GB wie der M5-Max-Desktop, die Wahl geht dort also eher um die Bauform als um die Fähigkeiten. Wenn du Apple Silicon gegen die Alternativen abwägst, steckt unser Vergleich MacBook vs Googlebook vs Chromebook das weitere Feld ab, und unser Blick auf Apples KI-Fahrplan behandelt, was nach diesem Hardwarezyklus kommt.

Ein praktischer Hinweis, der weiterhin gilt. Prüf Apples Konfigurator am Tag des Kaufs selbst. Die Speicheroptionen dieses Geräts haben sich in sechs Monaten dreimal geändert, zweimal nach unten und einmal nach oben, und nur die letzte Änderung kam mit einer Ankündigung.

Prüf nach, bevor du $5.499 ausgibst.

FAQ

Wann kommt das Mac Studio mit M5 Ultra?

Apple hat es am 25. August 2026 angekündigt, und es kommt am 22. September 2026. Die Vorbestellungen öffneten am Ankündigungstag in 30 Ländern. Eine Konfiguration kommt später: der M5 Ultra mit 512 GB vereinheitlichtem Speicher erscheint Ende Oktober.

Wie viel Arbeitsspeicher hat das Mac Studio jetzt?

96 GB, 256 GB oder 512 GB beim M5 Ultra und 36 GB bis 128 GB beim M5 Max. Das stellt eine Leiter wieder her, die Apple abgebaut hatte: Es strich die 512-GB-Option im März 2026 und die 256-GB-Option am 5. Mai 2026, sodass bis zum Start des M5 Ultra nur 96 GB blieben.

Hat das Mac Studio mit M5 Ultra 768 GB Arbeitsspeicher?

Nein. MacRumors berichtete im Juni 2026, dass Apple Unterstützung für bis zu 768 GB getestet hatte, und warnte zugleich, dass Lieferengpässe diese Option verhindern könnten. Das ausgelieferte Maximum sind 512 GB, verfügbar ab Ende Oktober.

Was kostet das Mac Studio?

Der M5 Max startet bei $2.499 mit 36 GB und 512 GB Massenspeicher, der M5 Ultra bei $5.499 mit 96 GB und 1 TB. Der Bildungspreis liegt bei $2.299 und $5.099. Ein M5 Ultra auf 256 GB aufzurüsten kostet $4.000 extra, und ein voll ausgestattetes Gerät mit 256 GB und 16 TB erreicht $18.299.

Kann ein Mac Studio lokale 70B-LLMs ausführen?

Ja, bequem, in jeder Konfiguration. Der MLX-Build von Llama 3.3 70B mit 4 Bit misst 39,7 GB und passt in die 96-GB-Basis, mit Platz für ein zweites Modell. Rechne nach macOS und KV-Cache mit rund 80 % deines vereinheitlichten Speichers als nutzbar.

Kann ein Mac Studio Kimi K3 oder DeepSeek V4 ausführen?

Nein, und die 512-GB-Konfiguration ändert daran nichts. Die Gewichte von Kimi K3 belegen 1,56 TB und die von DeepSeek V4 Pro 865 GB, gemessen aus den jeweiligen Repositories. Selbst das nächstgelegene der offenen Spitzenmodelle, Kimi K2.7 Code mit 641 GB, überschreitet 512 GB. Die größten Open-Weight-Modelle von heute brauchen Serverhardware, keinen Desktop.

Wird es einen M6 Ultra geben?

Nein. Apple überspringt die M6-Generation am oberen Ende, es wird also keinen M6 Pro, M6 Max oder M6 Ultra geben; der im August 2026 angekündigte M6 ist der Basischip im Mac mini. AppleInsider berichtet, dass der nächste Ultra-Chip der M7 Ultra im Jahr 2028 ist, womit der M5 Ultra für rund zwei Jahre das einzige Upgrade der Ultra-Klasse bleibt.

Ist ein Mac Studio oder eine RTX 5090 besser für lokale KI?

Das hängt von der Modellgröße ab. Die RTX 5090 ist schneller bei allem, was in ihre 32 GB VRAM passt. Ein Mac Studio hält Modelle, die die 5090 nicht halten kann, in einem leisen Gehäuse und bei weit geringerer Leistungsaufnahme, und dieser Kapazitätsvorteil beträgt bei 512 GB jetzt bis zu das Sechzehnfache, gegenüber dem Dreifachen bei der 96-GB-Basis.

Unterstützt macOS 27 Intel-Macs?

Nein. macOS 27 Golden Gate, angekündigt auf der WWDC 2026 am 8. Juni, ist die erste rein für Apple Silicon gebaute macOS-Version und die letzte mit vollem Rosetta 2. Intel-Macs enden bei macOS 26 Tahoe.