Der M5 Ultra Mac Studio kam nicht auf der WWDC 2026. Was mit dem Mac Studio passiert ist, waehrend alle warteten, ist die eigentliche Geschichte. Apple hat die Speichergrenze des Geraets in zwei Schritten still und leise von 512 GB auf 96 GB gesenkt und danach den Preis des M3 Ultra von $3.999 auf $5.299 erhoehen. Auf Apples eigener Tech-Specs-Seite listet der M3 Ultra heute 96 GB Unified Memory ohne jegliche Upgrade-Option.
Das dreht den ueblichen Rat auf den Kopf. Es geht hier nicht um einen schnelleren Chip, der das Warten lohnt, sondern um eine Speichergrenze, die beim aktuell kaufbaren Geraet um 81 % gesunken ist. Wir zeigen, was der Mac Studio heute bietet, und fassen jeden glaubwuerdigen M5 Ultra Leak zusammen, einschliesslich der 768 GB, die Apple Berichten zufolge getestet hat. Ausserdem messen wir, was wirklich in 96 GB passt, und erklaeren, warum der naechste Ultra-Chip erst 2028 kommen wird.
Die wichtigsten Punkte
- 96 GB ist nun die einzige Speicherkonfiguration des M3 Ultra Mac Studio. Die 512-GB-Option entfiel im Maerz 2026, die 256-GB-Option am 5. Mai 2026
- Der M3 Ultra Mac Studio startet jetzt bei $5.299 (vorher $3.999), der M4 Max bei $2.499 (vorher $1.999) nach Apples Preiserhoehung vom 25. Juni
- Der M5 Ultra existiert noch nicht. Die WWDC 2026 kam und ging ohne ihn; aktuelle Berichte zeigen auf etwa Oktober 2026
- Apple hat Berichten zufolge bis zu 768 GB Unified Memory fuer den M5 Ultra getestet, Lieferengpaesse koennten diese Option jedoch verhindern
- Es wird keinen M6 Ultra geben. Der naechste Ultra nach dem M5 ist der M7 Ultra im Jahr 2028, dieses Modell ist also das einzige Ultra-Upgrade fuer rund zwei Jahre
Der aktuelle Stand beim M5 Ultra Mac Studio
Apple hat den M5 Ultra Mac Studio nicht angekuendigt. Das ist keine Absicherung, sondern nachpruefbar: Suche auf Apples Mac Studio Tech-Specs-Seite, der Marketing-Seite und im Store nach M5 Ultra, das Ergebnis ist auf allen drei Seiten null. Dieselben Seiten zeigen M3 Ultra und M4 Max wieder und wieder, die Abwesenheit ist also real und kein Ladefehler.
Die WWDC 2026 begann am 8. Juni 2026 und brachte macOS 27 Golden Gate, keinen neuen Mac Studio. Das aktuelle Zeitfenster liegt bei etwa Oktober 2026. AppleInsider berichtete am 28. Juni, dass der M5 Ultra noch 2026 kommen soll, und Bloombergs Mark Gurman hat seit April auf Oktober hingewiesen, als Grund gilt der weltweite DRAM-Engpass.
Zwei Details aus diesen Berichten sind fuer Kaeufer wichtig. Apple redesignt das Gehaeuse nicht, das Chassis und die Anschluesse bleiben gleich. Neu ist das Innere, vor allem ein verbesserter Kuehlkoerper, der die Taktraten unter Dauerlast haelt, was genau dem Belastungsprofil eines langen lokalen Inference-Laufs entspricht.
Die Speichergrenze des Mac Studio fiel von 512 GB auf 96 GB
Das ist das Wichtigste auf dieser Seite, und es geschah in zwei Schritten, die getrennt berichtet wurden, weshalb es leicht zu uebersehen ist. Als Apple den M3 Ultra Mac Studio auf den Markt brachte, warb es mit bis zu 512 GB Unified Memory, einer fuer einen Desktop ungewoehnlichen Menge und der Grund, warum das Geraet fuer lokale KI so beliebt wurde. Beide Konfigurationen oberhalb der 96-GB-Basis sind jetzt verschwunden.
| Datum | Aenderung | Max. Unified Memory |
|---|---|---|
| Maerz 2025 | M3 Ultra Mac Studio erscheint, beworben mit bis zu 512 GB | 512 GB |
| 5. Maerz 2026 | 512-GB-Option entfernt. Sie hatte $4.000 gekostet. Das 256-GB-Upgrade steigt von $1.600 auf $2.000 | 256 GB |
| 5. Mai 2026 | 256-GB-Option entfernt | 96 GB |
| 25. Juni 2026 | Apple erhoehe Mac-Preise ueber die gesamte Produktlinie | 96 GB |
MacRumors berichtete ueber die erste Kuerzung am Tag, an dem die 512-GB-Option verschwand, zusammen mit der Preiserhoehung des 256-GB-Upgrades von $1.600 auf $2.000. Zwei Monate spaeter berichtete 9to5Mac ueber das Ende der letzten verbleibenden Upgrade-Option und brachte es auf den Punkt.
This leaves the M3 Ultra Mac Studio with a single memory configuration: 96GB.
Apples eigene Specs-Seite bestaetigt das auf eine kaum widerlegbare Weise. Die M4 Max Zeile lautet 36 GB Unified Memory, konfigurierbar bis 64 GB. Die M3 Ultra Zeile lautet 96 GB Unified Memory und hoert dort auf, ohne jegliche Konfigurierbar-bis-Angabe. Apples Mac-Vergleichsseite listet die Mac Studio Speicherleiter als 36 GB, 64 GB, 96 GB und beschreibt das Geraet als ab 96 GB Unified.
Apple hat keinen Grund genannt. Der Zeitpunkt passt zum weltweiten Arbeitsspeicher-Engpass, der auch zur Preiserhoehung vom 25. Juni bei allen Macs gefuehrt hat. Sowohl 9to5Mac als auch MacRumors nennen die KI-Server-Nachfrage nach DRAM als Ursache.
Was der Mac Studio jetzt kostet
Alle Preise hier wurden direkt aus Apples Live-Store-SKU-Daten entnommen, nicht aus Berichterstattung. Das ist wichtig: ein oft zitierter Mac Studio Ratgeber aus 2026 wurde am 22. Juli aktualisiert und listet immer noch $1.999 und $3.999.
| Konfiguration | Arbeitsspeicher | Speicher | Preis |
|---|---|---|---|
| M4 Max, 14-Core CPU, 32-Core GPU | 36 GB | 512 GB | $2.499 |
| M3 Ultra, 28-Core CPU, 60-Core GPU | 96 GB | 1 TB | $5.299 |
Der M4 Max laesst sich bis zu einer 16-Core CPU und einer 40-Core GPU mit 64 GB Arbeitsspeicher konfigurieren. Der M3 Ultra geht bis zu einer 32-Core CPU und einer 80-Core GPU. Beide sind kostenpflichtige Upgrades auf die Einstiegspreise, und die Speicherleiter endet bei 96 GB, egal welchen du waehlst.
Stellt man Preis und Speicheraenderung nebeneinander, zeigt sich das Bild von 2026 klar. Der M3 Ultra Einstieg kostet $1.300 mehr als zuvor, und das 512-GB-Upgrade, das einst darueber lag, ist zu keinem Preis verfuegbar. Das ist der Kontext fuer jede Entscheidung ueber das Warten. Leasing veraendert diese Entscheidung, und unser Ratgeber darueber, was das Apple Upgrade Program wirklich kostet, rechnet die Rueckkaufsmathe fuer den Mac Studio und alle anderen berechtigten Geraete durch.
Du zahlst mehr fuer weniger Spielraum. Das ist die ganze Geschichte dieses Geraets in 2026.
Geleakte M5 Ultra Specs
Die Leaks sind in ihrer Grundform konsistent. Es wird erwartet, dass der M5 Ultra zwei M5 Max Dies mit Apples UltraFusion-Interconnect verbindet, dem Ansatz, der bei jedem Ultra-Chip seit dem M1 verwendet wird. MacRumors und Macworld setzen ihn bei rund 36 CPU-Kernen und bis zu 80 GPU-Kernen an.
| Chip | CPU-Kerne | GPU-Kerne | Arbeitsspeicher (max) | Bandbreite | KI-Hardware | Status |
|---|---|---|---|---|---|---|
| M3 Ultra (Mac Studio) | bis zu 32 | bis zu 80 | 96 GB | 819 GB/s | 32-Core Neural Engine | Erhaeltlich |
| M4 Max (Mac Studio) | bis zu 16 | bis zu 40 | 64 GB | 546 GB/s | 16-Core Neural Engine | Erhaeltlich |
| M5 Max (MacBook Pro) | bis zu 16 | bis zu 40 | 128 GB | 614 GB/s | Neural Accelerator in jedem GPU-Kern | Erhaeltlich |
| M5 Ultra (Mac Studio) | ~36 | 80 | 768 GB getestet, unbestaetigt | nicht veroeffentlicht | Neural Accelerator in jedem GPU-Kern | Noch nicht erhaeltlich |
Zwei ehrliche Vorbehalte zur letzten Zeile. Niemand hat eine Arbeitsspeicher-Bandbreitenzahl fuer den M5 Ultra veroeffentlicht, daher drucken wir keine; die Verdopplung der gemessenen 614 GB/s des M5 Max ist die naheliegende Schaetzung, aber eben eine Schaetzung, kein Leak. Die Kernzahlen stammen aus Analysten-Berichten, nicht von Apple.
Der echte generationsuebergreifende Gewinn liegt nicht bei der Kernzahl, da der M3 Ultra bereits 80 GPU-Kerne erreicht. Der Unterschied ist, dass die M5-Generation einen Neural Accelerator in jeden GPU-Kern einbaut, eine Matrix-Multiplikationseinheit direkt neben der Shader-Hardware statt einem separaten Neural Engine Block. Fuer LLM-Inference, die hauptsaechlich aus grossen Matrixmultiplikationen besteht, kommt die Beschleunigung genau daher.
Es gab nie einen M4 Ultra. Apple hat diese Generation komplett uebersprungen, weshalb der aktuelle High-End Mac Studio noch immer einen 2025 eingefuehrten Chip neben einem deutlich neueren M4 Max betreibt.
768 GB: die Zahl, auf die es ankommt
Am 25. Juni berichtete MacRumors ueber die Spezifikation, die dieses Geraet fuer lokale KI veraendern wuerde, und es lohnt sich, sie genau zu zitieren, denn der Vorbehalt ist genauso wichtig wie die Zahl.
Apple has tested support for up to 768GB of unified memory, but supply constraints could prevent it from launching with an option for that much memory.
Lies den zweiten Halbsatz zweimal. Er entscheidet darueber, ob das Geraet ein Meilenstein oder eine Fussnote wird.
Das waere das Achtfache der heutigen 96-GB-Grenze. Wenn es so kommt, wird der M5 Ultra Mac Studio der faehigste Desktop fuer lokale Inference, den Apple je verkauft hat, und zwar mit grossem Abstand. Wenn nicht, ist der M5 Ultra ein schnellerer Chip an derselben 96-GB-Wand, und fuer grosse Modelle waere das ein bescheidenes Upgrade im Gewand eines grossen.
Derselbe Bericht weist auf die offensichtliche Preisfolge hin: das Achtfache des Speichers waehrend eines Speicher-Engpasses koennte einen voll konfigurierten Mac Studio auf ueber $10.000 treiben. Behandle 768 GB als eine Moeglichkeit, die Apple im Labor getestet hat, nicht als Spezifikation, nach der du ein Budget planen kannst.
Was du heute wirklich auf 96 GB betreiben kannst
Die meisten Berichte ueber dieses Geraet zitieren Modellgroessen aus dem Gedaechtnis. Die folgende Tabelle basiert auf Messungen: Jede Zahl ist die tatsaechliche Groesse der MLX-Build dieses Modells auf der Festplatte, aufsummiert aus den Gewichtsdateien selbst. Gewichte sind nicht die ganze Geschichte, denn du brauchst auch Platz fuer den KV-Cache und macOS, also rechne mit rund 75 bis 80 GB nutzbarem Speicher von 96 GB.
| Modell (MLX-Build) | Gemessene Gewichte | Passt in 96 GB? |
|---|---|---|
| Qwen3.5 9B, 4-bit | 6,0 GB | Ja, problemlos |
| DeepSeek R1 Distill 14B, 4-bit | 8,3 GB | Ja, problemlos |
| Gemma 4 26B A4B, 4-bit | 15,6 GB | Ja, mit Platz fuer mehrere weitere |
| Qwen3.6 27B, 4-bit | 16,1 GB | Ja, mit Platz fuer mehrere weitere |
| Qwen3.6 27B, 8-bit | 29,5 GB | Ja, komfortabel |
| Llama 3.3 70B, 4-bit | 39,7 GB | Ja, komfortabel |
| Qwen3.6 27B, full precision | 55,6 GB | Ja, knapp |
| gpt-oss 120B, MXFP4 | 63,4 GB | Ja, aber das ist die Grenze |
Ein 96-GB Mac Studio bleibt also ein faehiger lokaler KI-Rechner. Er verarbeitet alles bis etwa zur 70B-Dense-Klasse bei 4-bit, ein 27B-Modell in voller Praezision oder mehrere mittelgrosse Modelle gleichzeitig fuer eine Agent-Pipeline. Das deckt die meisten praktischen lokalen Aufgaben ab, und das ist der ehrliche Fall fuer einen Kauf heute.
Was er nicht mehr abdeckt, ist die Spitze der Open-Weights-Welt, wofuer die 512-GB-Konfiguration genau gedacht war. Mehr zu Modellauswahl findest du in unserem Ratgeber zu den besten Open-Source-KI-Modellen.
Die Frontier Open Models passen auf keinen Mac mehr
Hier hat sich die Geschichte des Mac Studio unter ihm veraendert. Vor zwei Jahren lagen die groessten Open-Weight-Modelle im 70B-Bereich, und ein Mac mit viel Speicher war der guenstigste Weg, eines davon zu betreiben. Die Frontier ist seitdem zu Billionen-Parameter-Mixture-of-Experts-Modellen uebergegangen, und das viel schneller als Apples Speichergrenze. Die folgenden Zahlen sind gemessene Download-Groessen aus den jeweiligen Modell-Repositories.
| Open-Weight-Modell | Parameter | Gewichte auf der Festplatte | Laeuft auf einem Mac Studio? |
|---|---|---|---|
| Kimi K3 | 2,8T gesamt, 104B aktiv | 1.561 GB | Nein |
| GLM-5.2 | 744B gesamt, 40B aktiv | 1.507 GB | Nein |
| DeepSeek V4 Pro | 1,6T gesamt | 865 GB | Nein |
| Kimi K2.7 Code, 4-bit | nicht veroeffentlicht | 641 GB | Nein |
Keines davon passt. Weder auf einen 96-GB Mac Studio noch auf einen 768-GB-Modell.
Kimi K3s Gewichte allein umfassen 1,56 TB. Das ist mehr als das Sechzehnfache eines 96-GB Mac Studio und mehr als das Doppelte der 768 GB, mit denen der M5 Ultra Berichten zufolge getestet wurde. Selbst die optimistischste Version dieses Geraets kann das beste heutige Open-Modell nicht ausfuehren, und keine Quantisierung schliesst eine so grosse Luecke. Unser ausfuehrliches Kimi K3 Breakdown erklaert, was fuer den Betrieb noetig ist.
Das ist es wert, klar zu sagen, weil die aeltere Darstellung auf dieser Seite, dass Apple Silicon durch das Ausfuehren der groessten Modelle gewinnt, an der absoluten Spitze nicht mehr stimmt. Was Apple Silicon weiterhin gewinnt, ist die Mitte: guenstige, stille, private Inference auf faehigen mittelgrossen Modellen, mit einem Unified-Memory-Pool, den eine Consumer-Grafikkarte nicht erreicht. Das ist eine bescheidenere Aussage, aber eine haltbare.
Wie UltraFusion funktioniert und warum es fuer lokale KI wichtig ist
Apples urspruengliches M1 Ultra UltraFusion-Design verwendete einen Silizium-Interposer, um zwei M1 Max Dies ueber mehr als 10.000 Signale zu verbinden und dabei 2,5 TB/s Bandbreite zwischen ihnen zu liefern. Es wird erwartet, dass der M5 Ultra dieselbe Technik auf zwei M5 Max Dies anwendet.
Der Vorteil fuer KI-Arbeit: Software sieht einen Chip mit einem Arbeitsspeicher-Pool, nicht zwei Chips, die Gewichte ueber eine langsame Verbindung hin- und herschaufeln. Fuer ein Modell, das sich ueber Dutzende von Gigabyte erstreckt, ist das der Unterschied zwischen einmaligem Laden und dem Streamen von Teilen bei jedem Token.
Unified Memory beseitigt auch die Trennung zwischen CPU-RAM und GPU-VRAM. Bei einer Workstation mit einer RTX 5090 hast du 32 GB VRAM getrennt vom System-RAM, und alles, was nicht passt, muss ausgelagert oder staerker quantisiert werden. Auf einem 96-GB Mac Studio schoefen CPU und GPU aus demselben Pool bei denselben 819 GB/s. Das ist ein dreifacher Kapazitaetsvorteil heute. Es war ein achtfacher Vorteil, als 256 GB noch verfuegbar war, was genau das ist, was Apple aufgegeben hat.
Anschluesse, Displays und der Rest des Geraets
Das Gehaeuse soll sich nicht aendern, daher ist das heutige Layout der richtige Ausgangspunkt. Auf der Rueckseite hat jeder Mac Studio vier Thunderbolt 5 Ports mit bis zu 120 Gb/s, zwei USB-A-Ports mit 5 Gb/s, HDMI 2.1, 10-Gb-Ethernet und eine Kopfhoererbuchse. Die Vorderseite unterscheidet sich je nach Chip, und das ist die einzige Stelle, an der die beiden Modelle nicht gleichwertig sind.
| Vordere Anschluesse | M4 Max | M3 Ultra |
|---|---|---|
| Zwei Ports | USB-C mit 10 Gb/s | Thunderbolt 5 mit 120 Gb/s |
| Kartenschacht | SDXC (UHS-II) | SDXC (UHS-II) |
| Thunderbolt 5 Ports gesamt | Vier | Sechs |
Bei der Display-Unterstuetzung verdient der Ultra seinen Namen. Der M3 Ultra steuert acht Displays mit 6K und 60 Hz, oder vier mit 8K und 60 Hz. Der M4 Max schafft fuenf.
Was Apples eigene Benchmarks zur M5 KI-Leistung zeigen
Apples Machine Learning Research Team veroeffentlichte im November 2025 gemessene MLX-Benchmarks fuer den M5, und das ist das beste First-Party-Beleg dafuer, was die Neural Accelerators leisten. Beim Time-to-First-Token ist der M5 bis zu 4x schneller als der M4, mit modellspezifischen Beschleunigungen von 3,33x bis 4,06x bei Qwen-Modellen mit 1,7B, 8B, 14B und 30B Mixture-of-Experts sowie gpt-oss 20B.
Die anhaltende Token-Generierung, die eher durch Bandbreite als durch Rechenleistung begrenzt wird, verbesserte sich um bescheidenere 19 bis 27 %. Apple fuehrt das auf eine Steigerung der Arbeitsspeicher-Bandbreite von 120 GB/s beim Basis-M4 auf 153 GB/s beim Basis-M5 zurueck, ein Anstieg von 28 %.
Prompt-Verarbeitung skaliert mit Rechenleistung. Generierung skaliert mit Arbeitsspeicher-Bandbreite.
Diese Unterscheidung ist die nuetzliche Lektion fuer Mac Studio Kaeufer. Die Neural Accelerators machen die Prompt-Verarbeitung dramatisch schneller, was du bei langen Dokumenten und grossen Codebasen am deutlichsten spuerst. Die Generierungsgeschwindigkeit skaliert stattdessen mit der Bandbreite. Deshalb haelt die 819 GB/s des M3 Ultra gegen deutlich neuere Chips stand. Und deshalb sollte ein M5 Ultra, der zwei 614-GB/s-Dies verbindet, ein grosser Schritt sein, kein inkrementeller.
Der Software-Stack: MLX, Ollama und LM Studio
Die Apple-Silicon-Software-Situation hat sich 2026 deutlich verbessert, und drei Tools decken fast jeden Anwendungsfall ab.
MLX
MLX ist Apples eigenes Machine-Learning-Framework, das darauf ausgelegt ist, Unified Memory und die Neural Accelerators direkt zu nutzen. Es ist der schnellste Weg auf Apple Silicon und die richtige Wahl, wenn du ein Produkt auf Basis lokaler Inference aufbaust, statt nur ein Modell auszufuehren.
Ollama
Ollama ist der einfachste Weg, eine lokale API zum Laufen zu bringen: installieren, Modell herunterladen, fertig. Es hat am 30. Maerz 2026 ein MLX-Backend in der Preview-Version veroeffentlicht und seitdem hart daran gearbeitet. Das Engineering-Blog meldete im Juni die bisher hoechste Apple Silicon Performance.
Sei vorsichtig mit den damit verbundenen Beschleunigungszahlen, einschliesslich einiger, die wir als Pauschalzahl wiederholt gesehen haben. Olamas staerkster eigener Anspruch ist bis zu 90 % schneller beim Einsatz mit Coding Agents, gemessen am Aider Polyglot Benchmark, und bezieht sich auf eine spezifische Multi-Token-Prediction-Optimierung. Unabhaengige Tests zeigen, dass die Gewinne sich stark auf Mixture-of-Experts-Modelle konzentrieren und bei einigen Dense-Modellen nahezu null betragen. Rechne mit einem grossen Gewinn bei MoE, und teste, bevor du annimmst, dass es auf dein Modell zutrifft.
LM Studio
LM Studio ist eine GUI-App zum Herunterladen, Ausfuehren und Chatten mit Modellen, die auch MLX unterstuetzt. Wenn du noch nie ein lokales Modell betrieben hast, fang hier an, wechsle zu Ollama, wenn du es per Script aufrufen moechtest, und greife direkt auf MLX zurueck, wenn du optimierst.
M5 Ultra vs RTX 5090 fuer lokale KI
Dieser Vergleich hat sich auf interessante Weise veraendert: Beide Seiten wurden aus demselben Grund teurer. Der Speicher-Engpass, der Apples Konfigurationen kuerzte und Mac-Preise anhob, trieb auch GDDR7-Kosten in die Hoehe, und Nvidia soll die Board-Partner-Preise im Mai 2026 um rund $300 angehoben haben.
Die RTX 5090 startete zu einem Listenpreis von $1.999 und war lange nicht zuverlaessig zu diesem Preis verfuegbar. Die aktuellen Strassenpreise sind umstritten. Tracker zeigen Werte von einem Median von rund $2.150 im Juni bis zu rund $4.300 bei grossen Haendlern, mit Premium-Partnerkarten ueber $5.000. Wir nennen dir die Bandbreite, statt eine einzige Zahl vorzugeben.
In der Rohgeschwindigkeit gewinnt die 5090 bei allem, was in ihre 32 GB VRAM passt, und zieht dabei bis zu 575 Watt, bevor du CPU, Mainboard, Netzteil und Kuehlung hinzufuegst. Ein Mac Studio ist eine einzelne Box mit einem Bruchteil des Stromverbrauchs und dem MLX-Stack bereits installiert.
Dann stoesst du an die Speicherwand.
Speicher ist weiterhin der entscheidende Unterschied
Ein 70B-Modell bei 4-bit ist gemessen 39,7 GB. Das passt nicht auf eine einzelne RTX 5090, also betreibst du zwei Karten, lagerst Layer in den System-RAM aus und verlierst den Grossteil deiner Geschwindigkeit, oder du quantisierst staerker und verlierst Qualitaet. Ein 96-GB Mac Studio laedt es mit Spielraum und haelt ein zweites Modell daneben.
Die ehrliche Regel: die 5090 fuer die schnellsten Tokens pro Sekunde bei Modellen, die in 32 GB passen, der Mac Studio fuer das stille Halten von Modellen, die es nicht tun, auf einem einzigen Schreibtisch. Beachte, wie viel enger dieser Anspruch im Vergleich zu vor sechs Monaten ist. Bei 256 GB war der Kapazitaetsvorteil des Mac acht zu eins; bei 96 GB ist er drei zu eins.
M5 Ultra vs M3 Ultra vs M5 Max: Wer sollte warten?
Die Kaufentscheidung haengt jetzt eher vom Speicher als von der Chip-Generation ab, und das veraendert die uebliche Antwort. Warten ist attraktiver geworden, nicht weniger, weil der heute verkaufte Mac Studio der schwachste Mac Studio fuer grosse lokale Modelle ist, den Apple seit dem Start des M3 Ultra angeboten hat.
| Wenn du... | Tue das | Warum |
|---|---|---|
| Modelle ueber 70B lokal betreibst | Auf den M5 Ultra warten | 96 GB kann diese Aufgabe zu keinem Preis erledigen. 768 GB koennte es, wenn es erscheint |
| Modelle von 27B bis 70B betreibst | Jetzt kaufen, oder warten wenn moeglich | Ein 96-GB M3 Ultra erledigt das heute gut bei $5.299 |
| Hauptsaechlich Video, 3D oder allgemeine Pro-Arbeit machst | Den M4 Max fuer $2.499 kaufen | Du bist nicht speicher-limitiert, der Ultra-Aufpreis betraegt $2.800 |
| Portabilitaet moechtest | M5 Max MacBook Pro | Dieselbe KI-Architektur pro Kern, bis zu 128 GB, mehr Speicher als das Ultra Studio |
| Mit lokalem KI anfaengst | Mac mini | Ein Bruchteil des Preises und ausreichend fuer mittelgrosse Modelle |
| Einen Intel Mac oder M1 Ultra besitzt | Upgraden, und den Zeitpunkt waehlen | macOS 27 laesst Intel fallen, das ist also keine Option, nur eine Frage des Wann |
Schau dir die vierte Zeile nochmal an. Ein M5 Max MacBook Pro laesst sich auf 128 GB Unified Memory konfigurieren, was mehr ist als der $5.299-M3-Ultra-Mac-Studio erreichen kann. Fuer speicherlimitierte lokale Inference uebertrifft Apples Laptop derzeit Apples Desktop-Workstation in der Konfiguration. Wir beschreiben das Geraet ausfuehrlich in unserem M5 MacBook Pro Upgrade-Ratgeber und vergleichen die Modellreihe in unserem besten MacBook fuer KI-Ratgeber. Fuer die guenstigere Option, sieh unseren Mac mini fuer KI Breakdown.
Kein M6 Ultra: das naechste Warten laeuft bis 2028
Wenn du dich entscheidest zu warten, lohnt es sich zu wissen, worauf du danach warten wuerdest. Apple ueberspringt die M6-Generation am oberen Ende vollstaendig. Es wird keinen M6 Pro und keinen M6 Max geben, und folglich auch keinen M6 Ultra, da ein Ultra-Chip durch die Verbindung zweier Max-Dies entsteht.
Ein Ultra braucht zwei Max-Dies. Kein M6 Max bedeutet keinen M6 Ultra.
AppleInsider berichtete im Juni, dass der naechste Ultra nach dem M5 der M7 Ultra ist, der irgendwann 2028 erwartet wird. Das veraendert die Entscheidung auf eine Art, die die meisten Berichte uebergehen. Der M5 Ultra ist nicht eine Stufe auf einer jaehrlichen Leiter; er ist das einzige Ultra-Tier-Upgrade, das fuer rund zwei Jahre verfuegbar sein wird.
Die Wahl ist also enger als sie aussieht. Kauf jetzt einen 96-GB M3 Ultra, nimm den M5 Ultra, wenn er um Oktober erscheint, oder behalte, was du hast, bis 2028. Wenn deine Arbeit speicher-limitiert ist, macht nur die mittlere Option Sinn, und es lohnt sich, danach zu planen.
Was wir noch nicht wissen
Einiges, und es ist wert, explizit zu sagen, welche Teile dieser Seite gesichert sind und welche nicht. Alles ueber den aktuellen Mac Studio, seine Preise, seine 96-GB-Grenze, seine Anschluesse und die gemessenen Modellgroessen, ist anhand von Apples eigenen Seiten und den Modell-Repositories verifiziert. Alles ueber den M5 Ultra ist Berichterstattung.
- Ob 768 GB ueberhaupt erscheint. Apple hat es Berichten zufolge getestet; Lieferengpaesse koennten es verhindern
- Speicher-Bandbreite. Keine glaubwuerdige Zahl wurde fuer den M5 Ultra veroeffentlicht
- Preis. Nichts ist durchgesickert, und der $5.299-Ausgangspreis des M3 Ultra laesst aeltere Schaetzungen im $4.000-Bereich veraltet aussehen
- Zeitplan. Oktober 2026 ist Berichterstattung, kein Datum, und dieses Geraet hat bereits eine Verschiebung hinter sich
- Ob die 96-GB-Kuerzung dauerhaft ist oder eine Engpass-Massnahme, die sich umkehrt, wenn DRAM wieder leichter verfuegbar ist
Behandle jede Zeile oben wie Wetter, nicht wie eine Prognose, nach der du ein Budget planen kannst.
Wir haben bewusst keine M5 Ultra Preisschaetzung oder Tokens-pro-Sekunde-Projektion fuer Hardware gedruckt, die noch nicht existiert. Wo diese Seite das frueher enthielt, waren es Extrapolationen, und die 96-GB-Kuerzung ist ein gutes Beispiel dafuer, wie schlecht Extrapolationen altern koennen.
macOS 27 Golden Gate und das Ende von Intel
Der M5 Ultra Mac Studio wird mit macOS 27 Golden Gate erscheinen, das auf der WWDC 2026 am 8. Juni angekuendigt wurde und fuer Spaet-2026 geplant ist. Es ist die erste macOS-Version, die nur auf Apple Silicon laeuft, und die letzte mit vollstaendigem Rosetta 2. Wir behandeln es ausfuehrlich in unserem macOS 27 Golden Gate Ratgeber.
Intel Macs enden bei macOS 26 Tahoe. Wenn du einen 2019er Mac Pro, ein 2019er 16-Zoll MacBook Pro oder ein 2020er iMac nutzt, ist das das Ende der Linie fuer neue Mac-KI-Funktionen. Die Migration zu Apple Silicon ist eine Notwendigkeit geworden, kein optionales Upgrade mehr.
Eine Klarstellung, die sich lohnt, weil sie oft falsch dargestellt wird. Apples erweitertes Apple Intelligence Tier erfordert Mac-Modelle mit M3 und spaeter sowie mindestens 12 GB Unified Memory, und diese Anforderung betrifft zwei spezifische Funktionen, die ausdrucksstarke Siri-Stimme und die hochpraezise On-Device-Diktierfunktion. Es sperrt Siris KI-Funktionen nicht als Ganzes, die auf jedem Apple-Silicon-Mac laufen. Jeder Mac Studio erfullt die 12-GB-Anforderung achtmal, daher ist das hier kein Thema.
Lokale Modelle auf dem Mac Studio, Frontier-Modelle ueber Fello AI
Ein Mac Studio ist hervorragend fuer private, ungemessene Inference auf Open-Weight-Modellen. Was kein lokaler Rechner kann, ist das Ausfuehren der Closed-Weights-Frontier-Modelle, weil diese Gewichte nie veroeffentlicht werden. Wie die Tabelle oben zeigt, kann er zunehmend auch die groessten Open-Modelle nicht mehr ausfuehren.
Diese Luecke schliesst Fello AI. Die App laeuft nativ auf Apple Silicon und stellt die fuehrenden Frontier-Assistenten in einer einzigen Menueleisten-App fuer $9.99 im Monat zur Verfuegung, sodass du keine einzelnen Abonnements benotigst, um Antworten zu vergleichen. Die Aufteilung funktioniert sauber: Open-Modelle laufen lokal auf deinem Mac ueber MLX oder Ollama, und Frontier-Modelle werden ueber Fello AI weitergeleitet, wenn eine Aufgabe die beste verfuegbare Qualitaet erfordert. Fello AI haelt eine 4,7-Sterne-Bewertung bei ueber 27.000 Rezensionen.
Wenn du lieber einzelne Clients installierst, haben wir Ratgeber fuer Claude auf dem Mac, ChatGPT fuer Mac, Gemini Desktop fuer Mac und Grok auf dem Mac. Um zu sehen, welches Cloud-Modell welchen Benchmark gerade anfuehrt, beginne mit unserem besten KI-Modelle-Ratgeber.
Solltest du auf den M5 Ultra Mac Studio warten?
Fuer speicherlimitierte lokale KI-Arbeit: ja, warte, und das ist eine eindeutigere Antwort als diese Seite vor drei Monaten geben konnte. Ein $5.299-Mac Studio mit einer Grenze von 96 GB ist nicht das Geraet, das diese Reihe fuer lokale Inference bekannt gemacht hat, und die 768-GB-Zahl, so unsicher sie ist, ist der einzige Weg zurueck zu dieser Faehigkeit.
Wenn deine Arbeit nicht speicher-limitiert ist, hoer auf zu warten. Der M4 Max fuer $2.499 ist ein starker Desktop fuer Video, 3D und allgemeine professionelle Arbeit, und nichts in den M5 Ultra Geruechten aendert das. Den $2.800-Ultra-Aufpreis fuer Bandbreite zu zahlen, die du nie ausschoepfst, war nie ein gutes Geschaeft.
Wenn du Portabilitaet brauchst, kauf das M5 Max MacBook Pro, da es 128 GB erreicht und das Ultra Desktop heute beim Speicher uebertrifft. Wenn du Apple Silicon gegen Alternativen abwaegst, stellt unser MacBook vs Googlebook vs Chromebook Vergleich die breitere Landschaft dar, und unser Blick auf Apples KI-Roadmap zeigt, was nach diesem Hardware-Zyklus kommt.
Ein letzter praktischer Hinweis. Pruef Apples Konfigurator selbst am Kauftag. Die Speicheroptionen dieses Geraets haben sich zweimal in neun Wochen ohne Ankuendigung geaendert, und die Richtung war abwaerts.
Pruef nach, bevor du $5.299 ausgibst.
FAQ
Wann kommt der M5 Ultra Mac Studio?
Apple hat kein Datum bestaetigt, und die WWDC 2026 im Juni verlief ohne eine Ankuendigung. AppleInsider berichtete Ende Juni, dass der M5 Ultra noch 2026 erscheinen soll, und Bloomberg hat auf etwa Oktober 2026 hingewiesen. Der weltweite DRAM-Engpass ist der Grund fuer die Verspaetung.
Wie viel Arbeitsspeicher hat der Mac Studio jetzt?
96 GB, und das ist die einzige Option. Apple entfernte die 512-GB-Konfiguration im Maerz 2026 und die 256-GB-Konfiguration am 5. Mai 2026. Apples eigene Tech-Specs-Seite listet 96 GB Unified Memory fuer den M3 Ultra ohne Konfigurierbar-bis-Angabe, und die Vergleichsseite beschreibt das Geraet als ab 96 GB.
Wird der M5 Ultra Mac Studio 768 GB Arbeitsspeicher haben?
Es ist moeglich, aber nicht bestaetigt. MacRumors berichtete im Juni 2026, dass Apple die Unterstuetzung fuer bis zu 768 GB Unified Memory getestet hat, warnte aber, dass Lieferengpaesse diese Option am Erscheinen hindern koennten. Derselbe Bericht merkte an, dass das einen voll konfigurierten Mac Studio auf ueber $10.000 treiben koennte.
Was kostet der Mac Studio?
Live aus Apples Store: der M4 Max startet bei $2.499 und der M3 Ultra bei $5.299 mit 96 GB und 1 TB. Beide stiegen am 25. Juni 2026 an, von $1.999 und $3.999. Einige Ratgeber drucken noch die alten Zahlen, also pruef direkt bei Apple nach.
Kann ein Mac Studio 70B lokale LLMs ausfuehren?
Ja, komfortabel. Der MLX-Build von Llama 3.3 70B bei 4-bit ist gemessen 39,7 GB, was in 96 GB mit Spielraum fuer ein zweites Modell passt. Plane mit rund 75 bis 80 GB nutzbarem Speicher nach macOS und dem KV-Cache.
Kann ein Mac Studio Kimi K3 oder DeepSeek V4 ausfuehren?
Nein, und auch eine 768-GB-Version wuerde es nicht koennen. Kimi K3s Gewichte sind 1,56 TB auf der Festplatte und DeepSeek V4 Pros sind 865 GB, gemessen aus ihren eigenen Repositories. Die heutigen Frontier Open-Weight-Modelle brauchen Server-Hardware, keinen Desktop.
Wird es einen M6 Ultra geben?
Nein. Apple ueberspringt die M6-Generation am oberen Ende, also wird es keinen M6 Pro, M6 Max oder M6 Ultra geben. AppleInsider berichtet, dass der naechste Ultra-Chip der M7 Ultra im Jahr 2028 ist, was den M5 Ultra zum einzigen Ultra-Tier-Upgrade fuer rund zwei Jahre macht.
Ist ein Mac Studio oder eine RTX 5090 besser fuer lokale KI?
Das haengt von der Modellgroesse ab. Die RTX 5090 ist schneller bei allem, was in ihre 32 GB VRAM passt. Ein 96-GB Mac Studio haelt Modelle, die die 5090 nicht kann, in einer ruhigen Box mit deutlich niedrigerem Stromverbrauch. Dieser Kapazitaetsvorteil ist jetzt drei zu eins statt acht zu eins, als 256 GB verfuegbar war.
Unterstuetzt macOS 27 Intel Macs?
Nein. macOS 27 Golden Gate, angekuendigt auf der WWDC 2026 am 8. Juni, ist die erste Apple-Silicon-only-Version von macOS und die letzte mit vollstaendigem Rosetta 2. Intel Macs enden bei macOS 26 Tahoe.