ModCon 2026: Open source, open cloud, open silicon

Vier en een half jaar geleden deed Modular een gok: AI zou niet voor altijd op één soort silicon draaien, en de softwarestack zou opnieuw moeten worden architectuurd voor een wereld van heterogene hardware en steeds complexere AI-workloads.

Tijdens de keynote van ModCon vanochtend hebben we laten zien wat er van die gok is geworden. Het Modular Platform is nu productieklaar, serveert miljarden tokens per minuut en drijft echte implementaties binnen ondernemingen aan. We stellen meer delen van het platform open voor het ecosysteem, breiden het uit naar geheel nieuwe klassen hardware en betrekken belangrijke industriepartners bij ons.

Concreet hebben Modular en Qualcomm het volgende aangekondigd:

  • Mojo 1.0 is nu volledig open source onder een Apache 2.0-licentie.
  • Modular Cloud is publiekelijk beschikbaar en bedient belangrijke klanten zoals MiniMax.
  • Het Modular Platform ondersteunt nu AWS Trainium, Google TPU's en de Qualcomm Cloud AI 100 en Qualcomm Dragonfly-acceleratoren, naast CPU's en GPU's.
  • Native Windows-ondersteuning komt naar Mojo, dankzij een samenwerking met het Microsoft Windows-team.
  • De MAX-licentie bevat geen beperkingen meer op apparaatgebruik en MAX zal 'source-available' worden met een open alliantieprogramma, zodat het bredere ecosysteem het platform samen met ons kan bouwen.

Heterogene computing is hier, en het heeft nu één open softwareplatform.

Mojo is nu open source

Vorige week kondigden we aan dat Mojo versie 1.0 heeft bereikt. Hiermee bieden we ontwikkelaars een stabiele, productieklare basis waarop ze voor de lange termijn kunnen bouwen. Naast een reeks nieuwe functies is het belangrijkste onderdeel van 1.0 de stabiliteitsgarantie: de code die je vandaag schrijft, zal in de toekomst niet plotseling onbruikbaar worden.

Vandaag gaan we een stap verder. De gehele Mojo-taal is nu open source onder de onbeperkte Apache 2.0-licentie. Dit betekent dat de compiler en alle tooling volledig open source zijn. Je kunt de taal uitbreiden, deze naar nieuwe platforms brengen en er alle gewenste applicaties op bouwen. Dit zet de progressieve opening van onze stack voort, die begon met de Mojo-standaardbibliotheek in 2024 en de MAX-kernels in 2025. Voor meer informatie over Mojo en om bij te dragen, kun je terecht op mojolang.org.

Windows-ondersteuning voor Mojo

Mojo ondersteunt macOS en Linux al jaren, en Windows-ontwikkelaars konden de taal gebruiken via WSL. Native ondersteuning voor Windows was een van de meest gehoorde verzoeken van ontwikkelaars.

Miljoenen ontwikkelaars bouwen dagelijks op Windows voor een enorme reeks applicaties en workloads. We geloven dat Mojo een betekenisvolle impact kan hebben binnen dat ecosysteem. Om Mojo op de juiste manier naar Windows te brengen, is diepgaande expertise van het platform nodig. Daarom zijn we verheugd dat het Microsoft Windows-team dezelfde kansen ziet als wij en dat we samenwerken om dit te realiseren.

"We zijn enthousiast om te zien dat Mojo naar Windows komt en de kansen die dit creëert voor ontwikkelaars die werken aan systemen en AI. Miljoenen ontwikkelaars bouwen elke dag op Windows, en we zetten ons in om hen te helpen toegang te krijgen tot de tools en technologieën die ze nodig hebben op het platform van hun keuze."
Logan Iyer, CVP, Windows Platform + Developer

Introductie van Modular Cloud

Modular Cloud is de plek waar de volledige Modular-stack samenkomt als een productieservice. Het geeft ontwikkelaars direct toegang tot de toonaangevende inferentieprestaties van Modular, terwijl de complexiteit van het implementeren, optimaliseren en beheren van modellen over heterogene infrastructuur wordt geabstraheerd.

Modular Cloud is algemeen beschikbaar via console.modular.com en serveert populaire open source-modellen via gedeelde endpoints en dedicated implementaties. Gedeelde endpoints zijn OpenAI-compatibel met een prijsmodel per token, terwijl dedicated implementaties draaien op onze compute of op je eigen infrastructuur, in gereserveerde geïsoleerde instanties.

De afgelopen maanden heeft Modular Cloud in stilte verkeer geserveerd voor OpenRouter onder de naam ModelRun. Hierbij behaalden de endpoints consequent de hoogste scores voor latentie en doorvoer bij productieverkeer. Artificial Analysis, een onafhankelijk benchmarkbureau, bevestigt dit beeld.

Case Study: MiniMax

MiniMax is een toonaangevende zakelijke klant van Modular Cloud. Zij draaien M3 op een dedicated Modular-implementatie die productieverkeer verwerkt met miljarden tokens per minuut.

Het efficiënt schalen van M3 vormt een unieke systeemuitdaging. Het combineert een contextvenster van 1 miljoen tokens, native multimodality en MiniMax Sparse Attention (MSA) — een innovatieve sparse-attention architectuur die selectief let op relevante KV-blokken, waardoor de benodigde rekenkracht afneemt naarmate de context schaalt.

Om state-of-the-art prestaties te leveren, was optimalisatie over de gehele stack nodig: het native implementeren van M3 in MAX, het bouwen en tunen van gespecialiseerde MSA-kernels, en het optimaliseren van de implementatie op basis van de werkelijke verkeerspatronen van MiniMax.

Voorbij GPU's: Trainium, TPU's en Dragonfly

Modular Cloud serveert al productieworkloads op NVIDIA- en AMD-GPU's. Vandaag breiden we die hardwareondersteuning uit naar custom AI-acceleratoren, wat een veel zwaardere test is voor de overdraagbaarheid van het platform.

We hebben ondersteuning toegevoegd voor:

  • AWS Trainium
  • Google TPU's
  • Qualcomm Cloud AI 100 Ultra
  • Qualcomm Dragonfly

Al deze platforms draaien via hetzelfde Modular Platform, met dezelfde modellerings-API's, serving-workflows, programmeertaal en kernabstracties. Ontwikkelaars kunnen een model één keer schrijven en dit naar volledig verschillende hardware-architecturen brengen zonder de softwarestack opnieuw op te bouwen.

Wat minstens zo belangrijk is: we hebben elk van deze platforms opgezet met een fractie van de technische inspanning die traditioneel nodig is om nieuwe AI-hardware te ondersteunen — een reductie van meer dan 10x in engineering-inspanning. In de komende maanden zullen we deze nieuwe hardwareplatforms in productie brengen en beschikbaar stellen via Modular Cloud.

MAX: Een gemeenschappelijke basis, gebouwd met het ecosysteem

Innovatie in AI-hardware versnelt, maar geweldige hardware is alleen waardevol als ontwikkelaars deze kunnen gebruiken. Te veel van die innovatie wordt nog steeds beperkt door softwarestacks die voor slechts één architectuur zijn geschreven. De industrie heeft een gemeenschappelijke softwarebasis nodig: één keer een model schrijven en elke accelerator bereiken, hardware kiezen op basis van prestaties en economie in plaats van welke stack het ondersteunt, en leveranciers laten concurreren op de kwaliteiten van hun silicon. Dat is wat we met het Modular Platform bouwen.

De samenwerking met Qualcomm versterkt dit doel. Het Modular Platform zal een breed scala aan hardware blijven ondersteunen en optimaliseren, inclusief hardware die direct concurreert met de platforms van Qualcomm Technologies. De kans voor het ecosysteem is veel groter dan de roadmap van één enkele leverancier, en een fundament werkt alleen als iedereen erop kan staan.

Om die basis te bouwen, starten we twee belangrijke initiatieven:

  1. We stellen MAX open. We evolueren het licentiemodel van MAX en breiden de toegang tot de broncode uit, zodat ontwikkelaars, bedrijven, hardwareleveranciers en partners op het platform kunnen bouwen, het kunnen uitbreiden en kunnen bijdragen.
  2. We bouwen een alliantieprogramma voor het ecosysteem. We werken aan een industrie-alliantieprogramma met hardwareleveranciers, modelproviders, cloudbedrijven en datacenter-operators. Het doel is om partners een directe rol te geven bij het integreren van MAX, het optimaliseren voor hun platforms en het vormgeven van de toekomst van het Modular Platform.

HTEC heeft al laten zien hoe dit in de praktijk werkt. Hun engineers implementeerden zelf de ondersteuning voor Google TPU's op het Modular Platform in slechts enkele maanden met een klein team, waarbij wij enkel een ondersteunende rol hadden. Dit is een duidelijke validatie van onze visie: een fundament dat het ecosysteem onafhankelijk kan uitbreiden.

Ook andere startup-hardwareleveranciers zien deze behoefte. d-Matrix is daar een voorbeeld van:

"De gedeelde toewijding van d-Matrix en Modular aan heterogene computing wordt ondersteund door wederzijdse steun voor open standaarden. Nu we het tijdperk van gedisaggregeerde heterogene compute ingaan, kunnen open standaarden de implementatie van GPU's, CPU's en XPU's versnellen die samenwerken om efficiëntie op schaal te stimuleren. Dat is waarom ons partnerschap zo'n natuurlijke match is."
Sid Sheth, Founder & CEO van d-Matrix

Begin vandaag nog

Alles wat je nodig hebt om te starten met open source Mojo 1.0 is nu beschikbaar op mojolang.org. Modular Cloud is live via console.modular.com. Voor wie vandaag in San Francisco aanwezig is bij ModCon: de tech-talks vanmiddag gaan dieper in op alle bovenstaande punten.

AI beweegt te snel om elk bedrijf telkens dezelfde infrastructuur opnieuw te laten bouwen. Modellen worden groter, serving wordt meer gedistribueerd en de hardware wordt heterogener. Open horizontale platforms hebben eerder industrieën gereset, maar alleen wanneer het ecosysteem samenkwam om ze te bouwen. Dus, of je nu werkt aan hardware, modellen, infrastructuur of applicaties: help ons dit fundament te bouwen. Neem contact met ons op via alliance@modular.com.