Muse Spark 1.1 en 1.2 hielpen wiskundigen bij zes papers die Meta op 2 oktober publiceerde; volgens het bedrijf beantwoorden vijf daarvan eerder open vragen.
Voor Nederlandse R&D-teams maakt dit AI-ondersteund onderzoek tastbaarder: onderzoekers kozen de vragen en controleerden de redeneringen, terwijl het model meehielp aan ideeën en bewijsvoering. De inzet ligt bij de herleidbaarheid van AI-bijdragen en de vakkennis die nodig blijft om een uitkomst te beoordelen.
Hoe nieuw en hoe gecontroleerd?
Meta zegt dat onderzoekers de modellen via de gewone Meta AI-chat gebruikten, dat een tweede groep het werk beoordeelde en dat AI- en menselijk geschreven passages zijn gemarkeerd. Het overzicht noemt reviewers bij vijf papers, maar niet bij het rekenkundig-fysische paper. Het bedrijf noemt ook drie onderwerpen waarvoor andere teams onafhankelijk parallelle resultaten aankondigden. Niet alle uitkomsten zijn dus eerste oplossingen.
De onderzoekers werkten gedurende meerdere maanden met Muse Spark in Thinking Mode, zonder speciaal onderzoeksraamwerk. De zes studies laten verschillende bijdragen zien:
- Kansrekening: de studie vindt rond n ≈ d²/4 een scherpe grens voor hoeveel willekeurige punten precies op een ellipsoïde passen. Precies op die grens doet het paper geen uitspraak. Drie andere teams hadden in augustus al onafhankelijk de drempel of verwante resultaten online gezet. Muse Spark hielp de onderzoekers de bewijsstrategie ontwikkelen en aanscherpen.

- Differentiaalvergelijkingen: voor radiale golven met negatieve energie bewijst het paper instorting binnen eindige tijd, in twee of meer dimensies. Daarmee beantwoordt het een vraag die sinds 2015 openstond. Muse Spark hielp met berekeningen, het testen van ideeën en het aanscherpen van het bewijs.
- Groepentheorie: een tegenvoorbeeld met 384 elementen weerlegt een vermoeden over semiabeliaanse groepen, een klasse van wiskundige structuren. Muse Spark maakte het GAP-zoekprogramma dat het voorbeeld vond; onderzoekers controleerden en voltooiden het bewijs. Een AI-agent had op 16 september al een ander tegenvoorbeeld voor hetzelfde vermoeden gemeld.
- Optimalisatie: de studie bepaalt wanneer een vereenvoudigd model exact overeenkomt met het oorspronkelijke optimalisatieprobleem. In de onderzochte klasse klopt de vereenvoudiging wanneer elk van drie overlappende gebieden één keuzevariabele bevat. Muse Spark hielp de vraag via kansen te herformuleren en een tegenvoorbeeld te vinden.
- Rekenkundige natuurkunde: het paper verbindt een berekening uit de snaartheorie aan een hoogtefunctie uit de getaltheorie. Het breidt een eerder bekende koppeling voor de Tate-kromme uit. Muse Spark stelde bewijzen voor en schreef drie technische secties die onderzoekers controleerden en herschreven. Meta telt dit als zesde paper, niet als een van de vijf antwoorden op open vragen.
- Niet-associatieve algebra: een tegenvoorbeeld in drie dimensies weerlegt een voorgestelde classificatieregel voor evolutiealgebra's. Dit zijn wiskundige structuren geïnspireerd op biologie. Het paper stelt ook een alternatief criterium voor. Meta erkent onafhankelijk werk van Hu en Wen met tegenvoorbeelden voor hetzelfde vermoeden.
De onafhankelijke resultaten bij ellipsoïdefitting, groepentheorie en evolutiealgebra zijn parallelle oplossingen, geen externe controle van precies de Muse Spark-bewijzen. Bij ellipsoïdefitting noemt Meta drie eerdere studies: één bewijst dezelfde drempel, twee benaderen die of tonen een ruimer resultaat. Voor groepentheorie gaat het om een ander tegenvoorbeeld, niet hetzelfde bewijs. Bij de differentiaalvergelijkingen en optimalisatie noemt de aankondiging geen parallelle oplossing. Meta meldt review door een tweede groep, maar de aankondiging noemt geen onafhankelijke reproductie van elk bewijs of formele externe vakbladreview.
De publicatie beschrijft werk over meerdere maanden, geen kant-en-klaar onderzoeksproduct. Voor Nederlandse R&D-teams maakt dit de zakelijke inzet concreet: AI kan ideeën, zoekprogramma's en bewijsstappen aandragen, terwijl vakspecialisten de vraag kiezen, fouten opsporen en het resultaat dragen. De ontwikkeling laat samenwerking zien, geen zelfstandig modelantwoord.
Veelgestelde vragen
AI-resultaten die je kunt toetsen
Ik denk mee, ontwerp en realiseer AI- en kennisprocessen van de eerste onderzoeksvraag tot een werkende toepassing, met menselijke controle en automatisering ingebouwd. Waar het kan, draait die self-hosted.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
