Ontwikkelaar bekijkt broncode op twee schermen in een donkere werkruimte.
Nieuws22 juli · 10:104 min leestijd

Cisco brengt Antares uit: open-weight modellen die code-lekken lokaliseren

Cisco Foundation AI brengt Antares uit, open-weight modellen die kwetsbaarheden in code lokaliseren. Ze draaien lokaal op je eigen hardware onder Apache 2.0 en zijn volgens het bedrijf tot 172 keer goedkoper dan GPT-5.5.

Cisco Foundation AI heeft Antares uitgebracht, twee open-weight AI-modellen die kwetsbaarheden in code lokaliseren en volgens het bedrijf tot 172 keer goedkoper draaien dan GPT-5.5, lokaal op je eigen hardware.

Voor een Nederlands softwarebedrijf of een IT-afdeling die aan compliance werkt, verschuift dat de rekensom rond code-audits. Tot nu toe zat de AI die zelfstandig lekken opspoort vooral in dure, gesloten frontier-modellen die je code naar de cloud sturen. Antares is klein genoeg om op eigen hardware te draaien en staat onder de Apache 2.0-licentie op Hugging Face, dus je broncode verlaat je eigen omgeving niet en een testrun die op GPT-5.5 rond 141 dollar kost, doe je hier voor minder dan een euro.

Wat Antares doet

De modellen krijgen niet meer dan een CWE-nummer en een algemene omschrijving van het type kwetsbaarheid, en gaan dan zelf een codebase door. Ze werken als een agent die shell-commando's uitvoert, kandidaat-bestanden leest, bewijs verzamelt en van richting verandert tot ze een gerangschikte lijst van bronbestanden opleveren die het lek waarschijnlijk bevatten. Het is dus geen vervanger van je securityteam, maar een triagehulp die de zoekruimte in een grote codebase versmalt.

Onder de motorkap bouwt Antares-1B voort op IBM's Granite 4.0-architectuur, met een contextvenster van 128.000 tokens, genoeg om flinke bestanden in één keer te overzien. Naast de 350M- en 1B-modellen die nu op Hugging Face staan, kondigt Cisco een grotere Antares-3B aan.

De kosten zijn de kern

Cisco zet de geschatte kosten per evaluatie op de eigen benchmark naast elkaar: de Antares-modellen draaien voor 0,60 tot 0,82 dollar per run, waar het Chinese GLM-5.2 op 12,50 dollar uitkomt en OpenAI's GPT-5.5 op 141 dollar. Dat maakt Antares 15,2 keer goedkoper dan GLM-5.2 en 172 keer goedkoper dan GPT-5.5, bij een fractie van de omvang.

Grafiek van Cisco die de geschatte kosten per evaluatie vergelijkt. De Antares-modellen kosten 0,60 tot 0,82 dollar per run, GLM-5.2 kost 12,50 dollar en GPT-5.5 kost 141 dollar (bron: Cisco).
Grafiek van Cisco die de geschatte kosten per evaluatie vergelijkt. De Antares-modellen kosten 0,60 tot 0,82 dollar per run, GLM-5.2 kost 12,50 dollar en GPT-5.5 kost 141 dollar (bron: Cisco).

Voor een team dat een codebase regelmatig wil doorlichten, is dat het verschil tussen een kostenpost die je afschrikt en een die je desnoods wekelijks laat draaien. De modellen draaien op eigen hardware, dus je betaalt niet per token bij een externe API en gevoelige code blijft binnen je eigen netwerk.

Prestaties, eerlijk gelezen

Klein betekent hier niet zwak. Op Cisco's eigen Vulnerability Localization Benchmark, een set van 500 taken over verschillende CWE-categorieën, scoort Antares-3B dicht bij de sterkste GPT-5.5-configuraties, en verslaat Antares-1B zowel GLM-5.2 als Google's Gemini 3 Pro, modellen die vele malen groter zijn.

De benchmark is nieuw en van Cisco zelf, dus onafhankelijke herhaling moet nog volgen. Het patroon is niettemin duidelijk: voor deze ene, smalle taak haalt een model van een miljard parameters de buurt van de frontier, tegen een fractie van de rekenkosten.

Waarom dit ertoe doet

De aankondiging tekent een bredere verschuiving. De AI die zelfstandig kwetsbaarheden vindt, was tot voor kort het terrein van gesloten cloudmodellen. Google's Gemini 3.5 Flash Cyber vond 55 bevestigde lekken in de V8-engine van Chrome, maar blijft voorlopig alleen voor overheden en vertrouwde partners beschikbaar. Antares draait die logica om: dezelfde soort taak, maar in een model dat iedereen mag downloaden, aanpassen en achter de eigen firewall draaien.

Dat sluit aan op wat het Britse AI Security Institute deze maand mat, namelijk dat open-weight modellen op offensieve cybercapaciteit nog maar 4 tot 7 maanden achterlopen op de gesloten top, terwijl de kosten per testrun kelderen. Dezelfde beweging zie je nu aan de verdedigende kant. Het echte nieuws is niet dat een model lekken kan aanwijzen, maar dat het zo klein en zo goedkoop is geworden dat de drempel om het op je eigen code los te laten vrijwel verdwijnt.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

AI veilig op je eigen infra

Een open model op je code of data loslaten is stap één; de agents, koppelingen en self-hosted infrastructuur eromheen laten werken is het echte werk. Dat traject ontwerp en bouw ik end-to-end mee, van meedenken tot draaiende automatisering, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Tencent brengt open model Hy3 uit dat modellen tot vijf keer zijn omvang evenaart
Nieuws
5 min

7 jul 00:19

Tencent brengt open model Hy3 uit dat modellen tot vijf keer zijn omvang evenaart

Tencent zet zijn Hy3-model open source onder de Apache 2.0-licentie, waardoor het ook voor Europese bedrijven bruikbaar wordt. Het compacte model evenaart volgens Tencent veel grotere modellen, al houdt GLM-5.2 de codeerkroon.

AI-modellen sjoemelen bij cybertests en geven het zelden toe
Nieuws
4 min

22 jul 12:11

AI-modellen sjoemelen bij cybertests en geven het zelden toe

Elk AI-model dat het Britse AI Security Institute testte, sjoemelde bij zijn cybersecurity-evaluaties, van 7,8% tot 14,1% van de runs. En gevraagd of dat fout was, gaf geen model het vaker dan 44% van de keren toe.

Google lanceert goedkopere Gemini Flash-modellen en een AI die kwetsbaarheden zelf patcht
Nieuws
3 min

21 jul 18:10

Google lanceert goedkopere Gemini Flash-modellen en een AI die kwetsbaarheden zelf patcht

Google verlaagt met Gemini 3.6 Flash en 3.5 Flash-Lite de prijs van AI-code en lanceert 3.5 Flash Cyber, een model dat softwarelekken zelfstandig opspoort en patcht, voorlopig alleen voor overheden en vertrouwde partners.

Google stelt vlaggenschip Gemini 3.5 Pro uit om tegenvallende codeerprestaties
Nieuws
3 min

16 jul 22:20

Google stelt vlaggenschip Gemini 3.5 Pro uit om tegenvallende codeerprestaties

Google schuift de release van Gemini 3.5 Pro maanden op omdat de codeervaardigheden achterblijven bij de interne doelen, meldt Bloomberg. Alphabet-aandelen zakten donderdag ruim vier procent op het nieuws.

Kimi K2.7 Code nu kiesbaar in GitHub Copilot: eerste open-weight model in de modelkeuze
Nieuws
6 min

3 jul 04:10

Kimi K2.7 Code nu kiesbaar in GitHub Copilot: eerste open-weight model in de modelkeuze

GitHub heeft Kimi K2.7 Code algemeen beschikbaar gemaakt in de Copilot-modelkeuze. Het is het eerste open-weight model in de picker, fors goedkoper dan de frontier-modellen, en je devteam kan vandaag overstappen zonder tooling te wijzigen.

Proton lanceert Lumo 2.0: privacy-chatbot moet ChatGPT en Copilot evenaren
Nieuws
4 min

1 jul 00:29

Proton lanceert Lumo 2.0: privacy-chatbot moet ChatGPT en Copilot evenaren

Proton lanceert Lumo 2.0, een flink krachtigere AI-chatbot die op Europese servers draait onder Zwitsers privacyrecht en zo een concreet, betaalbaar alternatief biedt voor ChatGPT en Copilot.