Een persoon typt code op een laptop aan een bureau.
Nieuws6 oktober · 02:245 min leestijd

Together Link koppelt codeeragenten aan open modellen

Together Link laat bestaande codeeragenten open modellen via Together AI gebruiken. De gratis bèta werkt op macOS en Linux, maar modelkosten, beschikbare modellen en de route van broncode vragen om controle.

Together Link verbindt Claude Code, Codex en andere codeeragenten met gehoste open modellen, maakte Together AI op 5 oktober bekend. De tool laat ontwikkelaars hun bestaande agent behouden en de modelaanbieder verwisselen.

Een ontwikkelteam kan nu van modelaanbieder wisselen zonder van editor, project of werkwijze te veranderen. De rekening volgt het verbruik per model en token. Verzoeken gaan naar de aanbieder die ze verwerkt, en bij bepaalde Claude-taken kan daar een tweede rekening bijkomen.

Modellen en tarieven lopen niet gelijk

Together Link zelf is gratis en heeft een MIT-licentie. Het gebruik van de modellen wordt wel per token afgerekend via een Together API-sleutel. De huidige documentatie noemt Kimi K3 voor $2,70 invoer en $13,50 uitvoer, GLM 5.3 voor $1,40 en $4,40, DeepSeek V4.1 Flash voor $0,30 en $1,20, en Qwen 3.8 voor $2 en $6 per miljoen tokens. De tarieven gelden per miljoen invoer- en uitvoertokens; gecachte invoer heeft voor sommige modellen een lager tarief.

Bij een vereenvoudigde maandproef met 10 miljoen invoertokens en 1 miljoen uitvoertokens kost GLM 5.3 volgens die tarieven $18 en DeepSeek V4.1 Flash $4,20, vóór caching. Dat is een modelrekening voor een vast tokenvolume, geen prijs per afgeronde programmeertaak: een agent kan context opnieuw meesturen en een taak kan meerdere modelaanroepen vragen.

De openbare productpagina en de actuele documentatietabel wijken af. De getoonde Kimi K3-tarieven zijn $3 per miljoen invoer en $15 per miljoen uitvoer, met MiniMax M3 in de modelkeuze en een beloofde besparing van meer dan 50 procent. De docs noemen Qwen 3.8 in plaats van MiniMax en zetten Kimi op $2,70 en $13,50. Het aanbod kan in de bèta veranderen; Together verwijst daarom naar togetherlink models voor de actuele lijst.

Voorbeeldbon met een sessie van 42 minuten in Claude Code, modelregels voor Kimi K3 en GLM 5.3 Flash en een totaal van 31 dollarcent - Bron: Together AI
Voorbeeldbon met een sessie van 42 minuten in Claude Code, modelregels voor Kimi K3 en GLM 5.3 Flash en een totaal van 31 dollarcent - Bron: Together AI

De agent blijft, de route verandert

De bèta ondersteunt Claude Code, Claude Desktop en Cowork, Codex, ChatGPT Desktop, OpenCode 2 en Pi Code vanaf versie 0.80.8. De installatie vraagt macOS of Linux, Bash, curl, een bestaande agent en een Together API-sleutel. Pi Code vereist Node.js 22.19 of nieuwer. Together Link installeert de agent zelf niet.

Terminaltools krijgen alleen een tijdelijke sessieconfiguratie; hun normale instellingen en geschiedenis blijven staan. ChatGPT Desktop en Claude Desktop gebruiken elk een eigen profiel. De desktops zijn volgens de documentatie nog in bèta.

Auto is de standaard: een cloudgateway beoordeelt elk verzoek en kiest een model. In Claude Code en Claude Desktop kan een optionele Anthropic API-sleutel moeilijke vragen naar Claude Opus sturen; die komen op de Anthropic-rekening. Zonder die sleutel verwerkt Together alle verzoeken zelf. Codex, OpenCode, Pi Code en ChatGPT Desktop blijven altijd op Together-modellen. Een Claude-proef kan dus twee modelrekeningen opleveren.

Z.ai bracht een eigen codeeromgeving op GLM-5.2 uit en bood nieuwe gebruikers 5 miljoen gratis tokens. Together Link houdt de bestaande editor en verandert alleen de modelroute. AT&T meldde bij een bredere inzet tot 56 procent lagere kosten voor codeer- en andere AI-taken, met 2 procent kwaliteitsverlies. Dat resultaat is niet rechtstreeks vergelijkbaar met Together’s productclaim.

De besparing is nog geen kwaliteitsmeting

Together noemt een besparing van meer dan 50 procent; de documentatie zegt 50 tot 80 procent vergeleken met sessies die volledig op Opus 5.5 draaien. De publicatie toont geen vaste programmeertaken of onafhankelijke kwaliteitsmeting bij dat cijfer. Een lagere tokenprijs zegt daarom nog niet hoeveel herstelwerk een codewijziging vraagt.

De bon in de afbeelding is een Together-voorbeeld: 42 minuten Claude Code voor 31 dollarcent, verdeeld over Kimi K3 en GLM 5.3 Flash. Hij laat zien hoe sessiekosten in beeld komen, maar niet wat een vergelijkbare programmeertaak kost of welke kwaliteit en hoeveelheid herstelwerk erbij horen.

Een vergelijking houdt dezelfde opdrachten, repositories en acceptatiecriteria aan en zet de rekening af tegen tests, reviewcorrecties, herstelrondes en wachttijd. Bij Auto telt ook de Anthropic-factuur mee. Zo wordt zichtbaar wat een afgeronde taak werkelijk kost.

Open gewichten draaien niet lokaal

Together Link stuurt codeeragenten naar een gehoste gateway; er draait geen lokale proxy. Daaruit volgt dat meegestuurde prompts en codecontext de computer verlaten en bij de gekozen modelaanbieder worden verwerkt. Open gewichten zeggen iets over modelbeschikbaarheid en licentie, niet over de plek waar verzoeken worden uitgevoerd.

Volgens Together geldt dat prompts niet voor modeltraining worden gebruikt zonder expliciete toestemming en dat Zero Data Retention apart kan worden aangezet. Die instelling geldt pas vanaf het moment van activeren; het beleid staat ook verwerking en opslag buiten het land van de gebruiker toe. Zonder aparte schriftelijke afspraak hebben partijen geen geheimhoudingsplicht tegenover elkaar, volgens Together’s algemene voorwaarden. Bij broncode met klantgegevens of bedrijfsgeheimen horen de privacy-instellingen, contractafspraken en verwerkingslocatie bij dezelfde leverancierskeuze.

OpenWorker biedt in dezelfde agentcategorie een lokale route via Ollama zonder API-sleutel, met eigen beheer en passende hardware. Together Link brengt de modelkeuze naar vertrouwde codeertools, maar blijft een bèta met een veranderlijk aanbod en routergedrag. Voor een organisatie hangen taakprijs, resultaatkwaliteit en de route van code daardoor samen.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Van modelkeuze naar werkende software

Ik denk mee over de juiste modellen voor je processen, ontwerp de koppelingen en bouw de agenten die het werk uitvoeren. Ik verzorg het hele traject, waar het kan self-hosted.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Open modellen halen 62 procent van het tokenverkeer op Vercels AI Gateway
Nieuws
5 min

24 aug 02:11

Open modellen halen 62 procent van het tokenverkeer op Vercels AI Gateway

Op 22 augustus liep 62 procent van alle tokens op Vercels AI Gateway over open modellen, tegen 28,4 procent in juni. De uitgaven volgen die verschuiving niet: daar houdt Anthropic de meerderheid vast.

Welke privacy-veilige AI-chatbot voor je MKB: Proton Lumo, Mistral Le Chat of zelf hosten
Gids
Uitgebreide gids11 min

8 jul 09:00

Welke privacy-veilige AI-chatbot voor je MKB: Proton Lumo, Mistral Le Chat of zelf hosten

Geen bedrijfsdata bij Amerikaanse AI, maar welke Europese of self-hosted route past bij jou? Een koperskeuzegids die Proton Lumo, Mistral Le Chat en zelf hosten afweegt op prijs, EU-databodem en beheerslast.

OpenAI watermerkt geschikte ChatGPT- en Codex-tekst in de EU
Nieuws
5 min

5 okt 20:37

OpenAI watermerkt geschikte ChatGPT- en Codex-tekst in de EU

Geschikte ChatGPT- en Codex-tekst krijgt in de EU straks een onzichtbaar OpenAI-watermerk. API-markering blijft wereldwijd vrijwillig, terwijl de AI-verordening gebruikers alleen bij bepaalde publicaties zelf een label oplegt.

DeepSeek voert Vercels AI Gateway-ranglijst aan
Nieuws
2 min

26 sep 09:47

DeepSeek voert Vercels AI Gateway-ranglijst aan

DeepSeek is goed voor 25,4 procent van OpenRouters tekstverzoeken. Op Vercels AI Gateway verwerkt DeepSeek V4.1 Flash 51,7 procent van het tokenvolume. Beide ranglijsten meten alleen hun eigen platform.

Bolt.new lanceert Forge met open modellen en 50x gebruik
Nieuws
3 min

14 sep 20:42

Bolt.new lanceert Forge met open modellen en 50x gebruik

Bolt.new lanceert Forge, een agent op open modellen met voor individuele Pro-abonnees tot 14 oktober vijftig keer meer gebruik. De ruil: opt-in voor geanonimiseerde bouwsessies die open modellen helpen trainen.

Het gratis AI-model met een drempel is een prijskaartje dat later wordt ingevuld
Inzicht
7 min

15 aug 17:00

Het gratis AI-model met een drempel is een prijskaartje dat later wordt ingevuld

Qwen, Kimi, Llama en Gemma zetten voorwaarden op je omzet, je gebruikersaantal en je merknaam. Een gratis model met een drempel is geen open source, maar een inkoopbeslissing die je vooruitschuift naar het moment dat je niet meer weg kunt.