Together Link verbindt Claude Code, Codex en andere codeeragenten met gehoste open modellen, maakte Together AI op 5 oktober bekend. De tool laat ontwikkelaars hun bestaande agent behouden en de modelaanbieder verwisselen.
Een ontwikkelteam kan nu van modelaanbieder wisselen zonder van editor, project of werkwijze te veranderen. De rekening volgt het verbruik per model en token. Verzoeken gaan naar de aanbieder die ze verwerkt, en bij bepaalde Claude-taken kan daar een tweede rekening bijkomen.
Modellen en tarieven lopen niet gelijk
Together Link zelf is gratis en heeft een MIT-licentie. Het gebruik van de modellen wordt wel per token afgerekend via een Together API-sleutel. De huidige documentatie noemt Kimi K3 voor $2,70 invoer en $13,50 uitvoer, GLM 5.3 voor $1,40 en $4,40, DeepSeek V4.1 Flash voor $0,30 en $1,20, en Qwen 3.8 voor $2 en $6 per miljoen tokens. De tarieven gelden per miljoen invoer- en uitvoertokens; gecachte invoer heeft voor sommige modellen een lager tarief.
Bij een vereenvoudigde maandproef met 10 miljoen invoertokens en 1 miljoen uitvoertokens kost GLM 5.3 volgens die tarieven $18 en DeepSeek V4.1 Flash $4,20, vóór caching. Dat is een modelrekening voor een vast tokenvolume, geen prijs per afgeronde programmeertaak: een agent kan context opnieuw meesturen en een taak kan meerdere modelaanroepen vragen.
De openbare productpagina en de actuele documentatietabel wijken af. De getoonde Kimi K3-tarieven zijn $3 per miljoen invoer en $15 per miljoen uitvoer, met MiniMax M3 in de modelkeuze en een beloofde besparing van meer dan 50 procent. De docs noemen Qwen 3.8 in plaats van MiniMax en zetten Kimi op $2,70 en $13,50. Het aanbod kan in de bèta veranderen; Together verwijst daarom naar togetherlink models voor de actuele lijst.

De agent blijft, de route verandert
De bèta ondersteunt Claude Code, Claude Desktop en Cowork, Codex, ChatGPT Desktop, OpenCode 2 en Pi Code vanaf versie 0.80.8. De installatie vraagt macOS of Linux, Bash, curl, een bestaande agent en een Together API-sleutel. Pi Code vereist Node.js 22.19 of nieuwer. Together Link installeert de agent zelf niet.
Terminaltools krijgen alleen een tijdelijke sessieconfiguratie; hun normale instellingen en geschiedenis blijven staan. ChatGPT Desktop en Claude Desktop gebruiken elk een eigen profiel. De desktops zijn volgens de documentatie nog in bèta.
Auto is de standaard: een cloudgateway beoordeelt elk verzoek en kiest een model. In Claude Code en Claude Desktop kan een optionele Anthropic API-sleutel moeilijke vragen naar Claude Opus sturen; die komen op de Anthropic-rekening. Zonder die sleutel verwerkt Together alle verzoeken zelf. Codex, OpenCode, Pi Code en ChatGPT Desktop blijven altijd op Together-modellen. Een Claude-proef kan dus twee modelrekeningen opleveren.
Z.ai bracht een eigen codeeromgeving op GLM-5.2 uit en bood nieuwe gebruikers 5 miljoen gratis tokens. Together Link houdt de bestaande editor en verandert alleen de modelroute. AT&T meldde bij een bredere inzet tot 56 procent lagere kosten voor codeer- en andere AI-taken, met 2 procent kwaliteitsverlies. Dat resultaat is niet rechtstreeks vergelijkbaar met Together’s productclaim.
De besparing is nog geen kwaliteitsmeting
Together noemt een besparing van meer dan 50 procent; de documentatie zegt 50 tot 80 procent vergeleken met sessies die volledig op Opus 5.5 draaien. De publicatie toont geen vaste programmeertaken of onafhankelijke kwaliteitsmeting bij dat cijfer. Een lagere tokenprijs zegt daarom nog niet hoeveel herstelwerk een codewijziging vraagt.
De bon in de afbeelding is een Together-voorbeeld: 42 minuten Claude Code voor 31 dollarcent, verdeeld over Kimi K3 en GLM 5.3 Flash. Hij laat zien hoe sessiekosten in beeld komen, maar niet wat een vergelijkbare programmeertaak kost of welke kwaliteit en hoeveelheid herstelwerk erbij horen.
Een vergelijking houdt dezelfde opdrachten, repositories en acceptatiecriteria aan en zet de rekening af tegen tests, reviewcorrecties, herstelrondes en wachttijd. Bij Auto telt ook de Anthropic-factuur mee. Zo wordt zichtbaar wat een afgeronde taak werkelijk kost.
Open gewichten draaien niet lokaal
Together Link stuurt codeeragenten naar een gehoste gateway; er draait geen lokale proxy. Daaruit volgt dat meegestuurde prompts en codecontext de computer verlaten en bij de gekozen modelaanbieder worden verwerkt. Open gewichten zeggen iets over modelbeschikbaarheid en licentie, niet over de plek waar verzoeken worden uitgevoerd.
Volgens Together geldt dat prompts niet voor modeltraining worden gebruikt zonder expliciete toestemming en dat Zero Data Retention apart kan worden aangezet. Die instelling geldt pas vanaf het moment van activeren; het beleid staat ook verwerking en opslag buiten het land van de gebruiker toe. Zonder aparte schriftelijke afspraak hebben partijen geen geheimhoudingsplicht tegenover elkaar, volgens Together’s algemene voorwaarden. Bij broncode met klantgegevens of bedrijfsgeheimen horen de privacy-instellingen, contractafspraken en verwerkingslocatie bij dezelfde leverancierskeuze.
OpenWorker biedt in dezelfde agentcategorie een lokale route via Ollama zonder API-sleutel, met eigen beheer en passende hardware. Together Link brengt de modelkeuze naar vertrouwde codeertools, maar blijft een bèta met een veranderlijk aanbod en routergedrag. Voor een organisatie hangen taakprijs, resultaatkwaliteit en de route van code daardoor samen.
Veelgestelde vragen
Van modelkeuze naar werkende software
Ik denk mee over de juiste modellen voor je processen, ontwerp de koppelingen en bouw de agenten die het werk uitvoeren. Ik verzorg het hele traject, waar het kan self-hosted.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
