Together AI hat Together Link veröffentlicht, eine kostenlose, MIT-lizenzierte CLI, die derzeit in Beta-Phase ist. Sie verbindet die von Entwicklern bereits verwendeten Code-Agenten mit den auf Together AI gehosteten Modellen. Unterstützte Tools sind Claude Code, Claude Desktop, Codex, ChatGPT Desktop, OpenCode und Pi. Die Idee ist einfach: das Framework behalten, das Modell tauschen und die Kosten senken.
Ist es heute verfügbar? Ja. Es wird mit einer einzigen Befehl auf macOS oder Linux installiert und erfordert nur eine Together-API-Schlüssel. Es ist in Beta, daher können die Befehle, das Routing und die Modellliste sich ändern.
Das Problem, das es angreift
Die Coding-Agenten senden oft jede Aufgabe an das gleiche Premium-Modell – von einer einzeiligen Lösung bis hin zu einer vollständigen Umstellung. In ihrem Startartikel sagt das Together-Team, dass Engineering-Organisationen monatlich Zehntausende bis Millionen von Dollar für geschlossene Modelle ausgeben. Ihr Argument ist, dass offene Modelle einen großen Teil des Unterschieds überbrücken. Kimi K3 und GLM 5.3 richten sich an harte Kodierarbeit. GLM 5.3 Flash und DeepSeek V4.1 Flash decken alltägliche Aufgaben ab.
Wie „Together Link“ funktioniert
Die Installation erfordert einen einzigen Befehl:
Code kopierencurl -fsSL https://link.together.ai/install | bash
Der Installator fügt bei Bedarf Bun hinzu und platziert die Befehle in ~/.local/bin. Führen Sie togetherlink aus, um einen Launcher zu öffnen, oder starten Sie ein Tool direkt mit togetherlink claude, togetherlink codex, togetherlink opencode oder togetherlink pi. Kurze Schalter wie tclaude funktionieren ebenfalls.
Laut den offiziellen Dokumenten läuft kein lokaler Proxy oder Daemon. Jedes Tool kommuniziert direkt mit der von Together bereitgestellten Gateway. Die Terminal-Agenten erhalten eine vorübergehende Konfiguration pro Ausführung, die beim Beenden der Sitzung entfernt wird. Claude Desktop und ChatGPT Desktop verwenden separate, umkehrbare Profile. Befehle wie togetherlink chatgpt off führen zur Rückkehr.
The Auto Router
Die Sitzungen verwenden standardmäßig ein virtuelles auto-Modell. Laut der Launch-Posting liest der Router die erste Aufgabe jeder Sitzung. Schnelle Lösungen werden in schnellen, kostengünstigen Modellen angewandt, während schwierige Probleme eine fortgeschrittene Leistung erfordern. Mit einer Anthropic-API-Kennung wird der Wechsel zwischen Opus 5.5 und GLM 5.3 durchgeführt. Ohne diese API-Kennung erfolgt der Wechsel zwischen GLM 5.3 und GLM 5.3 Flash. Der Routing erfolgt einmal pro Sitzung, sodass die Prompt-Caching funktioniert.
Der Opus-Pfad gilt nur für Claude Code und Claude Desktop und wird auf Ihr Anthropic-Konto abgerechnet. Codex, OpenCode, Pi und ChatGPT Desktop bleiben immer auf den Together-Modellen. Um ein Modell festzulegen, platzieren Sie das Flaggenzeichen vor dem Toolnamen: togetherlink --main zai-org/GLM-5.3 claude.
Im Claude Code befindet sich im Menü /model, wo die Tiers zu den offenen Modellen verknüpft werden. Opus läuft Kimi K3, Fable läuft GLM 5.3, Sonnet läuft GLM 5.3 Flash, und Haiku läuft DeepSeek V4.1 Flash.
Modelle, Preise und Rechnungen
Die Dokumentation listet Kimi K3, GLM 5.3, GLM 5.3 Flash und DeepSeek V4.1 Flash auf, wobei jeder mit 1 Mio. Kontexten ausgestattet ist. Die Produktseite listet Kimi K3 für 3,00 US-Dollar ein und 15,00 US-Dollar aus sowie GLM 5.3 für 1,40 US-Dollar ein und 4,40 US-Dollar aus. DeepSeek V4.1 Flash und MiniMax M3 werden für 0,30 US-Dollar ein und 1,20 US-Dollar aus angegeben. Die aktuellen Preise sind auf Togethers Preisseite zu finden.
Die Abrechnung erfolgt mit Ihrer bestehenden Together-Karte, entweder nach „Pay-as-you-go“-Methode oder über Kreditpakete. Bei jedem Session wird beim Verlassen des Systems die Gesamtsumme in Token und Dollar angezeigt. In Claude Code zeigt die Statuszeile die geschätzten Ausgaben neben der entsprechenden Opus-Kosten an. Der Befehl togetherlink usage --last 7d zeigt die über den Gateway-Protokoll erfassten Ausgaben über verschiedene Sessions an.
Die gemeinsame Gruppe weist außerdem darauf hin, dass es einen der größten OpenRouter-Token-Anteile für DeepSeek V4.1 Flash (40,8%), GLM 5.3 Flash (28,2%) und Kimi K3 (23,1%) gibt, Stand 9/30/2026.
Gemeinsames Link gegenüber den nächsten Alternativen
| Feature | Gemeinsam Link | OpenRouter | Claude Code Router | Ollama Start |
|---|---|---|---|---|
| Einstellungen | Eine Curl-Installation, dann togetherlink claude | Shell-Profil-Umgebungsvariablen | Desktop-Anwendung oder npm CLI | ollama launch claude |
| Lokaler Proxy | Nein, hostierter Gateway | Nein, direkte Verbindung | Ja, lokale Gateway auf Port 3456 | Lokaler Server oder direkt zu Ollama Cloud |
| Agenten | Claude Code, Claude Desktop, Codex, ChatGPT Desktop, OpenCode 2, Pi | Leitfäden für Claude Code, Codex CLI, OpenCode, Cursor und mehr | 10 Agenten, einschließlich Claude Code, Codex, OpenCode und Pi | Claude Code, OpenCode, Claude und ChatGPT Desktop (macOS) |
| Automatisches Routing | Auto-Router, optional Opus 5.5 Escalation | openrouter/auto Modell | Regelbasierte Routing mit Fallback-Methoden | Nicht dokumentiert |
| Kostenverfolgung | Sitzungsnachweis plus 7-Tage-Nutzungsbericht | Aktivitätsdashboard plus Statusline-Skript | Tokenverwendung und Kostenschätzungen in den Logs | Nicht dokumentiert |
| Modelle | Curated Together Lineup | OpenRouter-Katalog | Jeder Anbieter, den Sie konfigurieren | Lokale und Ollama Cloud-Modelle |
| OS | macOS, Linux | Wo immer Claude Code läuft | macOS, Windows, Linux | Desktop-App Connect ist für macOS geeignet |
| Lizenz | MIT, kostenlos | Hosted-Dienst | MIT, kostenlos | Kostenlos lokal, Cloud benötigt API-Schlüssel |
Der Edge von Together Link ist eine ausgewählte, einkommando-gesteuerte Route mit integrierten Sparrechnungen. Der Claude Code Router bietet eine größere Kontrolle über den Anbieter, aber er nutzt einen lokalen Gateway, den Sie verwalten.
Interaktives Erklärventil
Wichtigste Erkenntnisse
- Eine Installationsanweisung verbindet 6 bestehende Agenten mit den offenen Modellen in Together AI.
- Der Standard-Autorouter wählt zwischen GLM 5.3, GLM 5.3 Flash und optional Opus 5.5.
- Gemeinsam ergeben sich mehr als 50% Einsparungen, und 50 bis 80% im Vergleich zu allen Opus 5.5-Sessions.
- Kein lokaler Proxy läuft, und die normalen Agent-Konfigurationsdateien bleiben unberührt.
- Kostenlos und MIT-lizenziert, aber auf macOS und Linux während der Beta-Phase beschränkt.
Schauen Sie sich die technischen Details und GitHub an. Der gesamte Dank gilt dem Forscher dieses Projekts. Folgen Sie uns auch gerne auf Twitter und vergessen Sie nicht, sich bei unserem 150k+ML SubReddit anzumelden und unseren Newsletter zu abonnieren. Warte! Sind Sie auf Telegram? Jetzt können Sie sich auch auf Telegram bei uns anmelden.
Möchten Sie mit uns zusammenarbeiten, um Ihre GitHub-Repo, Hugging Face-Seite, Produktveröffentlichung oder Webinar zu promoten? Kontaktieren Sie uns
Die Nachricht Meet Together Link: Eine kostenlose CLI, die offene Modelle wie Kimi K3 und GLM 5.3 innerhalb von Claude Code, Codex und OpenCode ausführt erschien zunächst auf MarkTechPost.