Jeder Modellaufruf klar und kontrollierbar — neun Upstream-Typen hinter einem einzigen sk-Key, mit Kontingent, Logs und Abrechnung im eigenen Haus.
Kurz gesagt
Ygg Lab Token ist das selbst entwickelte, OpenAI-kompatible API-Kontingent-Gateway von YGG. Es bündelt neun Upstream-Anbietertypen hinter einem sk-Key und einem /v1/chat/completions-Endpunkt. Administratoren vergeben Keys pro Person mit Ausgabenlimit und Ablaufdatum; Tokens und Kosten jedes einzelnen Aufrufs werden protokolliert — Schluss mit separaten Guthaben je Anbieter und unklarer Kostenzuordnung.
Was der Agent den Menschen abnimmt
POST https://token.ygg.com.cn/v1/chat/completions mit Authorization: Bearer sk-… — beim vorhandenen OpenAI-SDK genügt eine neue base_url. Neun Upstream-Typen: OpenAI, OpenAI-kompatibel, Anthropic, Azure, Gemini, DeepSeek, Volcengine, Tongyi Qianwen, AWS.
9 Upstream-Typen · 1 Endpunkt
Mitglieder legen eigene Keys an und benennen sie (z. B. „Paper-Experiment"), jeder mit eigenem Limit und Ablaufdatum, jederzeit aktivierbar oder sperrbar. Vier sichtbare Zustände — aktiv, abgelaufen, aufgebraucht, deaktiviert — ein außer Kontrolle geratenes Experiment verbraucht nur das Kontingent dieses einen Keys.
Jeder Aufruf protokolliert Input-Tokens, Output-Tokens, Kosten, Modell und Zeitstempel. Das Dashboard verdichtet das zu heutigen Requests, heutigen Ausgaben, kumuliertem Verbrauch, Restguthaben, Verbrauchstrend, Modellverteilung, letzten Aufrufen und aktiven Keys — Monatsabschluss ohne Rätselraten.
Die Benutzerverwaltung verteilt Kontingente, bildet Gruppen, schaltet die offene Registrierung um und setzt das Startguthaben neuer Konten. Gruppenrabatte wirken als Faktor (1 = Listenpreis, 0,8 = 20 % Nachlass) — dieselben Upstream-Kanäle bedienen Betreuende, Studierende und Partner gleichzeitig, jeweils separat abgerechnet.
Ein Kanal nimmt mehrere eingefügte Keys auf, dazu Priorität, eigenen oder Proxy-Endpunkt, automatische Modellliste je Key und Konnektivitätstest per Klick. Erhöht ein Anbieter Preise oder drosselt, ändert man nur die Kanalpriorität — sk-Keys und Anwendungscode bleiben unberührt.
Modellpreise werden in $/1 Mio. Tokens gepflegt, Input und Output getrennt — deckungsgleich mit den Upstream-Tarifen. Das Wallet unterstützt Paket-Aufladungen, Einlösecodes und Rechnungshistorie, angebunden an WeChat Pay Native (Public-Key-Verifikation) und Alipay Face-to-Face RSA2. Nachgelagerte Systeme rufen POST /api/system/register mit einem Integrationsschlüssel auf, um per externer Nutzer-ID automatisch ein Konto anzulegen und einen abrechenbaren sk-Token auszustellen.
Im Vergleich
| Dimension | Eigenes Ygg Lab Token | Jede Anbieter-Konsole separat | Öffentlicher API-Reseller |
|---|---|---|---|
| Kostenkonsolidierung | Ein Wallet, aufgeschlüsselt nach Person, Key und Modell | N getrennte Rechnungen und Aufladungen, manuell zusammengeführt | Eine Rechnung, aber Tarife und Rabatte bestimmt der Reseller |
| Kontingentsteuerung | Limit und Ablauf je Key, harter Stopp bei Erschöpfung | Meist nur kontoweit — ein außer Kontrolle geratener Job leert das Team-Guthaben | Unterkonten vorhanden, Granularität aber vom Reseller vorgegeben |
| Aufruf-Nachweis | Jeder Aufruf mit Input-/Output-Tokens, Modell, Kosten, Zeit | Logformate und Aufbewahrung je Anbieter verschieden, schwer vergleichbar | Logs vorhanden, liegen aber beim Reseller; Export eingeschränkt |
| Upstream-Wechsel | Nur Kanalpriorität ändern; sk-Keys und Code bleiben | base_url und Keys je Projekt ändern, Regressionsaufwand | Hängt davon ab, ob der Reseller das Modell führt |
| Datenhoheit | Gateway und Logs auf eigenen Servern, vollständig self-hosted | Requests gehen direkt an Anbieter, Logs bleiben dort | Requests und Logs laufen über einen Dritten |
Vorher / nachher im Vergleich
Fächer und Funktionsmatrix
Dashboard
Ausgaben · Trend · Modellmix
API-Keys
Limits · Ablauf
Aufruf-Log
Tokens und Kosten je Aufruf
Wallet
Pakete · Codes · Rechnungen
Kanalverwaltung
Multi-Key · Priorität · Health
Benutzer
Kontingente · Gruppen
Modellpreise
$/1 Mio. Tokens · getrennt
Gruppenrabatte
Faktor · 1 = Listenpreis
Zusammenspiel von Agent und menschlicher Aufsicht
source
Lab-Mitglied / Fachanwendung
agent
Token-Gateway (sk-Auth · Metering)
human
Admin (Kanäle / Preise / Kontingente)
output
Neun Upstream-Typen
output
Aufruf-Log / Abrechnung
Flow
Nachprüfbare Fakten
Neun Upstream-Kanaltypen werden unterstützt: OpenAI, OpenAI-kompatibel, Anthropic, Azure, Gemini, DeepSeek, Volcengine, Tongyi Qianwen und AWS.
Nach außen genau ein OpenAI-kompatibler Endpunkt: POST /v1/chat/completions, Auth via Authorization: Bearer sk-….
Modellpreise werden in $ je 1 Mio. Tokens geführt, Input und Output getrennt bepreist.
Gruppenrabatte wirken als Faktor: 1 = Listenpreis, 0,8 = 20 % Nachlass.
Standard-Schwellenwerte: Guthaben unter 10 $ löst eine Erinnerung aus; SMS-Codes maximal einmal pro 60 Sekunden und fünfmal pro 24 Stunden; Passwörter mindestens 8 Zeichen.
Aufladungen laufen über WeChat Pay Native QR (Public-Key-Verifikation) und Alipay Face-to-Face (RSA2-Signatur); SMS über Tencent Cloud SMS.
Lieferumfang und Preis
Enthalten
Kundenseitig gestellt
Zusatzleistungen

Vollständiges Konzept per QR-Code anfordern
QR-Code mit WeChat scannen, um die zuständige Ansprechperson zu erreichen und die vollständige Dokumentation samt Deployment-Checkliste anzufordern.
Einsatzgrenzen
Weiterführend
DataWeaver
Fünf spezialisierte Agenten verkürzen natürlichsprachliche Abfragen über mehrere Datenbanken von 2–3 Tagen auf 10 Sekunden.
YggLab — KI-Agenten-Desktop
Ein Desktop, auf dem über 20 CLI-Agenten wirklich zusammenarbeiten — einzeln beauftragen, im Team arbeiten lassen oder vom Handy aus steuern, während die Arbeit rund um die Uhr weiterläuft.