Informationen zu Cookies und lokalen Einstellungen

Cookies und lokale Einstellungen sind kleine Datenpakete, die es uns und Ihnen erleichtern eine optimal bedienbare Web-Seite anzubieten. Sie entscheiden, welche Cookies und lokale Einstellungen sie zulassen und welche sie ablehnen.

Der Anbieter der Anwendung ist Ihre jeweilige Volksbank und Raiffeisenbank.

Informationen zum Datenschutz entnehmen Sie bitte den Datenschutzhinweisen Ihrer jeweiligen Volks- und Raiffeisenbank.

Notwendige Cookies helfen dabei, Ihnen die Funktionen der Webseite zugängig zu machen, indem sie Grundfunktionen die zuletzt angesehen Wertpapiere und Ihre Entscheidung für oder gegen die Nutzung der jeweiligen Cookies speichert. Die Webseite wird ohne diese Cookies nicht so funktionieren, wie es geplant ist.

Name Anbieter Zweck Ablauf Typ Empfänger der Daten  
CookieConsent8926 Volksbank Hohenzollern-Balingen eG Um diese Cookiebar auszublenden. 1 Jahr Server-Cookie Infront Financial Technology GmbH
Die Cookie-Erklärung wurde das letzte Mal am 21.09.2026 von Infront Financial Technology GmbH aktualisiert.

Volksbank Hohenzollern-Balingen eG

Bitte mindestens 3 Zeichen eingeben.

Nachrichtenübersicht

GNW-News: KAYTUS erweitert MotusAI für agentenbasierte KI-Token-Fabriken vor Ort

21.09.2026 - 11:05:04
^SINGAPUR, Sept. 21, 2026 (GLOBE NEWSWIRE) -- KAYTUS, ein führender Anbieter von
KI-Infrastrukturlösungen, gab heute ein umfangreiches Upgrade seiner
Unternehmens-KI-Plattform MotusAI bekannt. Die neue Version ermöglicht es
Unternehmen, ?Token-Fabriken" vor Ort individuell zu entwickeln, zu verwalten
und zu skalieren, KI-Agenten in der Produktion einzusetzen und sensible Daten
innerhalb ihrer eigenen Infrastruktur zu behalten - und dies alles bei einer
Senkung der jährlichen Betriebskosten im Zusammenhang mit Token um 30 % bis 50
%.
Die Herausforderung: Skalierung von KI-Agenten unter Wahrung der Kontrolle
Da sich die KI in Unternehmen von einfachen LLM-Abfragen hin zu autonomen Multi-
Agenten-Systemen weiterentwickelt, werden Token zunehmend zur ?Rechenwährung",
die zentrale Geschäftsabläufe antreibt. Die unternehmensweite Einführung
agentenbasierter KI in großem Maßstab rückt drei entscheidende infrastrukturelle
Herausforderungen in den Fokus:
  * Sicherheits- und Compliance-Risiken: Durch die Übermittlung von proprietärem
    Quellcode, Kundendaten und zentraler Geschäftslogik über öffentliche Clouds
    und LLM-APIs können sensible Daten offengelegt und Risiken hinsichtlich der
    Einhaltung gesetzlicher Vorschriften entstehen.
  * Latenz und Servicezuverlässigkeit: Mehrstufige Schlussfolgerungsprozesse der
    Agenten und die Orchestrierung von Tools führen zu unvorhersehbaren
    Verkehrsspitzen. Ohne elastische Planung führen Engpässe bei den
    Rechenressourcen zu Verzögerungen bei der ?Time to First Token" (TTFT) und
    verursachen fehlgeschlagene Anfragen, wodurch Service-Level-Vereinbarungen
    und die Benutzererfahrung beeinträchtigt werden.
  * Unkontrollierte Token-Kosten: Eine unüberwachte Modellnutzung und fehlende
    Abteilungsquoten führen zu steigenden API-Kosten, wodurch Unternehmen keine
    klare Übersicht über die Ausgaben in den einzelnen Geschäftsbereichen haben.

MotusAI: Eine solide Grundlage für das durchgängige Token-Lebenszyklusmanagement
MotusAI begegnet diesen Herausforderungen mit einer sicheren, lokal
installierten Infrastruktur, die die Erstellung, Verteilung und den Betrieb von
Token vereint.
1. Datenhoheit in Unternehmen
MotusAI hält die Inferenzverarbeitung, die Modellgewichte und den Kontext
innerhalb des Sicherheitsperimeters des Unternehmens und macht es somit
überflüssig, auf die öffentliche Cloud zurückzugreifen. Unternehmen aus den
Bereichen Finanzdienstleistungen, Gesundheitswesen und öffentlicher Sektor
können den Einsatz von KI ausbauen und dabei die Kontrolle über sensible Daten
und Compliance-Richtlinien behalten.
2. Zuverlässige Servicequalität
MotusAI verwandelt lokale GPU-Cluster in eine ausfallsichere Engine zur Token-
Erzeugung, die selbst bei Spitzenauslastung eine Reaktionszeit von unter einer
Sekunde gewährleistet:
  * Hochgeschwindigkeits-Inferenz bei mehrstufigen Dialogen: Prefill-Decode
    (PD)-Disaggregation, dynamisches KV-Caching und dynamisches Batching
    reduzieren die TTFT und die End-to-End-Latenz und ermöglichen so
    blitzschnelle und reaktionsschnelle Interaktionen über mehrere
    Gesprächsrunden hinweg.
  * Ausfallsicherheit bei Spitzenauslastung: In Verbindung mit Inferenz-
    Laufzeitumgebungen wie vLLM und SGLang skaliert MotusAI die Rechenressourcen
    dynamisch auf der Grundlage von Echtzeit-Telemetriedaten zu TTFT, Token pro
    Sekunde (TPS) und GPU-Auslastungskennzahlen. Bei Produktionstests wurde die
    automatische Skalierung innerhalb von 21 Sekunden nach Erreichen des
    Spitzenverkehrsaufkommens aktiviert, wodurch die Kapazität innerhalb von
    zwei Minuten erfolgreich auf 16 Instanzen erweitert und die Einhaltung der
    SLA-Vorgaben automatisch wiederhergestellt wurde.
  * Selbstheilende Verfügbarkeit: Die Echtzeit-Clusterüberwachung löst bei
    Auftreten von Knotenanomalien automatisch ein Failover aus und gewährleistet
    so die Verfügbarkeit rund um die Uhr für geschäftskritische, agentenbasierte
    KI-Workflows.

3. Einheitliches API-Gateway für eine schnellere KI-Entwicklung
Das MotusAI-API-Gateway für den Unternehmensbereich optimiert die
Modellbereitstellung und den Zugriff für interne Entwicklungsteams:
  * Nahtloser Modellwechsel ohne Programmieraufwand: OpenAI-kompatible APIs
    ermöglichen es Entwicklern, Open-Source- und kommerzielle Modelle
    anzubinden, zu testen und zwischen ihnen zu wechseln, ohne den
    Anwendungscode neu schreiben zu müssen. Dadurch bleibt die Flexibilität
    gewahrt und eine Anbieterabhängigkeit wird vermieden.
  * Unterstützung für Kontexte mit einer Million Token: Die native Verarbeitung
    langer Kontexte ermöglicht komplexe Dokumentenanalysen, fortgeschrittene
    Schlussfolgerungen und die automatisierte Codegenerierung.

4. Präzise Unternehmensführung und geringere Kosten
MotusAI bietet durchgängige Transparenz im Betrieb, um die Verschwendung von
Rechenressourcen zu vermeiden.
  * Echtzeit-Einblicke in die Leistungsfähigkeit: Interaktive Dashboards
    ermöglichen die Überwachung von Latenz, Token-Durchsatz und Cache-Effizienz
    anhand von Echtzeit-Kennzahlen zu TTFT, TPS und Cache-Treffern und
    unterstützen Teams dabei, die Servicequalität zu bewerten und die
    Rechenauslastung zu optimieren.
  * Dynamische Ressourcenbündelung: Durch eine fein abgestufte GPU-
    Partitionierung und eine intelligente Planung über verschiedene Workloads
    hinweg wird die Hardware-Effizienz maximiert, wodurch die Auslastung in
    Benchmark-Tests von 68,9 % auf 95,7 % gesteigert wurde.
  * Isolierung bei Mehrmandantenumgebungen und Kostenverrechnung:
    Administratoren setzen Abteilungsquoten durch, steuern den Zugriff und legen
    interne Abrechnungssätze fest, um die Rechenschaftspflicht bei den Ausgaben
    zu stärken. Durch das Herausfiltern redundanter Anfragen können Unternehmen
    ihre jährlichen Betriebskosten für Token um 30 % bis 50 % senken.

Weltweit erfolgreich im Einsatz
MotusAI führt KI-Workloads in Unternehmens- und kommerziellen
Produktionsumgebungen auf den weltweiten Märkten aus:
  * Finanzdienstleistungen: Ein ausländisches Fintech-Unternehmen hat seine
    bestehende Plattform durch MotusAI auf acht GPU-Servern ersetzt und damit
    nutzungsabhängige Token-Dienste mit zentraler Steuerung für die interne
    Risikoanalyse und die Einhaltung von Sicherheitsvorschriften ermöglicht.
  * GPU-Cloud-Anbieter: Ein japanischer Cloud-Anbieter betreibt seine
    Kernplattform auf MotusAI und bietet mehr als 30 Unternehmenskunden
    gemeinsam genutzte GPU-Ressourcen sowie durchgängige Workflows für Training
    und Inferenz an.
  * NeoCloud-Betreiber: Ein südostasiatischer Anbieter entschied sich für die
    integrierte Hardware- und Softwarelösung von KAYTUS anstelle eines
    internationalen Mitbewerbers und nutzte dabei die in MotusAI integrierten
    Multi-Tenancy- und Abrechnungsfunktionen.

?Unternehmen benötigen nicht nur mehr GPUs - sie benötigen die Möglichkeit,
Token-Dienste zuverlässig zu verwalten, abzuwickeln und zu skalieren", sagte
Darren Cox, GM von KAYTUS Europe. ?MotusAI schließt die Lücke zwischen Hardware
und Token-Betrieb und ermöglicht es Unternehmen, KI-Agenten sicher in ihren
eigenen Rechenzentren zu betreiben."
Die Zukunft der Unternehmens-KI in großem Maßstab vorantreiben
Mit MotusAI ermöglicht KAYTUS eine sichere Produktion mit hohem Durchsatz vor
Ort und unterstützt Unternehmen dabei, sensible Daten zu schützen, unabhängig
von Cloud-APIs zu arbeiten und die GPU-Auslastung weiter zu steigern. Die
weiterentwickelte MotusAI-Plattform ermöglicht es Unternehmen weltweit,
agentenbasierte KI sicher und effizient einzusetzen und zu skalieren.
Über KAYTUS
KAYTUS zählt zu den führenden Anbietern von KI-Infrastrukturen und
Flüssigkeitskühlungslösungen. Das Unternehmen bietet ein breites Portfolio
innovativer, offener und energieeffizienter Produkte für cloudbasierte
Anwendungen, KI, Edge Computing sowie weitere zukunftsweisende
Anwendungsbereiche. Mit einem konsequent kundenorientierten Ansatz und einem
flexiblen Geschäftsmodell reagiert KAYTUS schnell und gezielt auf die
individuellen Anforderungen seiner Kunden. Erfahren Sie mehr unter KAYTUS.com
und folgen Sie uns auf LinkedIn
(https://www.linkedin.com/company/kaytus/posts/?feedView=all) und X
(https://x.com/KAYTUS_)
Medienkontakt: media@kaytus.com (mailto:media@kaytus.com)
°


Quelle: dpa-AFX
Seitenanfang