Zurück zur Übersicht
ProduktstartOpenAIAgents APICodex

OpenAI stellt die Agents API vor: Neuer verwalteter Dienst für Cloud-Agenten auf Basis des Codex-Harness

OpenAI hat über seinen offiziellen Unternehmensblog die Einführung der neuen Agents API angekündigt. Bei dem Angebot handelt es sich um einen vollständig verwalteten Dienst (Managed Service), der speziell dafür konzipiert wurde, Entwicklern das Erstellen und Bereitstellen von Cloud-Agenten zu ermöglichen. Das technische Fundament dieser Lösung bildet das sogenannte Codex-Harness, welches für die Orchestrierung, die Verwaltung langlebiger Sitzungen (long-running sessions) sowie die Einbindung und Ausführung von Werkzeugen (tool use) zuständig ist. Die Ankündigung stellt damit eine zentrale Schnittstelle für cloudbasierte Agentensysteme vor, beschränkt sich inhaltlich jedoch auf die Nennung dieser Kernfunktionen und Rahmenbedingungen, ohne bereits tiefere Spezifikationen, Preismodelle oder ergänzende Systemanforderungen im Detail offenzulegen.

OpenAI Blog

Die wichtigsten Punkte

  • Einführung der Agents API: OpenAI kündigt eine neue Schnittstelle an, mit der Cloud-Agenten entwickelt und in Betrieb genommen werden können.
  • Vollständig verwalteter Dienst: Die Lösung wird als Managed Service bereitgestellt, wodurch Infrastruktur- und Betriebsaufwände auf Seiten des Anbieters liegen.
  • Codex-Harness als Basis: Der Dienst basiert auf dem Codex-Harness als technologischem Kern zur Steuerung der Systeme.
  • Drei funktionale Säulen: Die Plattform umfasst explizit Orchestrierung, langlebige Sitzungen (long-running sessions) sowie Werkzeugnutzung (tool use).

Analyse

Bereitstellung und Architektur: Cloud-Agenten als Managed Service

Die von OpenAI veröffentlichte Ankündigung markiert mit der Einführung der Agents API einen gezielten Schritt zur Standardisierung von Agentenanwendungen. Der Kern des neuen Angebots liegt in der Bereitstellung eines verwalteten Dienstes (Managed Service). Dieser Ansatz zielt darauf ab, Entwicklerinnen und Entwicklern eine fertige Umgebung zur Verfügung zu stellen, über die autonome und halbautonome Cloud-Agenten („cloud agents“) gebaut („build“) und gestartet („launch“) werden können.

Durch die Definition als verwalteter Dienst übernimmt die Plattform grundlegende betriebliche Aufgaben. Anstatt eigene Backend-Infrastrukturen zur Verwaltung von KI-gestützten Agentenabläufen aufzusetzen, greifen Entwickler auf eine cloudbasierte Schnittstelle zu. Die Originalmeldung hebt dabei hervor, dass die Realisierung dieser Agenten nicht lokal oder rein clientseitig gedacht ist, sondern spezifisch in der Cloud betrieben wird. Dadurch wird der Lebenszyklus von Agenten in eine dedizierte API-Umgebung eingebettet.

Das Codex-Harness als Steuerungs- und Ausführungseinheit

Als treibende technische Komponente nennt die Originalmeldung das sogenannte Codex-Harness („powered by the Codex harness“). Dieses Framework dient als Unterbau für die gesamte Funktionalität der Agents API. Innerhalb dieser Architektur erfüllt das Codex-Harness laut Ankündigung drei explizit definierte Aufgabenbereiche:

  1. Orchestrierung (Orchestration): Das Harness sorgt für die strukturierte Koordinierung der Abläufe und Prozesse innerhalb des Agentenbetriebs. Es bildet damit das Bindeglied zwischen Modellen, Eingaben und Ausführungslogik.
  2. Langlebige Sitzungen (Long-running sessions): Ein zentraler Bestandteil der Schnittstelle ist die Fähigkeit, über ausgedehnte Zeiträume hinweg aktive Sitzungen aufrechtzuerhalten. Dies unterscheidet die Agents API von rein kurzlebigen, zustandslosen Standard-Anfragen und adressiert komplexe Arbeitsabläufe, die persistente Kontexte erfordern.
  3. Werkzeugnutzung (Tool use): Als dritter Kernbestandteil wird der gezielte Einsatz von Tools aufgeführt. Das Codex-Harness versetzt die Cloud-Agenten in die Lage, externe Werkzeuge und Funktionen direkt in ihre Prozessketten einzubinden.

Die Ankündigung beschränkt sich dabei präzise auf diese Nennung der Funktionalitäten, ohne weiterführende Programmierbeispiele, Codeausschnitte oder Einblicke in die interne Architektur des Codex-Harness zu liefern.

Bedeutung für die KI-Branche

Die Ankündigung einer dedizierten Agents API durch OpenAI besitzt für die Landschaft der Software- und KI-Entwicklung eine klare strategische Relevanz. Bisher mussten Entwicklerteams komplexe Mechanismen zur Orchestrierung, Zustandsverwaltung und Tool-Anbindung häufig über eigene Middleware-Lösungen oder separate Frameworks realisieren. Mit der Etablierung eines offiziellen Managed Service rückt die Ausführung komplexer Agentenlogiken direkt in den Leistungsumfang des Modellanbieters.

Besonders das Zusammenspiel aus langlebigen Sitzungen und der Steuerung durch das Codex-Harness verdeutlicht, dass Cloud-Agenten zunehmend als dauerhaft operierende Instanzen konzipiert werden. Die Bereitstellung als API signalisiert den Übergang von rein textgenerierenden Prompt-Response-Schnittstellen hin zu zustandsbehafteten, werkzeugnutzenden Ausführungsumgebungen in der Cloud. Gleichzeitig verdeutlicht die knappe Ankündigung, dass weitere organisatorische und technische Details – wie Preisstrukturen, globale Verfügbarkeiten oder Schnittstellenlimits – zu einem späteren Zeitpunkt spezifiziert werden müssen, da die Originalquelle hierzu keine weiteren Angaben macht.

Häufig gestellte Fragen

Was ist die Agents API von OpenAI?

Die Agents API ist ein offiziell von OpenAI angekündigter, verwalteter Dienst (Managed Service), der Entwicklern das Erstellen und Starten von Cloud-Agenten ermöglicht.

Welche Aufgaben übernimmt das Codex-Harness?

Das Codex-Harness bildet die technologische Grundlage des Dienstes und wird laut Ankündigung für die Orchestrierung, die Verwaltung langlebiger Sitzungen (long-running sessions) sowie die Nutzung von Werkzeugen (tool use) eingesetzt.

Welche konkreten Funktionen umfasst die Schnittstelle laut Originalmeldung?

Die Originalmeldung nennt explizit vier zentrale Aspekte: das Erstellen und Starten von Cloud-Agenten, die Bereitstellung als Managed Service, die Steuerung über das Codex-Harness sowie die Unterstützung von Orchestrierung, langlebigen Sitzungen und Tool-Nutzung.

Ähnliche Nachrichten

Googles neues Feature Guided Vision für Gemini Live liefert Echtzeit-Audiobeschreibungen über die Smartphone-Kamera
Produktstart

Googles neues Feature Guided Vision für Gemini Live liefert Echtzeit-Audiobeschreibungen über die Smartphone-Kamera

Google führt mit Guided Vision eine neue Funktion innerhalb von Gemini Live auf kompatiblen Android-Geräten ein. Die visuelle Assistenzfunktion nutzt Künstliche Intelligenz, um Nutzerinnen und Nutzern unmittelbare Audiobeschreibungen all dessen zu liefern, worauf sie ihre Smartphone-Kamera richten. Durch die Freigabe des Live-Kamerabildes kann die KI von Google bei vielfältigen Aufgaben im Alltag unterstützen. Dazu zählt das Erfassen und Vorlesen von schwer lesbarem Kleingedrucktem ebenso wie die detaillierte Beschreibung der unmittelbaren Umgebung. Darüber hinaus hilft Guided Vision dabei, bestimmte Objekte im Sichtfeld zu finden oder präzise zu identifizieren. Das Feature markiert einen weiteren Schritt bei der Zusammenführung von Echtzeit-Bildanalyse und auditiver Sprachausgabe direkt auf mobilen Endgeräten.

Sony bringt KI-Upscaling auf die reguläre PS5: Quick Spectral Super Resolution in Kooperation mit AMD vorgestellt
Produktstart

Sony bringt KI-Upscaling auf die reguläre PS5: Quick Spectral Super Resolution in Kooperation mit AMD vorgestellt

Sony führt eine neue Technologie zur Bildhochskalierung mittels künstlicher Intelligenz speziell für die reguläre PlayStation 5 ein. Die Neuentwicklung trägt den Namen Quick Spectral Super Resolution (QSSR) und wird in einem offiziellen Blogbeitrag als eine neuartige Leistungsstufe des KI-basierten Upscalings beschrieben. Hervorgegangen ist dieses Verfahren aus dem gemeinsamen Projekt Amethyst, einer Kooperation zwischen Sony und dem Halbleiterhersteller AMD. Während Sony das bereits existierende PlayStation Spectral Super Resolution (PSSR) als Referenztechnologie einordnet, soll QSSR nun maßgeschneiderte KI-Grafikfunktionen für die Basisversion der Konsole bereitstellen. Damit weitet das Unternehmen moderne KI-Technologien auf die Standard-Hardware aus, ohne dabei auf externe Komponenten zurückgreifen zu müssen. Die Ankündigung verdeutlicht die fortschreitende Integration dedizierter KI-Algorithmen in etablierte Konsolensysteme und zeigt, wie Partnerschaften wie Project Amethyst hardwarenahe Softwareoptimierungen für den Massenmarkt ermöglichen.

Google kündigt Gemini 4 Argon an: Neues KI-Frontier-Modell vorerst nur für vertrauenswürdige Cybersicherheitsexperten freigegeben
Produktstart

Google kündigt Gemini 4 Argon an: Neues KI-Frontier-Modell vorerst nur für vertrauenswürdige Cybersicherheitsexperten freigegeben

Google hat sein neuestes KI-Frontier-Modell namens Gemini 4 Argon offiziell vorgestellt. Wie Koray Kavukcuoglu, Senior Vice President von Google DeepMind und leitender KI-Architekt des Unternehmens, erklärte, bietet das neue Modell eine Spitzenleistung bei der Bewältigung komplexer Arbeitsabläufe. Zu den primären Einsatzbereichen zählen praktische Softwareentwicklung unter realen Bedingungen, anspruchsvolle betriebliche Wissensarbeit in Bereichen wie Recht und Finanzen sowie die Verteidigung im Rahmen der Cybersicherheit. Aufgrund der außergewöhnlich hohen Leistungsfähigkeit des KI-Systems wird der Zugang von Google derzeit jedoch stark reglementiert. Gemäß den Angaben steht Gemini 4 Argon im ersten Schritt ausschließlich ausgewählten, vertrauenswürdigen Akteuren der Cyberabwehr zur Verfügung. Das Technologieunternehmen setzt damit unmittelbar auf eine kontrollierte Freigabe für spezialisierte Verteidigungsexperten.