OpenAI hat ChatGPT Voice zu einem vollwertigen KI-Agenten ausgebaut: Der Sprachassistent greift nun auf externe Dienste wie E-Mail, Kalender und Slack zu und führt Aufgaben per Sprachbefehl aus. Angetrieben wird das Ganze von den neuen Modellen GPT-6 Astra, Sol und Luna – ein deutlicher Schritt weg vom reinen Chatbot hin zum eigenständig handelnden System.
ChatGPT Voice verbindet sich nun aktiv mit externen Diensten und handelt im Auftrag des Nutzers.
Was ist neu?
Bisher war ChatGPT Voice vor allem ein gesprächsfähiger Assistent – überzeugend in der Interaktion, aber ohne echten Zugriff auf produktive Systeme. Das ändert sich jetzt grundlegend. OpenAI integriert Plugin-ähnliche Konnektoren, über die der Assistent direkt in E-Mail-Postfächer, Kalendereinträge und Slack-Channels eingreifen kann. Nutzer können per Sprache Termine anlegen, E-Mails verfassen und versenden oder – laut Meldung – sogar einfache Websites erstellen lassen.
Der entscheidende Unterschied zur bisherigen Funktionsweise: Das System handelt, nicht nur antwortet. In der KI-Fachsprache nennt man das einen Agenten (englisch: AI Agent) – ein System, das nicht nur Informationen liefert, sondern eigenständig Schritte in externen Systemen ausführt, um ein Ziel zu erreichen.
Technisch basiert das auf den neuen Modellvarianten der GPT-6-Familie. Die Namen Astra, Sol und Luna deuten darauf hin, dass OpenAI verschiedene Modellprofile für unterschiedliche Aufgabentypen etabliert – ähnlich wie Microsoft es mit seinen Copilot-Varianten (Copilot for Microsoft 365, Copilot Studio, Copilot+ PC) bereits tut.
Was bedeutet das für Microsoft-Umgebungen und die Praxis?
In meinen Azure-Kursen ist das Thema KI-Agenten seit Monaten präsent – und die Frage, wie man den Zugriff solcher Systeme auf Unternehmensdaten sicher steuert, wird regelmäßig diskutiert. Genau hier liegt der neuralgische Punkt dieser Entwicklung.
Wer ChatGPT Voice mit Slack und E-Mail verbindet, erteilt einem externen System Schreibrechte auf produktive Kommunikationskanäle. Für Privatnutzer ist das eine Komfortfunktion. Für Unternehmen ist es ein Governance-Thema.
Praxistipp: In Microsoft-Umgebungen sollten Conditional Access (bedingter Zugriff in Microsoft Entra ID) und Microsoft Defender for Cloud Apps genutzt werden, um zu kontrollieren, welche Drittanbieter-Apps überhaupt Zugriff auf Microsoft 365-Daten erhalten. OpenAI-Dienste lassen sich dort als Cloud-App kategorisieren und entsprechend mit Richtlinien belegen.
Wer stattdessen auf Microsoft-eigene Agenten-Funktionen setzen möchte, findet mit Copilot Studio eine direkt in den M365-Tenant integrierte Alternative – mit klaren Berechtigungskonzepten auf Basis von Microsoft Entra und Power Platform-Konnektoren. Azure OpenAI Service ermöglicht zudem den Aufbau eigener Agenten, bei denen die Datenhoheit im eigenen Azure-Tenant verbleibt.
Merksatz: Je mächtiger ein KI-Agent wird, desto wichtiger wird das Berechtigungskonzept dahinter. Sprachsteuerung und Autonomie sind kein Ersatz für Identity Governance.
Fazit
ChatGPT Voice entwickelt sich vom Assistenten zum Agenten. Das ist technisch beeindruckend und sicherheitstechnisch ein Thema, das IT-Verantwortliche aktiv adressieren müssen, bevor Mitarbeitende solche Tools eigenständig einsetzen. Weiterführende Informationen finden Sie in der Originalmeldung bei The Decoder (DE)
