Zurück zur Übersicht
OpenAI hat drei neue Modelle für Echtzeit-Sprache, Übersetzung und Transkription in seine API aufgenommen. Der Ausbau richtet sich an Entwickler von Sprachassistenten, Voice-Interfaces und Live-Übersetzung.
OpenAI hat seine API um drei neue Audio-Modelle erweitert: GPT-Realtime-2, GPT-Realtime-Translate und GPT-Realtime-Whisper.
GPT-Realtime-2 ist für Echtzeit-Sprachanwendungen mit stärkerem Reasoning ausgelegt. GPT-Realtime-Translate dient der Live-Übersetzung, GPT-Realtime-Whisper der Streaming-Transkription. OpenAI positioniert das Update damit klar für Anwendungen, die Sprache in Echtzeit verstehen, übersetzen und beantworten müssen.
Weiterlesen
Microsoft will Unternehmen stärker an die eigene KI-Plattform binden und zugleich den Wechsel zwischen verschiedenen Modellanbietern erleichtern. Der Konzern setzt dabei auf eigene Modelle, Agenten, Sicherheitswerkzeuge und Chips.
Eine Analyse von mehr als 800.000 arbeitsbezogenen Nachrichten zeigt, dass Beschäftigte ChatGPT häufig für Aufgaben außerhalb ihres eigenen Berufsbilds nutzen. Die Untersuchung deutet auf eine Verschiebung zwischen spezialisierten und generalistischen Rollen hin, misst jedoch weder Produktivitäts- noch Beschäftigungseffekte.
Nach einem Sicherheitsvorfall bei einer OpenAI-Modellprüfung verlangt Clem Delangue mehr Transparenz und Rechenleistung für die Entwicklung von Abwehrsystemen. Der Fall zeigt, dass nicht nur Modelle selbst, sondern auch ihre Testumgebungen zum Angriffsziel werden können.
Die neue Funktion verknüpft ChatGPT mit persönlichen Gesundheitsdaten aus Apple Health und unterstützten medizinischen Datensätzen. Der Dienst soll medizinische Versorgung unterstützen, aber keine Diagnose oder Behandlung ersetzen.
Der Kommentarbereich wird geladen, sobald du ihn erreichst.