Labor
Organisation, die das Modell entwickelt oder veröffentlicht und dessen technische und Sicherheitsdokumentation pflegt.
Entdecke die dokumentierten Modelle, veröffentlichten Bewertungen und Primärquellen dieser Organisation.
Generalistisches Grenzmodell, das auf komplexe Aufgaben, den Einsatz von Werkzeugen und hochanspruchsvolle berufliche Arbeit ausgerichtet ist.
16 SEP 2026↗ GENERALISTISCHE GRENZEKomplexe Aufgaben, Code und Agenten mit Werkzeugen.
16 SEP 2026↗ AUSGEWOGENES KOSTEN-LEISTUNGS-VERHÄLTNISAufgaben mit ausgewogenem Verhältnis von Qualität, Geschwindigkeit und Kosten.
16 SEP 2026↗ HOHE EFFIZIENZHohes Volumen, Unteragenten und strukturierte Extraktion.
16 SEP 2026↗ FRÜHERE FRONTIER-GENERATIONFrühere OpenAI-Generation für Code und professionelle Arbeit, beibehalten zum Vergleich von Migrationen und Kosten.
18 SEP 2026↗ NICHT SCHLUSSFOLGERND · LANGER KONTEXTNicht schlussfolgerndes Modell mit langem Kontext, nützlich als historische Referenz für Code, Instruktionsbefolgung und vorhersehbare Latenz.
18 SEP 2026↗ OFFENES REASONINGReasoning-Modell mit offenen Gewichten für lokale oder private Ausführung; laut OpenAI passt es auf eine H100-GPU.
18 SEP 2026↗ VISUELLE GENERIERUNG UND BEARBEITUNGOpenAIs Hauptmodell zum Generieren und Bearbeiten von Bildern mit komplexen Anweisungen und hochwertiger visueller Produktion.
18 SEP 2026↗ VIDEO MIT SYNCHRONISIERTEM AUDIOHistorisches Videomodell mit synchronisiertem Audio, nützlich zum Vergleich der Entwicklung der Sora-Familie.
18 SEP 2026↗ SPRACHUNTERHALTUNG IN ECHTZEITEchtzeit-Sprachmodell für ausdrucksstarke Gespräche, natürliche Unterbrechungen und Workflows mit Tools.
18 SEP 2026↗ SPRACHERKENNUNGSpezialisiertes hochpräzises Transkriptionsmodell für Dateien und Echtzeit-Audioeingaben.
18 SEP 2026↗ TEXTVEKTORREPRÄSENTATIONLeistungsstärkstes Embedding-Modell von OpenAI für semantische Suche, Klassifizierung, Clustering und RAG.
18 SEP 2026↗ PROGRAMMIERUNG, COMPUTERNUTZUNG UND PROFESSIONELLE AUFGABENOpenAI-Modell für komplexe Programmierung, Computernutzung und professionelle Aufgaben mit Text- und Bildeingaben. Der Anbieter beschreibt eine Leistung nahe Astra bei geringeren Kosten; prüfen Sie dieses Verhältnis anhand Ihrer eigenen Aufgaben.
30 SEP 2026↗Die Zahlen werden mit dem von der Quelle angegebenen Kontext dargestellt. Ein Anbieterergebnis ist kein unabhängiger Vergleich und ersetzt keine eigene Bewertung.
Eine Organisation, ein Produkt und ein Modell sind nicht dieselbe Einheit. Inferama trennt sie, um Fähigkeiten oder kommerzielle Bedingungen nicht dem falschen Element zuzuschreiben.
Organisation, die das Modell entwickelt oder veröffentlicht und dessen technische und Sicherheitsdokumentation pflegt.
Identifizierbare Version mit Limits, Modalitäten und Verhalten, die sich zwischen Veröffentlichungen ändern können.
API, Anwendung, angebundene Cloud oder kommerzieller Tarif; jeder Kanal kann unterschiedliche Preise, Aufbewahrungsfristen und Limits haben.
Zu jeder Aussage müssen die konsultierte offizielle Seite und das Prüfdatum festgehalten werden.
Eine Arena-Bewertung beschreibt das Ergebnis eines Vergleichs unter einem bestimmten Protokoll. Sie beweist für sich genommen nicht, dass ein Modell Anweisungen besser befolgt, zeitliche Kontinuität wahrt oder Audio und Video synchronisiert. Dieser Leitfaden trennt, was sich über Sora 2 Pro sagen lässt, von dem, was die verfügbaren Benchmarks nicht belegen.
26 Sep 2026 ↗ ANALISISLeitfaden zur Bewertung von GPT‑Live‑1 in Full‑Duplex-Sprachgesprächen, der Turn-Dynamik, Verständnis, Aufgabenerfolg und die Sicherheit delegierter Aktionen voneinander trennt. Vorgestellt wird ein reproduzierbares Protokoll mit kontrolliertem Audio, Traces, zeitlicher Annotation und verblindeter menschlicher Prüfung.
23 Sep 2026 ↗ ANALISISEine brauchbare Bewertung automatischer Transkription lässt sich nicht auf einen einzigen Genauigkeitswert reduzieren. Dieser Leitfaden beschreibt ein Protokoll, das Texttreue, kritische Entitäten, Sprecherzuordnung, Zeitmarken, Segmentierung und die Gültigkeit der Ausgabe für die konsumierende Anwendung getrennt misst. Ziel ist, Versionen und Konfigurationen reproduzierbar zu vergleichen und auf Grundlage von Evidenz zu entscheiden, wann ein Deployment freigegeben, eingeschränkt oder blockiert werden sollte.
23 Sep 2026 ↗ GUIAEine generative Bearbeitung ist nicht schon deshalb für den Produktionseinsatz geeignet, weil die verlangte Änderung korrekt aussieht. Dieser Leitfaden behandelt jede Retusche als Vertrag zur Erhaltung: Er legt fest, was sich ändern darf, was erhalten bleiben muss, wie dies gemessen wird und wann eine menschliche Prüfung erforderlich ist.
23 Sep 2026 ↗ NOTICIAGPT-Transcribe ist als Transkriptionsmodell verfügbar, das über die OpenAI-API genutzt werden kann. Bevor ein bestehendes ASR-System ersetzt wird, sollte nicht nur der resultierende Text geprüft werden, sondern auch der technische Vertrag, auf dem Suche, Zusammenfassungen, Warnungen, Zitate, Prüfungen und Compliance-Aufzeichnungen beruhen.
22 Sep 2026 ↗ ANALISISBenchCAD 1.0 misst, ob ein System CadQuery-Programme erzeugen, ändern oder interpretieren kann, deren Geometrie ausführbar ist und mit einer Referenz verglichen werden kann. Das ist ein nützliches Signal für parametrische Rekonstruktion, ersetzt aber keine Validierung von Toleranzen, Funktion, Fertigung oder Integration in einen Engineering-Workflow.
22 Sep 2026 ↗