Als nächstesNächster Leitfaden
Zhipu GLM-Modelle
Unternehmen
Leitfaden für Unternehmen
OpenAI o1 und o3 sind Argumentationsmodelle, die zusätzliche Testzeitberechnungen nutzen, um mehrstufige Probleme in Mathematik, Naturwissenschaften und Codierung vor der Beantwortung durchzuarbeiten.
o1 wurde Ende 2024 veröffentlicht und war das erste Modell von OpenAI, das darauf trainiert wurde, zu „denken“, bevor es reagierte, indem es eine lange interne Gedankenkette erzeugte. Im Gegensatz zu GPT-4o, das sofort antwortet, verbringt o1 Sekunden bis Minuten mit Überlegungen, dem Erkunden von Ansätzen, dem Erkennen eigener Fehler und dem Zurückverfolgen. Dies wird durch groß angelegtes Reinforcement Learning ermöglicht, das richtiges Denken belohnt, nicht nur plausiblen Text. o3, das im Dezember 2024 in der Vorschau vorgestellt und im Jahr 2025 veröffentlicht wurde, hat dies noch weiter vorangetrieben: Es erreichte rund 87,5 % im ARC-AGI-Benchmark für abstraktes Denken und erreichte ein konkurrenzfähiges Programmierniveau, das mit den besten menschlichen Programmierern mithalten konnte. Der Kompromiss besteht in den Kosten und der Latenz, da mehr Rechenaufwand für das „Denken“ zur Inferenzzeit die Antworten direkt verbessert.
Anbieter-Roadmaps beeinflussen, welche Funktionen Ihr Team als Nächstes entwickeln kann.
Kommerzielle Bedingungen und Bereitstellungsoptionen wirken sich auf die langfristigen Kosten und Risiken aus.
Unternehmensanreize prägen Produktstandards, Sicherheitslage und Offenheit.
Argumentationsmodelle verändern das Feld: Konkurrenten wie DeepSeek-R1, die Denkmodi Gemini von Google und das erweiterte Denken von Anthropic verwenden alle ähnliche Test-Zeit-Rechen-Ansätze. Erwarten Sie „Aufwand“-Regler, mit denen Benutzer Geschwindigkeit gegen Tiefe tauschen können, Agentensysteme, die über viele Schritte der Werkzeugnutzung hinweg argumentieren, und in multimodale und wissenschaftliche Tools integrierte Argumentation. Die Grenze besteht darin, dies billiger, schneller und zuverlässiger zu machen und gleichzeitig lange Gedankenketten ehrlich und frei von subtilen Fehlern zu halten.
Lösen von mathematischen Problemen auf Wettbewerbsebene (AIME, IMO-Stil) durch das Durcharbeiten mehrstufiger Beweise
Debuggen und Schreiben von komplexem Code, Leistung auf höchstem menschlichen Niveau bei wettbewerbsorientierten Programmierwettbewerben
Unterstützung von Forschern bei der Lösung physikalischer, chemischer und biologischer Fragen auf Graduiertenebene
Unterstützt Agenten-Workflows, die über viele Schritte hinweg planen, Tools aufrufen, Ergebnisse überprüfen und sich selbst korrigieren
Markteinführungsankündigungen können die Stabilität realer Produktionsabläufe übertreffen.
API-Preise oder Richtlinienänderungen können Annahmen über Nacht zunichte machen.
Die Abhängigkeit von einem einzigen Anbieter erhöht die Bindungs- und Migrationskosten.
Bewerten Sie Anbieter anhand Ihrer eigenen Aufgaben und Datensätze.
Lesen Sie vor der Integration Datenschutz, Sicherheit und rechtliche Bestimmungen.
Pflegen Sie einen Fallback-Plan für alle Modelle oder Anbieter.
Überwachen Sie die Versionshinweise, damit Roadmap-Änderungen die Teams nicht überraschen.
Free newsletter
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
OpenAI o1 und o3 sind Argumentationsmodelle, die zusätzliche Testzeitberechnungen nutzen, um mehrstufige Probleme in Mathematik, Naturwissenschaften und Codierung vor der Beantwortung durchzuarbeiten.
o1 und o3 erzeugen eine lange interne Gedankenkette, bevor sie eine endgültige Antwort geben, anstatt sofort zu antworten.
o1 wurde mit Reinforcement Learning trainiert, das produktive Argumentationsschritte belohnt, nicht nur plausibel klingenden Text.
Die wichtigste Erkenntnis besteht darin, dass die Leistung bei schwierigen Problemen gesteigert wird, wenn man das Modell bei der Antwortzeit länger „denken“ lässt und es nicht nur während des Trainings vergrößert.
Die hohe Punktzahl von o3 beim ARC-AGI-Benchmark zum abstrakten Denken war ein Schlagzeilenergebnis, das seine Fähigkeit zum logischen Denken unter Beweis stellte.
OpenAI zeigt nur eine Zusammenfassung der Gedankenkette, teilweise um die Methode zu schützen und zu verhindern, dass Konkurrenten sie kopieren.
Lerne weiter
Weitere Leitfäden zu diesem Thema ausgewählt
Als nächstesNächster Leitfaden
Zhipu GLM-Modelle
Unternehmen