Bauen Sie mehr mit GPT-5.1-Codex-Max

Bauen Sie mehr mit GPT-5.1-Codex-Max


Bauen Sie mehr mit GPT-5.1-Codex-Max (via) Kurz nach der gestrigen Veröffentlichung von Gemini 3 Pro kommt ein neues Modell von OpenAI namens GPT-5.1-Codex-Max.

(Erinnern Sie sich, als GPT-5 eine neue Ära weniger verwirrender Modellnamen einläuten sollte? Das hielt nicht an!)

Es ist derzeit nur über den Codex CLI-Codierungsagenten verfügbar, wo es das neue Standardmodell ist:

Ab heute wird GPT-5.1-Codex-Max GPT-5.1-Codex als Standardmodell in Codex-Oberflächen ersetzen. Im Gegensatz zu GPT-5.1, einem Allzweckmodell, empfehlen wir die Verwendung von GPT-5.1-Codex-Max und der Codex-Modellfamilie nur für Agenten-Codierungsaufgaben in Codex- oder Codex-ähnlichen Umgebungen.

Es ist noch nicht über die API verfügbar, dürfte aber in Kürze verfügbar sein.

Der Zeitpunkt dieser Veröffentlichung ist interessant, da Gemini 3 Pro offenbar erst gestern fast alle Benchmarks bestanden hat. Es erinnert an die Zeit im Jahr 2024, als OpenAI regelmäßig große Ankündigungen machte, die zufällig mit den Veröffentlichungen von Gemini zusammenfielen.

Besonders hervorzuheben ist der von OpenAI selbst angegebene SWE-Bench Verified-Score: 76,5 % für das Denkniveau „hoch“ und 77,9 % für das neue „xhigh“. Dies war der einzige Benchmark, bei dem Gemini 3 Pro von Claude Sonnet 4.5 übertroffen wurde – Gemini 3 Pro erreichte 76,2 % und Sonnet 4.5 erreichte 77,2 %. OpenAI hat dort jetzt mit einem Vorsprung von 0,7 Prozentpunkten das Modell mit der höchsten Punktzahl!

Sie berichten auch über eine Punktzahl von 58,1 % auf Terminal Bench 2.0 und übertreffen damit Gemini 3 Pro mit 54,2 % (und Sonnet 4.5 mit 42,8 %).

Der faszinierendste Teil dieser Ankündigung betrifft den Ansatz des Modells bei Problemen mit langen Kontexten:

GPT‑5.1-Codex-Max ist für lang andauernde, detaillierte Arbeiten konzipiert. Es ist unser erstes Modell, das durch einen Prozess namens „ Verdichtungkohärentes Bearbeiten von Millionen von Token in einer einzigen Aufgabe. (…)

Durch die Komprimierung kann GPT-5.1-Codex-Max Aufgaben erledigen, die zuvor aufgrund von Kontextfensterbeschränkungen fehlgeschlagen wären, wie z. B. komplexe Refaktoren und Agentenschleifen mit langer Laufzeit, indem der Verlauf bereinigt wird und gleichzeitig der wichtigste Kontext über lange Zeiträume hinweg erhalten bleibt. In Codex-Anwendungen komprimiert GPT-5.1-Codex-Max seine Sitzung automatisch, wenn sie sich ihrem Kontextfensterlimit nähert, und gibt ihr so ​​ein neues Kontextfenster. Dieser Vorgang wird wiederholt, bis die Aufgabe abgeschlossen ist.

Auf Hacker News herrscht große Verwirrung darüber, was das eigentlich bedeutet. Claude Code führt bereits eine Version der Komprimierung durch und fasst frühere Runden automatisch zusammen, wenn der Kontext erschöpft ist. Bedeutet das nur, dass Codex-Max in diesem Prozess besser ist?

Ich habe mir ein paar Pelikane zeichnen lassen, indem ich direkt in das Codex-CLI-Tool „Generiere eine SVG-Datei eines Pelikans auf einem Fahrrad“ eingegeben habe. Hier ist das mittlere Denkniveau:

Eine Illustration im flachen Stil zeigt einen weißen Vogel mit rundem Körper und orangefarbenem Schnabel, der auf einem Fahrrad mit rotem Rahmen und dünnen schwarzen Rädern an einem Sandstrand entlang radelt, mit einem ruhigen blauen Meer und klarem Himmel im Hintergrund.

Und hier ist die Denkstufe „xhigh“:

Ein rundlicher weißer Vogel mit orangefarbenem Schnabel und kleinen schwarzen Augen kauert tief auf einem blauen Fahrrad mit übergroßen dunklen Rädern und rast mit Bewegungslinien vor einem sanften blauen Himmel vorwärts.

Ich habe xhigh auch bei der Eingabeaufforderung meines längeren Pelican-Tests ausprobiert, das kam so heraus:

Bauen Sie mehr mit GPT-5.1-Codex-Max

Außerdem heute: GPT-5.1 Pro wird heute für alle Pro-Benutzer eingeführt. Laut den ChatGPT-Versionshinweisen:

GPT-5.1 Pro wird heute für alle ChatGPT Pro-Benutzer eingeführt und ist in der Modellauswahl verfügbar. GPT-5 Pro bleibt 90 Tage lang als Legacy-Modell verfügbar, bevor es eingestellt wird.

Das ist ein ziemlich schneller Verfallszyklus für das GPT-5 Pro-Modell, das erst vor drei Monaten veröffentlicht wurde.



Source link

Postagens Similares

  • WP ਰਾਕੇਟ ਹੁਣ ਤੁਹਾਡੇ ਸਭ ਤੋਂ ਮਹੱਤਵਪੂਰਨ ਪੰਨਿਆਂ ਲਈ ਮੁਫ਼ਤ CDN ਦੀ ਪੇਸ਼ਕਸ਼ ਕਰਦਾ ਹੈ

    WP ਰਾਕੇਟ ਸੰਸਕਰਣ 3.22 ਸਿੱਧੇ ਪਲੱਗਇਨ ਦੇ ਅੰਦਰ ਇੱਕ ਬਿਲਟ-ਇਨ ਮੁਫਤ CDN ਜੋੜਦਾ ਹੈ, ਸਾਈਟ ਮਾਲਕਾਂ ਨੂੰ ਇੱਕ ਵੱਖਰੀ ਸੇਵਾ ਸਥਾਪਤ ਕੀਤੇ ਬਿਨਾਂ ਭੂਗੋਲਿਕ ਤੌਰ ‘ਤੇ ਵੰਡੇ ਸਰਵਰਾਂ ਤੋਂ ਸਮੱਗਰੀ ਦੀ ਸੇਵਾ ਕਰਨ ਦੀ ਆਗਿਆ ਦਿੰਦਾ ਹੈ। ਕੈਚ ਇਹ ਹੈ ਕਿ ਮੁਫਤ ਟੀਅਰ ਤਿੰਨ ਪੰਨਿਆਂ ਤੱਕ ਸੀਮਿਤ ਹੈ, ਜੋ ਕਿ ਇਸ ਨੂੰ ਸਮਰਪਿਤ ਸਾਈਟ ਵਾਈਡ…

  • 紋身藝術家稱媽媽錯誤地指控她未經同意為青少年穿刺;她的記錄顯示不匹配

    一位 TikTok 用戶分享了她在一位媽媽指控紋身師刺穿她 16 歲女兒軟骨後的客戶噩夢經歷。 TikToker 發現事實與所謂的謊言相差甚遠。 一位在 TikTok 上名為 @dawnjeanelle 的受歡迎紋身藝術家分享了她差點失去紋身師執照的故事。該影片於 6 月 9 日發布。 當這位女士正在工作時,她接到了一位憂心忡忡的媽媽的電話。據 TikToker 報道,這位媽媽正在透過電話「大喊大叫」。顯然,她對女兒在未經父母同意的情況下進行軟骨穿孔感到不安。 儘管TikToker很理解這位母親當時的情緒,但接到電話後她卻感到很困惑。 原因是她不僅不認識這名青少年的名字,而且也不記得在未經父母同意的情況下給一名青少年進行了軟骨穿孔。 根據 Body Candy 的說法,法律要求 14 歲至 18 歲之間的未成年人在進行任何此類穿孔之前必須獲得父母的同意。此外,在手術過程中,父母或法定監護人必須在場。 紋身藝術家仔細檢查記錄 這位 TikToker 為自己辯護,聲稱事實並非如此,但仍決定參考她工作地點的記錄。這位 TikToker 搜尋了她的 Vagaro 預約記錄,想查看該女子的女兒,但結果卻空手而歸。 沒有記錄顯示這名少女穿孔,尤其是在未經母親同意的情況下。女兒給了她母親兩個不同的日期,但沒有一個與任何記錄相符。 這位 TikToker 表示,“未經父母同意,我不會給 16 歲的孩子打耳洞。這是違法的,我真的可能會被吊銷駕照……” 在徹底檢查了她的記錄後,她向媽媽保證,她十幾歲的女兒在那家機構沒有穿孔的記錄。 此外,當青少年來穿孔時,他們父母的詳細資料通常會輸入電腦系統。那也不見了。 媽媽指控紋身師未經父母同意為未成年人穿刺後,網路評論了真相 事實證明,女兒實際上對她媽媽撒了謊,說她的穿孔是從哪裡來的。據 TikToker 報道,這是因為這名青少年不想惹麻煩。 TikToker 和 X 上的評論者對這一情況做出了回應。 The TikToker…

  • కొత్త హోమ్‌పేజీ – సామ్ సోఫెస్

    పోస్ట్ చేయబడింది జూన్ 20, 2013 గత రాత్రి నేను నా అప్‌డేట్ చేసాను బ్లాగు వెబ్సైట్. ఇప్పుడు నేను నా బ్లాగ్ కోసం రూన్‌ని ఉపయోగిస్తున్నాను, నా తాజా పోస్ట్‌ని లాగడానికి మరియు నేను పని చేస్తున్న కొన్ని అంశాలను చూపించడానికి soff.esని అప్‌డేట్ చేయాలనుకుంటున్నాను. రూన్‌లో డెవలపర్ విషయాల కోసం మేము పెద్ద ప్లాన్‌లను కలిగి ఉన్నాము, కానీ ప్రస్తుతానికి నేను నా తాజా పోస్ట్‌ను తీయడానికి కొద్దిగా రూబీ స్క్రిప్ట్‌ని ఉపయోగిస్తున్నాను. desc…

  • Dawn 洗碗皂和除草醋:最佳 DIY 除草剂

    如果杂草占据了您的车道裂缝、庭院边缘、碎石路、栅栏线或花园边界,您可能已经看到过流行的 DIY 食谱,使用 黎明洗洁精和醋除草。 这是听起来太简单的家庭疗法之一:拿醋,添加洗洁精,喷洒杂草,然后看着它们变干。 老实说,它是可行的——但有一些重要的限制。 醋会损坏杂草的叶部并使其变干,尤其是一年生幼草。洗碗皂可以帮助醋粘在叶子上,而不是立即滚落。但这种混合物并不神奇,通常也是如此 不是 杀死成熟杂草或坚韧多年生植物的深根。有些杂草可能在顶部看起来已经死了,然后从根部重新长出来。 而且,这种喷雾是非选择性的。这意味着它会损坏草、花、蔬菜、药草、灌木以及它接触到的任何植物。因此,它最适合人行道、砾石、摊铺机裂缝、车道接缝以及您不希望任何东西生长的地方。 关联公司披露: 这篇文章包含附属链接。如果您通过此页面上的链接购买,StylePersuit 可能会赚取少量佣金,而无需您支付额外费用。 黎明洗洁精和醋能杀死杂草吗? 是的,黎明洗洁精和醋可以杀死或烧掉许多小杂草,尤其是在温暖、阳光明媚、干燥的日子直接喷洒在叶子上时。 醋之所以起作用是因为醋酸。它从植物组织中吸收水分并导致叶子干燥。洗洁精充当表面活性剂,帮助醋扩散并粘附在蜡质叶子表面。 这款 DIY 除草剂最适合: 年轻的杂草 一年生小杂草 车道裂缝中杂草丛生 摊铺机之间的杂草 碎石路上的杂草 围墙边杂草丛生 人行道裂缝中杂草丛生 露台边缘周围有小杂草 它在以下方面效果较差: 主根深的蒲公英 旋花 百慕大草 马唐草丛 蓟 成熟的杂草 已扎根的杂草 从地下重新生长的多年生杂草 基于醋的除草剂通常对可见的顶部生长的损害比对根部的损害更大,因此较大或多年生杂草可能需要重复施用或物理清除。园艺界人士普遍指出,醋对幼小的杂草效果最好,但只能暂时烧掉成熟的杂草。 DIY黎明和醋除草剂配方 这是大多数人用于处理露台、摊铺机、砾石和车道裂缝的简单版本。 你需要: 1 加仑白醋,5% 酸度 1 汤匙 Dawn 洗洁精 花园喷雾器或喷雾瓶 漏斗 手套 可选:量匙 如何制作: 将醋倒入干净的花园喷雾器中。添加 1 汤匙…

  • மவுண்ட் ஸ்டுபிட் ஒரு விலை பக்கம் உள்ளது

    “AI அமைப்புகள் கணிக்க முடியாதவை மற்றும் கட்டுப்படுத்த கடினமாக உள்ளன என்பதற்கு கடந்த சில ஆண்டுகளாக சேகரிக்கப்பட்ட ஏராளமான சான்றுகள் இப்போது உள்ளன.” அது ஜனவரியில் டாரியோ அமோடி, தனது நிறுவனம் விற்கும் தொழில்நுட்பத்தைப் பற்றி எழுதுகிறார். இந்த வாரம் உங்கள் LinkedIn டைம்லைனில் உள்ளதை ஒப்பிடுக. ஸ்கிரிப்ட் இதோ: AI இன்ஜின்கள் உங்கள் உள்ளடக்கத்தை அலசுவதை ஸ்கீமா மார்க்அப் உறுதி செய்கிறது. ஒவ்வொரு பிரிவின் முதல் வாக்கியமும் விடையாக இருக்க வேண்டும். துண்-நிலை மீட்டெடுப்புக்கு உகந்ததாக்கு….

  • Bevorzugte Quellen erweitern, Gmail Brand Lift, Pichai On AI-Übersichten

    Willkommen beim Pulse der Woche. Jedes Update in dieser Woche beeinflusst, was in den KI-Antworten von Google erscheinen kann und warum. Google hat bevorzugte Quellen in die KI-Übersichten und den KI-Modus integriert, neue Daten untersuchen, wie sich personenbezogene Daten darauf auswirken, welche Marken im KI-Modus angezeigt werden, und der CEO von Google sprach über die…

Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *