2026-يىلىدىكى ئالدىنقى AI مودېللىرى — بىر جەدۋەلدە سېلىشتۇرما
2026: ئالدىنقى مودېللار قانداق ئورۇنلاشتى
2026-يىلىنىڭ 9-ئېيىدا ئىككى چوڭ ئېلان ئارقا-ئارقىدىن كەلدى: 9-ئاينىڭ 1-كۈنى Anthropic نىڭ Claude Fable 5.1 ۋە Mythos 5.1 ى، 9-ئاينىڭ 3-كۈنى OpenAI نىڭ GPT-6 Astra سى. بۇنىڭدىن ئىلگىرى 7-ئايدا GPT-5.6 ئائىلىسى (Sol، Terra، Luna)، 6-ئايدا Claude Fable 5 ۋە Mythos 5 چىققانىدى.
بۇ ماقالە ئۈچ سوئالغا جاۋاب بېرىدۇ: قايسى مودېل قايسى ئۆلچەمدە ئالدىدا، باھاسى قانچە، ۋە ئۆز خىزمىتىڭىزگە قايسىنى تاللاش.
كودلاش ۋە agent ئۆلچەملىرى
تۆۋەندىكى جەدۋەل ئىشلەپچىقارغۇچىلار ئېلان قىلغان رەسمىي سانلارغا ئاساسلانغان. سىزىقچە (—) بولغان كاتەكچىلەردە رەسمىي نەتىجە ئېلان قىلىنمىغان.
| ئۆلچەم | GPT-6 Astra | GPT-5.6 Sol | Fable 5.1 | Fable 5 | Opus 5 | Gemini 3.8 Flash |
| Terminal-Bench 4.0 | %57.9 | %37.3 | %55.8 | %42.0 | %52.3 | %19.1 |
| DeepSWE v1.1 | %74.1 | %72.7 | %67.4 | %69.9 | %73.7 | %73.8 |
| FrontierCode 1.1 Extended (نومۇر) | 64.5 | 60.6 | 63.6 | 64.9 | 63.6 | 56.3 |
| FrontierCode 1.1 Main (نومۇر) | 53.3 | 47.5 | 50.9 | 53.5 | 53.4 | 43.6 |
| ئىچكى سانداندىن كۆچۈرۈش ۋەزىپىلىرى | %63.9 | %42.7 | %57.8 | %50.3 | — | — |
| Artificial Analysis Coding Agent Index v1.4 | 67.0 | 65.1 | — | 67.2 | 68.1 | 61.2 |
جەدۋەلدىن كۆرۈنىدىغىنى: Terminal-Bench 4.0 دەك ئۇزۇن، كۆپ باسقۇچلۇق terminal ۋەزىپىسىدە GPT-6 Astra بىلەن Fable 5.1 بىر-بىرىگە يېقىن (%57.9 ۋە %55.8)، ئەمما DeepSWE دەك كلاسسىك patch يېزىش ۋەزىپىسىدە پەرق ئانچە چوڭ ئەمەس — ھەتتا Gemini 3.8 Flash مۇ %73.8 بىلەن ئالدىنقى قاتاردا.
ئىلىم، بىلىم خىزمىتى ۋە كومپيۇتېر ئىشلىتىش
Anthropic ئېلان قىلغان جەدۋەل باشقا تەرەپلەرنى — ئىلمىي تەتقىقات، بىلىم خىزمىتى، كومپيۇتېر ئىشلىتىش ۋە كۆپ ساھەلىك ئەقلىي ئىقتىدارنى ئۆز ئىچىگە ئالىدۇ.
| ئۆلچەم | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
| Terminal-Bench-Science 0.1 (ئىلمىي تەتقىقات agent) | %52.6 | %24.7 | %29.0 | %22.4 |
| Terminal-Bench 4.0 (agentic كودلاش) | %55.8 | %42.0 | %52.3 | %37.3 |
| GDPval-AA v2 (بىلىم خىزمىتى، Elo) | 1853 | 1723 | 1824 | 1711 |
| OSWorld 2.0 — partial | %77.9 | %72.9 | %75.4 | — |
| OSWorld 2.0 — strict | %41.7 | %36.1 | %39.6 | — |
| Humanity's Last Exam — قورالسىز | %60.9 | %57.8 | %56.6 | — |
| Humanity's Last Exam — قورال بىلەن | %65.0 | %63.8 | %63.6 | — |
| AutomationBench (سودا ئېقىمى) | %31.4 | %17.1 | %26.9 | %19.6 |
| CursorBench 3.2.0 | %73.4 | %70.5 | %70.0 | %67.2 |
OpenAI تەرەپتىن كومپيۇتېر ئىشلىتىش ئۆلچىمى ئوخشاش ئەمەس: GPT-6 Astra OSWorld V2-Offline دا %72.6 (GPT-5.6 Sol %65.7) ئالغان. ئىككى شىركەت ئوخشىمىغان نەشرى ۋە ئوخشىمىغان scaffold ئىشلەتكەچكە، بۇ ئىككى ساننى بىۋاسىتە تەڭ قويۇشقا بولمايدۇ.
باھا سېلىشتۇرمىسى
ھەممە باھا ھەر 1 مىليون token بويىچە، دوللار ھېسابىدا.
| مودېل | كىرگۈزۈش | چىقىرىش | Cache ئوقۇش |
| GPT-6 Astra | 10.00 | 50.00 | 1.00 |
| GPT-5.6 Sol | 5.00 | 30.00 | — |
| GPT-5.6 Terra | 2.00 | 12.00 | — |
| GPT-5.6 Luna | 0.20 | 1.20 | — |
| Claude Fable 5.1 | 10.00 | 50.00 | 0.25 |
| Claude Fable 5 | 10.00 | 50.00 | 1.00 |
Fable 5.1 نىڭ ئاساسىي باھاسى Fable 5 بىلەن ئوخشاش، ئەمما cache ئوقۇش باھاسى 1.00 دوللاردىن 0.25 دوللارغا چۈشكەن. شۇ سەۋەبتىن ئادەتتىكى خىزمەتتە تەخمىنەن %25، قاتتىق agentic خىزمەتتە %45 كە قەدەر ئەرزانغا چۈشىدۇ.
GPT-6 Astra دا 272K token دىن ئېشىپ كەتكەن ئىلتىماسنىڭ كىرگۈزۈش ۋە cache باھاسى 2 ھەسسە، چىقىرىش باھاسى 1.5 ھەسسە ھېسابلىنىدۇ؛ Fast tier ئۆلچەملىك باھانىڭ 2 ھەسسىسى. GPT-5.6 نىڭ ھەر ئۈچ دەرىجىسىدە چىقىرىش باھاسى كىرگۈزۈشنىڭ 6 ھەسسىسى.
Context كۆزنىكى ۋە چىقىرىش چېكى
| مودېل | Context | ئەڭ كۆپ چىقىرىش |
| GPT-6 Astra | 1,000,000 token (ئەڭ يۇقىرىسى 1,050,000) | 128,000 token |
| Claude Fable 5.1 | 1,000,000 token | 128,000 token |
ئىككىلىسى 1M token لۇق كۆزنەككە يەتتى. ئەمما كۆزنەكنى تولۇق تولدۇرۇش ئەرزان ئەمەس — GPT-6 Astra دا 1M token لۇق بىر چاقىرىش تەخمىنەن 10 دوللار. Cache نى توغرا ئىشلىتىش ئۇزۇن context بىلەن ئىشلەشنىڭ ئاچقۇچى.
قايسى ۋەزىپىگە قايسى مودېل
| ۋەزىپە | تەۋسىيە | سەۋەبى |
| كومپيۇتېر كۆرۈنمە يۈزىنى باشقۇرۇش | GPT-6 Astra | computer use غا مەخسۇس تەربىيەلەنگەن؛ ۋەزىپە ۋاقتى 75 مىنۇتتىن 40 مىنۇتقا چۈشكەن |
| ئۇزۇن مۇددەتلىك كودلاش agent ى | Fable 5.1 ياكى GPT-6 Astra | Terminal-Bench 4.0 دا %55.8 ۋە %57.9 — ئىككىلىسى يېقىن |
| ئىلمىي تەتقىقات ۋە سانلىق مەلۇمات | Fable 5.1 | Terminal-Bench-Science دا %52.6، باشقىلاردىن ئىككى ھەسسە يۇقىرى |
| بىلىم خىزمىتى (ھۆججەت، تەھلىل، دوكلات) | Fable 5.1 | GDPval-AA v2 دە 1853 Elo |
| كۆپ ھەجىملىك سودا ئېقىمى | GPT-5.6 Terra | 1M token گە 2 دوللار — Sol نىڭ 40 پىرسەنتى |
| ئاددىي، تېز، ئەرزان خىزمەت | GPT-5.6 Luna | 1M token گە 0.20 دوللار |
| چەكلىك خىراجەت بىلەن كودلاش | Gemini 3.8 Flash | DeepSWE v1.1 دا %73.8 — ئەمما Terminal-Bench 4.0 دا پەقەت %19.1 |
ئۆلچەم نەتىجىلىرىنى ئوقۇغاندا دىققەت قىلىدىغانلار
سانلارنىڭ كۆپىنچىسى ئىشلەپچىقارغۇچىنىڭ ئۆزى ئېلان قىلغان نەتىجىلەر. مۇستەقىل تەكشۈرۈش ئەمەس.
ئوخشاش ئۆلچەمنىڭ ئوخشىمىغان نەشرى بار: OSWorld 2.0 بىلەن OSWorld V2-Offline، partial بىلەن strict — بۇلارنى ئارىلاشتۇرۇپ سېلىشتۇرۇشقا بولمايدۇ.
Scaffold (مودېلنى ئوراپ تۇرغان agent قۇرۇلمىسى) نەتىجىگە زور تەسىر كۆرسىتىدۇ. ئوخشاش مودېل ئوخشىمىغان scaffold دا ئوخشىمىغان نەتىجە بېرىدۇ.
Effort ياكى reasoning دەرىجىسى ئېيتىلمىسا، نەتىجە قايسى شارائىتتا ئېلىنغانلىقى ئېنىق ئەمەس.
ئۆلچەمدە باھا ۋە كۈتۈش ۋاقتى ئەكس ئەتمەيدۇ. ئەمەلىي خىزمەتتە بۇ ئىككىسى كۆپىنچە نەتىجىدىنمۇ مۇھىم.
ئەڭ ئىشەنچلىك ئۇسۇل — ئۆز ۋەزىپىڭىزدىن 20-50 مىسال ئېلىپ ئۆزىڭىزنىڭ eval توپلىمىنى قۇرۇش ۋە شۇنىڭ بىلەن سېلىشتۇرۇش.
مەنبەلەر
OpenAI — GPT-6 Astra: A new generation of intelligence — https://openai.com/index/gpt-6-astra/
OpenAI — GPT-5.6: Frontier intelligence that scales with your ambition — https://openai.com/index/gpt-5-6/
Anthropic — Introducing Claude Fable 5.1 and Claude Mythos 5.1 — https://www.anthropic.com/claude-fable-and-mythos-5-1
Claude Platform Docs — Models overview — https://platform.claude.com/docs/en/about-claude/models/overview
Artificial Analysis — Coding Agent Index — https://artificialanalysis.ai/
تۈزگۈچى: سۈنئىي ئىدراك — idirak.com ئۈچۈن 2026 مودېل سېلىشتۇرما جەدۋىلى
GPT-6 Astra · GPT-5.6 Sol/Terra/Luna · Claude Fable 5.1 · Mythos 5.1 · Opus 5 · Gemini 3.8 Flash
