سۈنئىي ئىدراك2026-09

2026-يىلىدىكى ئالدىنقى AI مودېللىرى — تولۇق سېلىشتۇرما

GPT-6 Astra، Claude Fable 5.1، Opus 5 ۋە Gemini 3.8 Flash نىڭ ئۆلچەم نەتىجىسى، باھاسى ۋە context كۆزنىكى بىر جەدۋەلدە

2026-يىلىدىكى ئالدىنقى AI مودېللىرى — بىر جەدۋەلدە سېلىشتۇرما

2026: ئالدىنقى مودېللار قانداق ئورۇنلاشتى

2026-يىلىنىڭ 9-ئېيىدا ئىككى چوڭ ئېلان ئارقا-ئارقىدىن كەلدى: 9-ئاينىڭ 1-كۈنى Anthropic نىڭ Claude Fable 5.1 ۋە Mythos 5.1 ى، 9-ئاينىڭ 3-كۈنى OpenAI نىڭ GPT-6 Astra سى. بۇنىڭدىن ئىلگىرى 7-ئايدا GPT-5.6 ئائىلىسى (Sol، Terra، Luna)، 6-ئايدا Claude Fable 5 ۋە Mythos 5 چىققانىدى.

بۇ ماقالە ئۈچ سوئالغا جاۋاب بېرىدۇ: قايسى مودېل قايسى ئۆلچەمدە ئالدىدا، باھاسى قانچە، ۋە ئۆز خىزمىتىڭىزگە قايسىنى تاللاش.

كودلاش ۋە agent ئۆلچەملىرى

تۆۋەندىكى جەدۋەل ئىشلەپچىقارغۇچىلار ئېلان قىلغان رەسمىي سانلارغا ئاساسلانغان. سىزىقچە (—) بولغان كاتەكچىلەردە رەسمىي نەتىجە ئېلان قىلىنمىغان.

ئۆلچەمGPT-6 AstraGPT-5.6 SolFable 5.1Fable 5Opus 5Gemini 3.8 Flash
Terminal-Bench 4.0%57.9%37.3%55.8%42.0%52.3%19.1
DeepSWE v1.1%74.1%72.7%67.4%69.9%73.7%73.8
FrontierCode 1.1 Extended (نومۇر)64.560.663.664.963.656.3
FrontierCode 1.1 Main (نومۇر)53.347.550.953.553.443.6
ئىچكى سانداندىن كۆچۈرۈش ۋەزىپىلىرى%63.9%42.7%57.8%50.3
Artificial Analysis Coding Agent Index v1.467.065.167.268.161.2

جەدۋەلدىن كۆرۈنىدىغىنى: Terminal-Bench 4.0 دەك ئۇزۇن، كۆپ باسقۇچلۇق terminal ۋەزىپىسىدە GPT-6 Astra بىلەن Fable 5.1 بىر-بىرىگە يېقىن (%57.9 ۋە %55.8)، ئەمما DeepSWE دەك كلاسسىك patch يېزىش ۋەزىپىسىدە پەرق ئانچە چوڭ ئەمەس — ھەتتا Gemini 3.8 Flash مۇ %73.8 بىلەن ئالدىنقى قاتاردا.

ئىلىم، بىلىم خىزمىتى ۋە كومپيۇتېر ئىشلىتىش

Anthropic ئېلان قىلغان جەدۋەل باشقا تەرەپلەرنى — ئىلمىي تەتقىقات، بىلىم خىزمىتى، كومپيۇتېر ئىشلىتىش ۋە كۆپ ساھەلىك ئەقلىي ئىقتىدارنى ئۆز ئىچىگە ئالىدۇ.

ئۆلچەمFable 5.1Fable 5Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.1 (ئىلمىي تەتقىقات agent)%52.6%24.7%29.0%22.4
Terminal-Bench 4.0 (agentic كودلاش)%55.8%42.0%52.3%37.3
GDPval-AA v2 (بىلىم خىزمىتى، Elo)1853172318241711
OSWorld 2.0 — partial%77.9%72.9%75.4
OSWorld 2.0 — strict%41.7%36.1%39.6
Humanity's Last Exam — قورالسىز%60.9%57.8%56.6
Humanity's Last Exam — قورال بىلەن%65.0%63.8%63.6
AutomationBench (سودا ئېقىمى)%31.4%17.1%26.9%19.6
CursorBench 3.2.0%73.4%70.5%70.0%67.2

OpenAI تەرەپتىن كومپيۇتېر ئىشلىتىش ئۆلچىمى ئوخشاش ئەمەس: GPT-6 Astra OSWorld V2-Offline دا %72.6 (GPT-5.6 Sol %65.7) ئالغان. ئىككى شىركەت ئوخشىمىغان نەشرى ۋە ئوخشىمىغان scaffold ئىشلەتكەچكە، بۇ ئىككى ساننى بىۋاسىتە تەڭ قويۇشقا بولمايدۇ.

باھا سېلىشتۇرمىسى

ھەممە باھا ھەر 1 مىليون token بويىچە، دوللار ھېسابىدا.

مودېلكىرگۈزۈشچىقىرىشCache ئوقۇش
GPT-6 Astra10.0050.001.00
GPT-5.6 Sol5.0030.00
GPT-5.6 Terra2.0012.00
GPT-5.6 Luna0.201.20
Claude Fable 5.110.0050.000.25
Claude Fable 510.0050.001.00

Fable 5.1 نىڭ ئاساسىي باھاسى Fable 5 بىلەن ئوخشاش، ئەمما cache ئوقۇش باھاسى 1.00 دوللاردىن 0.25 دوللارغا چۈشكەن. شۇ سەۋەبتىن ئادەتتىكى خىزمەتتە تەخمىنەن %25، قاتتىق agentic خىزمەتتە %45 كە قەدەر ئەرزانغا چۈشىدۇ.

GPT-6 Astra دا 272K token دىن ئېشىپ كەتكەن ئىلتىماسنىڭ كىرگۈزۈش ۋە cache باھاسى 2 ھەسسە، چىقىرىش باھاسى 1.5 ھەسسە ھېسابلىنىدۇ؛ Fast tier ئۆلچەملىك باھانىڭ 2 ھەسسىسى. GPT-5.6 نىڭ ھەر ئۈچ دەرىجىسىدە چىقىرىش باھاسى كىرگۈزۈشنىڭ 6 ھەسسىسى.

Context كۆزنىكى ۋە چىقىرىش چېكى

مودېلContextئەڭ كۆپ چىقىرىش
GPT-6 Astra1,000,000 token (ئەڭ يۇقىرىسى 1,050,000)128,000 token
Claude Fable 5.11,000,000 token128,000 token

ئىككىلىسى 1M token لۇق كۆزنەككە يەتتى. ئەمما كۆزنەكنى تولۇق تولدۇرۇش ئەرزان ئەمەس — GPT-6 Astra دا 1M token لۇق بىر چاقىرىش تەخمىنەن 10 دوللار. Cache نى توغرا ئىشلىتىش ئۇزۇن context بىلەن ئىشلەشنىڭ ئاچقۇچى.

قايسى ۋەزىپىگە قايسى مودېل

ۋەزىپەتەۋسىيەسەۋەبى
كومپيۇتېر كۆرۈنمە يۈزىنى باشقۇرۇشGPT-6 Astracomputer use غا مەخسۇس تەربىيەلەنگەن؛ ۋەزىپە ۋاقتى 75 مىنۇتتىن 40 مىنۇتقا چۈشكەن
ئۇزۇن مۇددەتلىك كودلاش agent ىFable 5.1 ياكى GPT-6 AstraTerminal-Bench 4.0 دا %55.8 ۋە %57.9 — ئىككىلىسى يېقىن
ئىلمىي تەتقىقات ۋە سانلىق مەلۇماتFable 5.1Terminal-Bench-Science دا %52.6، باشقىلاردىن ئىككى ھەسسە يۇقىرى
بىلىم خىزمىتى (ھۆججەت، تەھلىل، دوكلات)Fable 5.1GDPval-AA v2 دە 1853 Elo
كۆپ ھەجىملىك سودا ئېقىمىGPT-5.6 Terra1M token گە 2 دوللار — Sol نىڭ 40 پىرسەنتى
ئاددىي، تېز، ئەرزان خىزمەتGPT-5.6 Luna1M token گە 0.20 دوللار
چەكلىك خىراجەت بىلەن كودلاشGemini 3.8 FlashDeepSWE v1.1 دا %73.8 — ئەمما Terminal-Bench 4.0 دا پەقەت %19.1

ئۆلچەم نەتىجىلىرىنى ئوقۇغاندا دىققەت قىلىدىغانلار

سانلارنىڭ كۆپىنچىسى ئىشلەپچىقارغۇچىنىڭ ئۆزى ئېلان قىلغان نەتىجىلەر. مۇستەقىل تەكشۈرۈش ئەمەس.

ئوخشاش ئۆلچەمنىڭ ئوخشىمىغان نەشرى بار: OSWorld 2.0 بىلەن OSWorld V2-Offline، partial بىلەن strict — بۇلارنى ئارىلاشتۇرۇپ سېلىشتۇرۇشقا بولمايدۇ.

Scaffold (مودېلنى ئوراپ تۇرغان agent قۇرۇلمىسى) نەتىجىگە زور تەسىر كۆرسىتىدۇ. ئوخشاش مودېل ئوخشىمىغان scaffold دا ئوخشىمىغان نەتىجە بېرىدۇ.

Effort ياكى reasoning دەرىجىسى ئېيتىلمىسا، نەتىجە قايسى شارائىتتا ئېلىنغانلىقى ئېنىق ئەمەس.

ئۆلچەمدە باھا ۋە كۈتۈش ۋاقتى ئەكس ئەتمەيدۇ. ئەمەلىي خىزمەتتە بۇ ئىككىسى كۆپىنچە نەتىجىدىنمۇ مۇھىم.

ئەڭ ئىشەنچلىك ئۇسۇل — ئۆز ۋەزىپىڭىزدىن 20-50 مىسال ئېلىپ ئۆزىڭىزنىڭ eval توپلىمىنى قۇرۇش ۋە شۇنىڭ بىلەن سېلىشتۇرۇش.

مەنبەلەر

OpenAI — GPT-6 Astra: A new generation of intelligence — https://openai.com/index/gpt-6-astra/

OpenAI — GPT-5.6: Frontier intelligence that scales with your ambition — https://openai.com/index/gpt-5-6/

Anthropic — Introducing Claude Fable 5.1 and Claude Mythos 5.1 — https://www.anthropic.com/claude-fable-and-mythos-5-1

Claude Platform Docs — Models overview — https://platform.claude.com/docs/en/about-claude/models/overview

Artificial Analysis — Coding Agent Index — https://artificialanalysis.ai/

تۈزگۈچى: سۈنئىي ئىدراك — idirak.com ئۈچۈن 2026 مودېل سېلىشتۇرما جەدۋىلى

GPT-6 Astra · GPT-5.6 Sol/Terra/Luna · Claude Fable 5.1 · Mythos 5.1 · Opus 5 · Gemini 3.8 Flash

كۆپ سورىلىدىغان سوئاللار

2026-يىلىدىكى ئەڭ كۈچلۈك AI مودېلى قايسى؟
بىرلا جاۋاب يوق — ۋەزىپىگە باغلىق. Agentic كودلاش ۋە كومپيۇتېر ئىشلىتىشتە GPT-6 Astra ئالدىدا (Terminal-Bench 4.0 دا %57.9). ئىلمىي تەتقىقات ۋە بىلىم خىزمىتىدە Claude Fable 5.1 ئالدىدا (Terminal-Bench-Science دا %52.6، GDPval-AA v2 دە 1853 Elo).
GPT-6 Astra بىلەن Claude Fable 5.1 نىڭ قايسىسى ياخشى؟
Terminal-Bench 4.0 دا ئىككىسى بىر-بىرىگە يېقىن — Astra %57.9، Fable 5.1 %55.8. Astra كومپيۇتېر كۆرۈنمە يۈزىنى باشقۇرۇشتا كۈچلۈك؛ Fable 5.1 ئىلمىي تەتقىقات، بىلىم خىزمىتى ۋە cache نى كۆپ ئىشلىتىدىغان agent ئېقىمىدا ئەرزانغا چۈشىدۇ (cache ئوقۇش 0.25 دوللار، Astra دا 1.00 دوللار).
كودلاش ئۈچۈن قايسى AI مودېلى ئەڭ ياخشى؟
ئۇزۇن، كۆپ باسقۇچلۇق terminal ۋەزىپىسىدە GPT-6 Astra (%57.9) ۋە Fable 5.1 (%55.8) ئالدىدا. ئەمما DeepSWE v1.1 دەك كلاسسىك patch يېزىش سىنىقىدا پەرق كىچىك — Astra %74.1، Gemini 3.8 Flash %73.8، Opus 5 %73.7. شۇڭا ئۆز كود ئامبىرىڭىزدا سىناپ كۆرۈش ئەڭ توغرا.
ئەڭ ئەرزان AI مودېلى قايسى؟
بۇ سېلىشتۇرمىدىكى ئەڭ ئەرزىنى GPT-5.6 Luna — ھەر 1 مىليون كىرگۈزۈش token ى 0.20 دوللار، چىقىرىش 1.20 دوللار. ئۇ خۇلاسە، لايىھە يېزىش ۋە ئاددىي ئاپتوماتلاشتۇرۇشقا ماس كېلىدۇ.
Benchmark نەتىجىسىگە ئىشەنگىلى بولامدۇ؟
ئېھتىياتچانلىق بىلەن. سانلارنىڭ كۆپىنچىسى ئىشلەپچىقارغۇچىنىڭ ئۆزى ئېلان قىلغان نەتىجە؛ ئوخشاش ئۆلچەمنىڭ ئوخشىمىغان نەشرى (OSWorld 2.0 بىلەن V2-Offline، partial بىلەن strict) بار؛ scaffold ۋە effort دەرىجىسى نەتىجىگە زور تەسىر كۆرسىتىدۇ. ئەڭ ئىشەنچلىك ئۇسۇل — ئۆز ۋەزىپىڭىزدىن 20-50 مىسال ئېلىپ ئۆزىڭىزنىڭ eval توپلىمىنى قۇرۇش.