Нағыз ноутбукке сыятын, салмақтары ашық OpenAI моделі: жүктелетін көлемі 14 ГБ, ал Ollama оны 16 ГБ жадпен-ақ іске қосуға болады дейді. Ештеңе құрылғыңнан шықпағанда LLM өзін қалай ұстайтынын сезінудің ең арзан жолы.
Үлкен туысы gpt-oss:120b — 65 ГБ жүктеме, оған 80 ГБ GPU керек, сондықтан ол тек бұлтта жұмыс істейді. Жергілікті модель не беретінін шынайы бағала: құпиялылық, интернетсіз жұмыс, нөл шығын және түсінік — бірақ алдыңғы қатарлы агент сапасы емес.
Тегін: Ollama арқылы жүктеп алып, интернетсіз іске қоса бер. Оның үстіне Google Antigravity-дің тегін Individual жоспарында gpt-oss-120b бар, сондықтан үлкенін техникасыз да байқап көруге болады.
Google-дың салмақтары ашық отбасы, әрі беттегі ең ноутбукке ыңғайлысы: Ollama-дағы өлшемдері e2b — 7,2 ГБ, 12b — 7,6 ГБ, 31b — 20 ГБ; көру, құрал қолдану және ойлану мүмкіндіктері бар.
Контекст өлшемге қарай 128 мыңнан 256 мың токенге дейін деп көрсетілген. «e2b нұсқасына небәрі 3 ГБ жад керек» деп жазатын блог нұсқаулықтарына абай бол: бұл 7,2 ГБ жүктемеге қайшы келеді. Толы аудиторияға уәде берер алдында нағыз ноутбукте тексеріп көр.
Ollama арқылы тегін жүктеп алып, іске қосуға болады.
DeepSeek V4.1-Flash
DeepSeekБатыс флагмандарынан шамамен он есе арзан бағаға нағыз сапа: 1 млн контекст, 384 мың токенге дейінгі жауап, ойланатын және ойланбайтын режимдер, көру, құрал шақыру және JSON шығысы. Оның үстіне ол Anthropic API форматында сөйлейді, сондықтан Anthropic-пен үйлесімді құралдарды тікелей осыған бағыттауға болады.
- 1000k контекст
- $0.3 / $1.2 1M token: кіріс / шығыс
- ашық салмақтар
Көрсетілген бағалар — шың сағаттардікі. Шыңнан тыс уақытта екі есе арзан: шың уақыты жұмыс күндері UTC бойынша 01:00-04:00 және 06:00-10:00, яғни Қазақстанда (UTC+5) жергілікті 06:00-09:00 және 11:00-15:00. Кештерің мен демалыс күндерің — арзан терезе. Ашық салмақ дегенді де мұқият оқы: модель картасында 552 млрд параметрлік негіз сипатталған, яғни «ашық» деген сөз «сенің құрылғыңа сыяды» дегенді білдірмейді.
Салмақтары Hugging Face-те MIT лицензиясымен жарияланған, яғни 552 млрд параметрлік модельге техникаң болса — тегін. Хостталған API тегін емес, бірақ ол мұндағы ең арзан байыпты API.
DeepSeek-тің үлкен моделі (V4-Pro-0813, Hugging Face-те 1,7 трлн параметр деп көрсетілген); контексті сол 1 млн, жауабы 384 мың токенге дейін, әрі кез келген Батыс флагманынан арзан.
- 1000k контекст
- $1.32 / $3.96 1M token: кіріс / шығыс
- ашық салмақтар
Flash-тан айырмашылығы — көру мүмкіндігі жоқ. Шың және шыңнан тыс бағалар дәл солай бөлінеді. DeepSeek Flash-тан шамамен төрт есе қымбат, сондықтан алдымен Flash-пен баста, тек Flash нақты жеткізбей жатқанын көрсете алсаң ғана жоғары көтеріл.
Meta шынымен шығарған кіші ашық модель: 30 млрд параметр, Apache 2.0 лицензиясы, 2026 жылдың 10 тамызында жарияланған, контексті 128 мың токен. «Meta енді ешқандай ашық модель шығармайды» деген пікірдің де қате екенінің дәлелі.
- 128k контекст
- ашық салмақтар
Ollama-дағы жүктеме көлемі 18-19 ГБ. gpt-oss:20b (14 ГБ) 16 ГБ жадта жұмыс істейтінін ескерсек, мұнда 16 ГБ-дан айтарлықтай көп жад керек. 30 млрд параметр — алдыңғы қатарлы модель емес: оны өнім шығаруға емес, модельдердің өзін қалай ұстайтынын үйренуге пайдалан.
Ollama арқылы тегін жүктеп алып, іске қосуға болады; онда ол қазірдің өзінде 200 мыңнан астам рет жүктелген.
Соңғы ашық Llama, 2026 жылғы емес — 2025 жылдың 5 сәуірінде шыққан: жалпы 109 млрд параметрдің 17 млрд-ы белсенді, ал 10 млн токендік контекст терезесі осы беттегі ең үлкен сан, екінші орындағыдан он есе үлкен.
- 10000k контекст
- ашық салмақтар
Бұл — ұсыныс емес, тарих. Meta 2026 жылы жабық салмақтарға көшті, Llama 5 шыққан жоқ. Туысы Maverick — жалпы 400 млрд параметрдің 17 млрд-ы белсенді, контексті 1 млн токен. Бізге маңызды тағы бір себебі: Llama тектес токенизаторлар қазақ тілі үшін ең нашары — бір сөзге шамамен 4,73 токен, ал орыс тілінде 2,56, түрік тілінде 2,23.
Mistral Medium 3.5
MistralЕуропаның байыпты ашық нұсқасы: өзгертілген MIT лицензиясымен шыққан, 128 млрд параметрлік тығыз модель (2026 жылғы 28 сәуір). Деректер өз серверлеріңнен шықпауы шарт болса, жұмысты шынымен тартатын деңгей осы.
- 256k контекст
- $1.5 / $7.5 1M token: кіріс / шығыс
- ашық салмақтар
Контексті 256 мың токен — ірі зертханалардың ішіндегі ең кішісі; қалғандарының бәрі 1 млн деңгейінде, ал бұл айырма үлкен repo-мен агенттік жұмыста бірден сезіледі. Өз серверіңде ұстау да ноутбук әңгімесі емес: Ollama-дағы жүктеме 80 ГБ.
Салмақтарын өзгертілген MIT лицензиясымен жүктеп алуға болады, яғни өз серверіңде ұстауға лицензия ақысы жоқ. Хостталған API ақылы.
Apache 2.0 және арзан. Ең бастысы — лицензияның еркіндігі: оны коммерциялық мақсатта ешқандай шартсыз пайдалана аласың, өз серверіңде де, API арқылы да. Бұл сапа деңгейінде мұндайы сирек.
- 256k контекст
- $0.15 / $0.6 1M token: кіріс / шығыс
- ашық салмақтар
Mistral-дың сол 256 мың токендік шегі күшінде. Mistral API-де batch режимі екі есе арзан, ал кэштелген кіріс 90%-ға арзан — бұл каталогтағы ең жомарт кэш жеңілдігі.
Салмақтары Apache 2.0 лицензиясымен, сондықтан жүктеп алып, өз серверіңде ұстау техникадан басқа ештеңе тұрмайды.
Ноутбукке сыятын өлшем әрі Apache 2.0 лицензиясы, оның үстіне сирек кездесетін қасиеті бар: кіріс пен шығыс дәл бірдей тұрады. Сондықтан бұл — каталогтағы бюджеті ең оңай есептелетін модель.
- $0.15 / $0.15 1M token: кіріс / шығыс
- ашық салмақтар
Отбасы: 3 млрд — $0,10 / $0,10, 8 млрд — $0,15 / $0,15, 14 млрд — $0,20 / $0,20. Кіші модельдерді бір мезгілде бір ғана тар тапсырмаға қолдан. Агенттік циклге кемінде 64 мың токен контекст және сенімді құрал шақыру керек, ал дәл осы екеуінде осы өлшемдегі модельдер ақсай бастайды.
Салмақтары Apache 2.0 лицензиясымен, ал өлшемдері қарапайым ноутбукке сияды.
Qwen3.8 (open weights, 27B)
Alibaba (Qwen)Салмақтары ашық Qwen желісі — Ollama-да ең көп жүктелетін Батыстан тыс отбасы, ал 27 млрд параметр — қуатты ноутбук немесе бір жақсы GPU шынымен көтеретін өлшем.
Ескілеу Qwen3.6 (27 және 35 млрд) әлі 6,7 млн рет жүктелген, ал Qwen3.8 — 2,3 млн рет; яғни қауымдастықтың әдепкі таңдауы бір буынға артта. Оқыған нұсқаулығың қайсысын меңзеп тұрғанын тексер. Claude Code-ты жергілікті модельмен іске қосу туралы Ollama нұсқаулығы өз мысалында Qwen моделін қолданады.
Ollama арқылы тегін жүктеп алып, іске қосуға болады.
Тәуелсіз Artificial Analysis Intelligence Index тізіміндегі салмақтары ашық модельдердің ең жоғары нәтижесі: v4.3.2 нұсқасында max режимінде 45 ұпай, ал Claude Fable 5.1 мен GPT-6 Astra — 53 ұпай.
Екі сабақ бар. Біріншіден, ашық модельдердің алдыңғы шептен артта қалуы байқалады, бірақ шамалы: индекс бағалайтын 149 модельдің 66-сы — салмағы ашық модельдер. Екіншіден, Ollama-да бұл тек бұлттық модель ретінде бар: «ашық салмақ» ешқашан «сенің құрылғыңа сыяды» дегенді білдірген емес. Ұпайлар effort параметріне тәуелді, сондықтан сан келтірсең, қай режим екенін де айт.
Artificial Analysis индексіндегі салмағы ашық модельдер арасында екінші нәтиже (max режимінде 44 ұпай), әрі Cursor ішінде Claude, GPT және Gemini-мен қатар таңдауға болады.
GLM-5.3 сияқты бұлт деңгейіндегі модель: Ollama Kimi желісін тек бұлттық модель ретінде ұсынады. Екеуінен шығатын практикалық сабақ: «салмағы ашық модельдердің шегі» мен «менің ноутбугімде жұмыс істейтіндердің шегі» — екі мүлде бөлек сызық, арасы жүздеген миллиард параметр.