Moonshot AI направи параметрите на Kimi K3 достъпни за изтегляне

Moonshot AI направи параметрите на Kimi K3 достъпни за изтегляне и адаптиране. Моделът има 2,8 трилиона параметъра и контекст до 1 млн. токена, но размерът му ограничава самостоятелното внедряване основно до облачни доставчици и големи организации.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип
Moonshot, Kimi K3
Съдържание

Moonshot AI публикува пълните обучени параметри на Kimi K3, което позволява на разработчиците да изтеглят, адаптират и разполагат модела в собствена инфраструктура.

Това дава повече контрол върху данните и внедряването, но огромният размер на Kimi K3 ограничава практическото му използване до компании с мащабна изчислителна инфраструктура.

Според официалната документация на Moonshot AI моделът има 2,8 трилиона параметъра, от които 104 млрд. се активират при обработването на всеки токен. Контекстният му прозорец достига 1 048 576 токена.

Kimi K3 се доближава до водещите затворени модели

При представянето на Kimi K3 Moonshot AI публикува резултати, според които моделът се доближава до Claude Fable 5 и GPT-5.6 Sol, а в някои тестове ги изпреварва.

Тези сравнения обаче трябва да се разглеждат внимателно. Част от оценките са направени от самата Moonshot AI, използвани са различни агентни среди, а някои показатели идват от вътрешни тестове. Затова резултатите не доказват, че Kimi K3 превъзхожда конкурентните модели при всички практически задачи.

Например при Terminal-Bench 2.1 компанията отчита резултат от 88,3 точки за Kimi K3 спрямо 88,0 за Claude Fable 5 и 88,8 за GPT-5.6 Sol. При FrontierSWE резултатът на Kimi K3 е 81,2 точки, докато Claude Fable 5 достига 86,6, а GPT-5.6 Sol получава 71,3 точки.

Публичните параметри не означават напълно отворен код

Публикуването на параметрите предоставя на разработчиците достъп до обучените стойности, които определят поведението на модела. Така компаниите могат да го дообучават със собствени данни, да разработват специализирани инструменти и да го хостват независимо от API услугата на Moonshot AI.

Кодът и параметрите са публикувани под специалния лиценз Kimi K3. Това означава, че организациите трябва да проверят конкретните лицензионни условия, преди да използват модела в търговски продукти.

Kimi K3 не е напълно отворен проект в традиционния смисъл. Moonshot AI не е публикувала пълния набор от обучителни данни и всички подробности за процеса на обучение. Следователно външни екипи не могат независимо да възпроизведат целия модел от самото начало.

Изтеглянето е лесно, но стартирането изисква център за данни

Параметрите на Kimi K3 са достъпни чрез Hugging Face, но моделът е твърде голям за обикновен персонален компютър или стандартна работна станция.

Kimi K3 използва архитектура от типа „смес от експерти“, при която се активират 16 от общо 896 експерта. Въпреки че при всяка заявка работят само 104 млрд. параметъра, всички 2,8 трилиона параметъра трябва да бъдат съхранявани.

Самото 4-битово представяне на параметрите предполага приблизителен размер от около 1,4 TB. Към него трябва да се добавят паметта за контекста, кеша и останалите компоненти, необходими при изпълнение.

На практика самостоятелното хостване изисква сървър с множество висок клас графични ускорители. За малки компании и независими разработчици използването на API или на по-малки производни версии вероятно ще бъде по-практично.

Moonshot AI препоръчва среди като vLLM, SGLang и TokenSpeed. Компанията твърди също, че новата архитектура осигурява приблизително 2,5 пъти по-висока обща ефективност при мащабиране спрямо Kimi K2. Това е фирмено твърдение, а не независимо потвърдена оценка на разходите при реално внедряване.

Kimi K3 попадна в политически спор в САЩ

Публикуването на параметрите идва на фона на засилващ се дебат в САЩ за китайските AI модели и достъпа до усъвършенствани американски технологии.

Директорът на Службата за научна и технологична политика на Белия дом Майкъл Крациос обвини Moonshot AI, че е използвала мащабна дестилация на Claude Fable и че е получила достъп до ограничени сървъри с Nvidia GB300 в Тайланд. Към момента тези твърдения остават обвинения, а не публично доказано нарушение или окончателно решение на американските власти. Според Quartz, Moonshot AI не е отговорила на отправените запитвания за коментар.

Дестилацията представлява използване на резултатите от един модел за обучение или подобряване на друг. Самата техника има законни приложения, но спорът е дали е използвана за извличане на защитени възможности в нарушение на условията на доставчика.

Технологични компании защитават моделите с публични параметри

На 24 юли 2026 г. Nvidia и други технологични компании публикуваха писмо, призоваващо американските власти да не въвеждат широкообхватни ограничения върху моделите с публично достъпни параметри.

Сред подписалите актуалната версия са OpenAI, Google, Microsoft, Meta, AMD, Cisco, Cloudflare, GitHub, Hugging Face, Block и Ollama. Компаниите твърдят, че публичните параметри насърчават конкуренцията, дават повече контрол върху данните и подпомагат изследванията в киберсигурността. В писмото се признава и че веднъж публикувани, параметрите трудно могат да бъдат контролирани или изтеглени обратно.

Amazon и Anthropic не присъстват сред подписалите. Това обаче не означава автоматично, че подкрепят забрана. Изпълнителният директор на Anthropic Дарио Амодей заяви, че компанията не настоява за забрана на моделите с публични параметри, но подкрепя по-строг контрол върху чиповете, промишлената дестилация и тестовете за безопасност, съобщава Axios.

Размерът ще ограничи реалното разпространение

Kimi K3 предоставя на разработчиците достъп до модел с възможности, близки до тези на водещите затворени системи. Практическата му достъпност обаче е ограничена от необходимата памет, графични ускорители, електроенергия и поддръжка.

Първите мащабни внедрявания вероятно ще дойдат от облачни доставчици и големи организации. За повечето разработчици публикуването на параметрите ще означава по-голям избор между хоствани услуги и специализирани версии, а не възможност да стартират пълния Kimi K3 на собствен компютър.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип

Още публикации

  • 08.08.2026
  • /
  • Изкуствен интелект
Claude Design може да промени начина, по който UX екипите, маркетолозите и продуктовите мениджъри превръщат идеите си във визуални концепции. Повечето инструменти за дизайн са създадени за дизайнери. Това е водещото разбиране от десетилетия и е довело до затруднение, добре познато на маркетолозите, продуктовите мениджъри и екипите за съдържание: имате идея, но превръщането ѝ във […]
  • 07.08.2026
  • /
  • GEO
Данните от AI търсенето в Google Search Console вече са отделени от стандартния отчет за ефективност. През последните две години представянето в AI търсачките оставаше до голяма степен непрозрачно. Брандовете виждаха, че AI Overviews се разрастват, процентът на кликване намалява и начинът, по който Google показва съдържание, се променя. Липсваха обаче данни от първа страна […]
  • 06.08.2026
  • /
  • Социални мрежи
AI съдържанието в LinkedIn вече се оценява по-строго, когато изглежда общо, повтарящо се или лишено от оригинална професионална гледна точка. Платформата не забранява използването на изкуствен интелект, но ограничава разпространението на публикации и коментари, при които AI заменя същинския принос на автора. В официална публикация от 20 май 2026 г. LinkedIn описва проблема като увеличаване […]
  • 05.08.2026
  • /
  • Дигитален маркетинг
Маркетингът на потребителска електроника има централен проблем: как се продава продукт, който шест месеца след премиерата си може да изглежда остарял и струва хиляди долари? Телефоните, телевизорите, слушалките, лаптопите, устройствата за умен дом, носимата електроника, гейминг хардуерът, камерите и свързаните домакински уреди попадат в една от най-взискателните категории за маркетолозите. Купувачите сравняват продуктите внимателно. Рецензентите […]
  • 03.08.2026
  • /
  • Социални мрежи
Нов инструмент за ключови думи в TikTok дава на създателите и брандовете повече контрол върху начина, по който съдържанието им се открива. Платформата вече позволява на потребителите да управляват ключовите думи в метаданните на своите видеа. Те могат да премахват неподходящи термини и да предлагат нови, които описват по-точно съдържанието. TikTok ще продължи да преглежда […]
  • 02.08.2026
  • /
  • Изкуствен интелект
Google Gemini през 2026 г. вече е значително повече от самостоятелен чатбот. Платформата постепенно се превръща в AI слой, който свързва търсенето, Android, Google Workspace и различни потребителски услуги. Промяната започна да се очертава ясно в края на 2025 г., но поредицата от актуализации през 2026 г. разшири както възможностите на моделите, така и начините, […]
AI Assistant