Moonshot AI направи параметрите на Kimi K3 достъпни за изтегляне

Moonshot AI направи параметрите на Kimi K3 достъпни за изтегляне и адаптиране. Моделът има 2,8 трилиона параметъра и контекст до 1 млн. токена, но размерът му ограничава самостоятелното внедряване основно до облачни доставчици и големи организации.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип
Moonshot, Kimi K3
Съдържание

Moonshot AI публикува пълните обучени параметри на Kimi K3, което позволява на разработчиците да изтеглят, адаптират и разполагат модела в собствена инфраструктура.

Това дава повече контрол върху данните и внедряването, но огромният размер на Kimi K3 ограничава практическото му използване до компании с мащабна изчислителна инфраструктура.

Според официалната документация на Moonshot AI моделът има 2,8 трилиона параметъра, от които 104 млрд. се активират при обработването на всеки токен. Контекстният му прозорец достига 1 048 576 токена.

Kimi K3 се доближава до водещите затворени модели

При представянето на Kimi K3 Moonshot AI публикува резултати, според които моделът се доближава до Claude Fable 5 и GPT-5.6 Sol, а в някои тестове ги изпреварва.

Тези сравнения обаче трябва да се разглеждат внимателно. Част от оценките са направени от самата Moonshot AI, използвани са различни агентни среди, а някои показатели идват от вътрешни тестове. Затова резултатите не доказват, че Kimi K3 превъзхожда конкурентните модели при всички практически задачи.

Например при Terminal-Bench 2.1 компанията отчита резултат от 88,3 точки за Kimi K3 спрямо 88,0 за Claude Fable 5 и 88,8 за GPT-5.6 Sol. При FrontierSWE резултатът на Kimi K3 е 81,2 точки, докато Claude Fable 5 достига 86,6, а GPT-5.6 Sol получава 71,3 точки.

Публичните параметри не означават напълно отворен код

Публикуването на параметрите предоставя на разработчиците достъп до обучените стойности, които определят поведението на модела. Така компаниите могат да го дообучават със собствени данни, да разработват специализирани инструменти и да го хостват независимо от API услугата на Moonshot AI.

Кодът и параметрите са публикувани под специалния лиценз Kimi K3. Това означава, че организациите трябва да проверят конкретните лицензионни условия, преди да използват модела в търговски продукти.

Kimi K3 не е напълно отворен проект в традиционния смисъл. Moonshot AI не е публикувала пълния набор от обучителни данни и всички подробности за процеса на обучение. Следователно външни екипи не могат независимо да възпроизведат целия модел от самото начало.

Изтеглянето е лесно, но стартирането изисква център за данни

Параметрите на Kimi K3 са достъпни чрез Hugging Face, но моделът е твърде голям за обикновен персонален компютър или стандартна работна станция.

Kimi K3 използва архитектура от типа „смес от експерти“, при която се активират 16 от общо 896 експерта. Въпреки че при всяка заявка работят само 104 млрд. параметъра, всички 2,8 трилиона параметъра трябва да бъдат съхранявани.

Самото 4-битово представяне на параметрите предполага приблизителен размер от около 1,4 TB. Към него трябва да се добавят паметта за контекста, кеша и останалите компоненти, необходими при изпълнение.

На практика самостоятелното хостване изисква сървър с множество висок клас графични ускорители. За малки компании и независими разработчици използването на API или на по-малки производни версии вероятно ще бъде по-практично.

Moonshot AI препоръчва среди като vLLM, SGLang и TokenSpeed. Компанията твърди също, че новата архитектура осигурява приблизително 2,5 пъти по-висока обща ефективност при мащабиране спрямо Kimi K2. Това е фирмено твърдение, а не независимо потвърдена оценка на разходите при реално внедряване.

Kimi K3 попадна в политически спор в САЩ

Публикуването на параметрите идва на фона на засилващ се дебат в САЩ за китайските AI модели и достъпа до усъвършенствани американски технологии.

Директорът на Службата за научна и технологична политика на Белия дом Майкъл Крациос обвини Moonshot AI, че е използвала мащабна дестилация на Claude Fable и че е получила достъп до ограничени сървъри с Nvidia GB300 в Тайланд. Към момента тези твърдения остават обвинения, а не публично доказано нарушение или окончателно решение на американските власти. Според Quartz, Moonshot AI не е отговорила на отправените запитвания за коментар.

Дестилацията представлява използване на резултатите от един модел за обучение или подобряване на друг. Самата техника има законни приложения, но спорът е дали е използвана за извличане на защитени възможности в нарушение на условията на доставчика.

Технологични компании защитават моделите с публични параметри

На 24 юли 2026 г. Nvidia и други технологични компании публикуваха писмо, призоваващо американските власти да не въвеждат широкообхватни ограничения върху моделите с публично достъпни параметри.

Сред подписалите актуалната версия са OpenAI, Google, Microsoft, Meta, AMD, Cisco, Cloudflare, GitHub, Hugging Face, Block и Ollama. Компаниите твърдят, че публичните параметри насърчават конкуренцията, дават повече контрол върху данните и подпомагат изследванията в киберсигурността. В писмото се признава и че веднъж публикувани, параметрите трудно могат да бъдат контролирани или изтеглени обратно.

Amazon и Anthropic не присъстват сред подписалите. Това обаче не означава автоматично, че подкрепят забрана. Изпълнителният директор на Anthropic Дарио Амодей заяви, че компанията не настоява за забрана на моделите с публични параметри, но подкрепя по-строг контрол върху чиповете, промишлената дестилация и тестовете за безопасност, съобщава Axios.

Размерът ще ограничи реалното разпространение

Kimi K3 предоставя на разработчиците достъп до модел с възможности, близки до тези на водещите затворени системи. Практическата му достъпност обаче е ограничена от необходимата памет, графични ускорители, електроенергия и поддръжка.

Първите мащабни внедрявания вероятно ще дойдат от облачни доставчици и големи организации. За повечето разработчици публикуването на параметрите ще означава по-голям избор между хоствани услуги и специализирани версии, а не възможност да стартират пълния Kimi K3 на собствен компютър.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип

Още публикации

  • 15.09.2026
  • /
  • Изкуствен интелект
Нови функции в Gemini Notebook ще помагат на студентите да разбират сложни теми, да записват лекции и да проверяват знанията си. Google добавя гласови разговори в реално време, вграден диктофон, нови тестове и кратки видеообобщения. Gemini Notebook, познато преди като NotebookLM, получава сериозна актуализация, насочена към студентите. Новите инструменти трябва да улеснят разбирането на трудни […]
  • 14.09.2026
  • /
  • Социални мрежи
Meta пусна общия абонамент Meta One с над 50 платени функции за Instagram, Facebook, WhatsApp и Meta AI. Услугата включва планове за индивидуални потребители, създатели на съдържание и бизнеси, като цените и достъпните възможности зависят от региона и профила. Компанията обяви услугата след месеци на тестове. Разпространението на плановете става постепенно, уточнява Meta в официалното […]
  • 09.09.2026
  • /
  • Изкуствен интелект
ChatGPT Images 2.5 позволява на потребителите да покажат идеята си чрез рисунка, която изкуственият интелект да превърне в завършено изображение, според информацията в предоставения материал. Обновлението включва и подобрения в скоростта, реалистичността и прецизността при редактиране. В текста се посочва, че OpenAI започва разпространението на новата версия на фона на над 3 милиарда изображения, генерирани […]
  • 08.09.2026
  • /
  • Изкуствен интелект
ChatGPT тества функцията Writing Style, която цели да доближи генерираните текстове до начина, по който пише конкретният потребител. Вместо всеки път да получава инструкции за тона или копирани примери от стари имейли, чатботът ще може да използва текстове от свързани приложения. Идеята е да отпадне необходимостта потребителите многократно да обясняват как трябва да звучат отговорите. […]
  • 06.09.2026
  • /
  • SEO
Решението дали да бъдат блокирани AI ботовете е преди всичко бизнес въпрос. След като една компания прецени, че не желае нейното съдържание да бъде обхождано, използвано за обучение или достъпвано от определени AI системи, идва техническият въпрос: кой е най-добрият начин за блокиране? Основните подходи са два. AI ботовете могат да бъдат ограничени чрез файла […]
  • 06.09.2026
  • /
  • Изкуствен интелект
Google добави Lyria 3.5, своя най-усъвършенстван досега модел за генериране на музика, към приложението Gemini. Досега технологията беше достъпна чрез инструмента за създаване на филми с изкуствен интелект Flow. Моделът вече започва да достига до всички потребители на Gemini. Чрез него могат да бъдат генерирани песни, инструментали и саундтраци въз основа на обикновени текстови описания […]