Моделът Kimi K3 на китайския еднорог Moonshot AI изостава далеч от водещите американски съперници в способността си да предприема кибератаки, показват съвместни британско-американски правителствени изследвания, предизвикващи назряващото безпокойство на Вашингтон от бързото нарастване на китайския изкуствен интелект с отворен код.
Моделът, считан в момента за най-мощния голям езиков модел в Китай, се представя „значително под най-новите гранични кибер-способни модели“, според доклад, публикуван в четвъртък от Института за сигурност на изкуствения интелект на Обединеното кралство (AISI) и Центъра за AI стандарти и иновации на САЩ (CAISI).
AISI е изследователско звено към Министерството на науката, иновациите и технологиите на Обединеното кралство, докато CAISI работи в рамките на Националния институт по стандарти и технологии на Министерството на търговията на САЩ.
За да оценят способностите, двата правителствени органа подложиха Kimi K3 на ExploitBench, публичен бенчмарк, оценяващ способността на AI да разработва експлойти за уязвимости в киберсигурността.
Kimi K3 постигна общ резултат от 32,2 процента, превъзхождайки GLM-5.2 на местния съперник Zhipu AI с 24,4 процента, но изоставайки доста зад най-добрите, неназовани американски модели, които са със среден резултат от 76,2 процента.
Трябва да се отбележи, че Kimi K3 не успя да постигне изпълнение на произволен код – експлойтът от най-високо ниво, предоставящ пълен контрол върху целевата система – във всичките 41 задачи на ExploitBench, докато водещите американски модели го постигнаха при 20 задачи.

