Eksperci technologiczni poddają w wątpliwość популярną теорię, że chiński model Kimi K3 osiągnął swoją wysoką wydajność poprzez destylację danych z Fable, najnowszego modelu od Anthropic. Jak powiedział jeden ze specjalistów TechCrunch, uzyskanie modelu o takiej sile i w tak krótkim czasie nie byłoby możliwe, gdyby opierać się wyłącznie na destylacji.
Teoria o exploitacji Fable zdobyła popularność, gdy Kimi K3 szybko pojawił się na scenie i wykazał imponujące wyniki porównawcze. Jednak eksperci sugerują, że rzeczywistość jest bardziej skomplikowana - zespół za Kimi musiał zastosować bardziej zaawansowane techniki oraz własne badania, aby osiągnąć taką wydajność. Destylacja wiedzy z istniejących modeli może być elementem procesu, ale samo kopiowanie nie wystarczyłoby do budowy konkurencyjnego systemu.
Ta dyskusja odsłania szerszą debatę w industrii AI o metodach treningu, transferze wiedzy i granicy pomiędzy uczącym się od konkurencji a kradzieżą własności intelektualnej. Rosnąca konkurencja między Anthropic a chińskimi zespołami AI intensyfikuje dyskusje o etyce badań i ochronie modeli.