💻
💻 Technologia

Kimi K3 i czego wciąż uczy nas benchmark Pelican

Simon Willison analizuje model językowy Kimi K3 przez pryzmat benchmarku Pelican — narzędzia do oceny zdolności rozumowania modeli AI. Artykuł bada, jakie wnioski można wyciągnąć z wyników testów i co mówią one o stanie obecnych dużych modeli językowych. Tekst wywołał 19-komentarzową dyskusję na Hacker News.

Komentarze

Brak komentarzy