💻
💻 Technologia

Claude Opus 5 przetestowany na SlopCodeBench

Na GitHubie opublikowano wyniki testów modelu Claude Opus 5 firmy Anthropic na benchmarku SlopCodeBench, oceniającym agentów kodujących. Testy przeprowadzono w ramach projektu dotyczącego zaawansowanego inżynierowania kontekstu dla agentów kodujących. Wyniki mają pomóc w ocenie realnych możliwości modelu w zadaniach programistycznych.

Komentarze

Brak komentarzy