💻
💻 Technologia
Claude Opus 5 przetestowany na SlopCodeBench
Na GitHubie opublikowano wyniki testów modelu Claude Opus 5 firmy Anthropic na benchmarku SlopCodeBench, oceniającym agentów kodujących. Testy przeprowadzono w ramach projektu dotyczącego zaawansowanego inżynierowania kontekstu dla agentów kodujących. Wyniki mają pomóc w ocenie realnych możliwości modelu w zadaniach programistycznych.
Komentarze
Brak komentarzy
Komentarze
Jeszcze nikt nie skomentował — napisz pierwszy 👇
Brak komentarzy. Bądź pierwszy!