Probierz: kamień probierczy dla modeli AI
Większość publicznych benchmarków LLM jest skażona. Probierz to nasz sposób na benchmarki, których nie da się ograć — provenance danych, n-gramowy audyt i ślepa wymiana dwóch teamów.
czytaj wpis →Eksperymenty, benchmarki, koszty treningu i decyzje techniczne z otwartego laboratorium Slayer.
Większość publicznych benchmarków LLM jest skażona. Probierz to nasz sposób na benchmarki, których nie da się ograć — provenance danych, n-gramowy audyt i ślepa wymiana dwóch teamów.
czytaj wpis →Co robimy w głównym repozytorium Slayer AI Lab: benchmarki, porównanie Bielik vs Qwen, zasada czystości i tańsza ścieżka treningu.
czytaj wpis →Krótka mapa tego, o czym będziemy pisać: protokół, benchmarki, modele, workflow badawczy i kultura labu.
czytaj wpis →Krótki manifest bloga Slayer AI Lab: mniej slajdów, więcej mierzalnych eksperymentów.
czytaj wpis →GPU to nie tylko infrastruktura. To tempo eksperymentu, próg wejścia i miara tego, czy laboratorium w ogóle produkuje wiedzę i buduje zespół.
czytaj wpis →