Integracje Gaius-Lex z Outlookiem, Gmailem, OneDrive i Dyskiem Google są już dostępneDowiedz się więcej
Artykuł

Gaius-Lex w badaniu Bielik.AI na NVIDIA GTC: mniejszy, wyspecjalizowany model wygrywa z większymi w prawie

Sesja „From Data to Deployment: Engineering Sovereign Language Models for a Changing World" na dorocznej konferencji NVIDIA GTC, 16 marca 2026 roku, pokazała wyniki badania zespołu Bielik.AI (SpeakLeash) nad halucynacjami w prawniczych modelach językowych.

Opublikowano 17 mar 20261 min read
Gaius-Lex w badaniu Bielik.AI na NVIDIA GTC: mniejszy, wyspecjalizowany model wygrywa z większymi w prawie

Sesja „From Data to Deployment: Engineering Sovereign Language Models for a Changing World" na dorocznej konferencji NVIDIA GTC, 16 marca 2026 roku, pokazała wyniki badania zespołu Bielik.AI (SpeakLeash) nad halucynacjami w prawniczych modelach językowych. Prowadzili ją Adam Henryk Grzywaczewski z NVIDIA, Paweł Kiszczak z Bielik.ai i Stefan Mesken, główny naukowiec DeepL.

W zestawieniu, w którym uwzględniono Gaius-Lex, porównano cztery modele językowe w dwóch kategoriach benchmarku: source quality, czyli jakość trzymania się dostarczonych źródeł, oraz primacy score, wskaźnik trafności głównej odpowiedzi. Bielik v3 uzyskał 90 punktów w pierwszej kategorii i 89 w drugiej. Bielik v2.6 zanotował 79 i 77. GPT-5.1 uzyskał 81 i 74. GPT-5 Pro wypadł najsłabiej, z wynikiem 73 i 66.

gaius-nvidia

Wynik potwierdza tezę, którą Gaius-Lex formułuje od dawna: w prawie precyzja liczy się bardziej niż rozmiar modelu. Model dopasowany do wąskiej domeny trzyma się faktów ściślej niż model ogólnego przeznaczenia. Kreatywność, przydatna w innych zastosowaniach, w prawie działa na niekorzyść - im dalej model odchodzi od dostarczonych źródeł, tym wyższe ryzyko, że wymyśli przepis, orzeczenie albo cytat, którego nie ma.

Gaius-Lex stosuje te same zasady we własnym procesie testowania platformy przed każdym wdrożeniem: każda iteracja przechodzi przez tysiące testów, zanim trafi do klienta.