Защо високото качество на данните е от съществено значение за юридическия изкуствен интелект

Как лошото качество на данните води до халюцинации и защо генеричните езикови модели се провалят в правната практика.

Адвокат внася писмено становище във Върховния регионален съд в Кьолн. Цитатите са прецизни, препратките авторитетни: „Meyer-Götz, в: Hauß/Gernhuber, Familienrecht, 6-о изд. 2022 г., Раздел 1671, полева бележка 33.“ Номер на изданието, параграф, полева бележка – всичко е професионално форматирано.

Всичко е измислено.

Констатацията на съда: Цитираният източник не съществува. Чатботът очевидно е смесил три различни публикации. Имената на авторите, заглавията на антологиите и номерата на изданията са били комбинирани, без изобщо да се проверява дали принадлежат към един и същ източник. Твърдяха се правни принципи, които никога не са били установявани в литературата или в съдебните решения. Чатботът е генерирал правдоподобно звучащи, но напълно неоснователни цитати, а адвокатът ги е представил без проверка.

Това не е изолиран инцидент. През септември 2025 г. Регионалният съд във Франкфурт на Майн се произнесе по подобен случай: три предполагаеми решения на Федералния върховен съд, всичките измислени. Съдът реагира недвусмислено, като обвини адвоката в застрашаване на правораздаването. Ясен сигнал. 

Тези случаи разкриват какво наистина има значение при използването на изкуствен интелект в правната сфера: решителна е не скоростта на отговорите или елегантността на потребителския интерфейс, а надеждността на базовите данни. 



Когато изкуственият интелект халюцинира: Два случая от практиката

Случаите във Франкфурт и Кьолн показват общ модел: адвокатите са се доверили на генерирани от ИИ цитати, без да ги проверят. Резултатът са писмени становища, пълни с прецизно звучащи, но изцяло измислени цитати. Това, което технически е известно като халюцинация – феноменът, при който езиковите модели генерират правдоподобно звучаща, но невярна информация – тук доведе до незабавни правни последици. Съдилищата заклеймиха този подход с остри думи като злоупотреба и застрашаване на правораздаването.

Проблемът не се дължи единствено на адвокатите, които са нарушили задължението си за дължима грижа, но по същество и на технологията, която са използвали. Общите езикови модели – системи като ChatGPT или Claude, обучени с текстове от отворения интернет – не са проектирани да обработват надеждно специализирано правно съдържание. От техните огромни бази данни за обучение само минимална част се състои от правни текстове, а от нея още по-малка част включва германски правни документи. Те могат да разпознават модели и да генерират убедително звучащ текст, но не разбират нито присъщата систематична структура на правото, нито фините, но критични семантични различия в юридическия език, нито значението на прецизността в правната работа. 


 

Какво всъщност означава качеството на данните в правната практика

Качеството на данните в правната сфера означава много повече от техническа чистота или самия обем на наличните документи. Става въпрос за пет централни измерения, които трябва да работят заедно, за да може правният ИИ да предоставя надеждни резултати.


  • Релевантност. Не всяко решение има значение за всеки въпрос. Висококачествената правна база данни трябва да може да прави разлика между водещи решения и периферни съдебни актове, между настоящи и остарели съдебни решения, между решения на по-долни инстанции и прецеденти на върховния съд. 


  • Пълнота. Едно отделно решение може да бъде точно възпроизведено, но каква полза от това, ако липсва противоположното становище, ако не се вземат предвид последващите решения, ако е изключена доктриналната класификация от литературата? Правната работа се основава на претегляне, сравняване и систематично навлизане в правния проблем. Непълната база от данни възпрепятства точно това. 


  • Прецизност. Номера на дела, цитати, полеви бележки – правните препратки следват строги конвенции, защото само това гарантира възможността за проверка. Система, която не гарантира тази прецизност, е неизползваема за правната практика, независимо колко красноречиви на пръв поглед изглеждат отговорите. 


  • Контекстуализация. Едно съдебно решение разкрива значението си само в съчетание с литература, коментари, законодателни материали и индикация дали е било заменено от по-ново решение. Изолираната обработка на текстове на дела не създава правна сигурност, а крехка база от знания. 


  • Актуалност. Правото непрекъснато се развива. Решение, валидно вчера, днес може да е остаряло. Правният ИИ трябва не само да има достъп до текущи данни, но и да разпознава кога, защо и как се е променила правната ситуация. 




Защо само съдебните решения не са достатъчни

Много доставчици на правен ИИ се фокусират върху събирането и улесняването на търсенето в колкото се може повече съдебни решения. Това звучи като разумен подход, но е само половината от битката. Едно съдебно решение не е изолиран факт, а част от сложен правен дискурс.

Вземете за пример дело за неправомерно уволнение по трудово право. Само по себе си съответното решение на Федералния върховен съд може да даде представа по конкретен въпрос. Но как литературата класифицира това решение? Има ли несъгласни гласове? Какви последици извлича коментарната литература за договорната практика? Дали решение на по-долна инстанция е приложило насоките на Федералния върховен съд или се е отклонило от тях? Едва когато може да се отговори на всички тези въпроси, се появява пълна картина на правната ситуация.

Именно тук се отличават утвърдените правни издателства. Платформи като beck-online предоставят не само съдебни решения, но и коментари, законодателни материали, статии от списания и практически наръчници. От решаващо значение тук е постоянната редакционна поддръжка и свързването на съдържанието от страна на правни специалисти. Само тази структура позволява съдебните решения да бъдат разбрани в техния доктринален и практически контекст. 

 


Пътят към надежден правен ИИ

Привличането на общите езикови модели е разбираемо. Те са лесно достъпни, лесни за използване и предоставят отговор на почти всеки въпрос. Те обаче пренебрегват сложните особености на правните текстове и подлежат на постоянно изискване за актуализиране, което не могат да изпълнят без специализирана поддръжка.

Модерните технологии като Retrieval-Augmented Generation (RAG) представляват значителен напредък. Вместо да генерират отговори изключително от обучителния материал на езиковия модел, RAG системите извличат подходящи документи от база данни и ги интегрират в отговора. Това значително намалява халюцинациите – но само ако базовата база данни е висококачествена, актуална и изчерпателна.

RAG система, която има достъп само до непълна или лошо поддържана база данни със съдебни решения, може да функционира технически безупречно и въпреки това да предоставя неизползваеми резултати. Качеството на данните определя качеството на отговора. Без значение колко е усъвършенстван, ИИ алгоритъмът не може да компенсира липсващо или неточно съдържание. 



Как модерният правен ИИ създава надеждност

Добрият правен ИИ е насочен именно към тази точка. Той съчетава висококачествено, редакционно поддържано специализирано съдържание с модерна ИИ технология, създавайки отговори, които не са просто генерирани, а могат да бъдат проверени. Всяко твърдение е документирано с конкретен източник – съдебно решение, коментар, статия. Потребителите могат веднага да проследят откъде идва информацията и сами да решат дали да се доверят на източника.

Тази прозрачност и възможност за проследяване не е техническа характеристика, а основно условие за използване на правния ИИ в практиката. Едва когато адвокатите, правните отдели и съдилищата могат да разберат основата, на която ИИ предоставя своите отговори, може да се развие доверие. И само с това доверие правният ИИ се превръща в инструмент, който не замества правната работа, а предоставя солидна подкрепа.

Урокът от случаите във Франкфурт и Кьолн е ясен: Пътят от съдебните решения до правната сигурност минава само в една посока: през висококачествени данни. Едва когато специализираното правно съдържание се поддържа непрекъснато, структурира и свързва с ИИ методи като RAG, се появява инструмент, който надеждно подпомага практиката. Всичко останало остава непълно и излага на риск не само клиентите, но и доверието в правовата държава. 


Максимилиан Деткен

Съдържание

Всички права запазени Noxtua AG ©

Всички права запазени Noxtua AG ©