OpenAI ogłosiło premierę Astra for Law – konfiguracji swojego najnowszego modelu GPT-6 Astra, dostosowanej specjalnie do potrzeb branży prawniczej. Kluczowym elementem ogłoszenia nie jest jednak sam model, lecz to, co znajduje się pod nim: własny indeks wyszukiwania prawnego obejmujący orzecznictwo, ustawy, regulacje i decyzje administracyjne Stanów Zjednoczonych. To strategiczny krok, który może na nowo zdefiniować układ sił na rynku technologii prawniczych.
Nowy indeks prawny i model dla kancelarii
Podstawą oferty OpenAI jest zbudowany od podstaw indeks wyszukiwania prawnego. Obejmuje on ponad 230 milionów adresów URL, a źródła są aktualizowane codziennie. Znaczna część orzecznictwa pochodzi z Free Law Project – organizacji non-profit stojącej za CourtListener. Według zapewnień OpenAI kolekcja ta pokrywa ponad 99,9% opublikowanego precedensowego orzecznictwa amerykańskiego.
Firma podkreśla, że jej indeks ma charakter komplementarny wobec licencjonowanych treści i specjalistycznych produktów, z których korzystają kancelarie – takich jak rozwiązania Thomson Reuters. Sam model GPT-6 Astra został skonfigurowany z wyszukiwarką prawną, instrukcjami dotyczącymi analizy i pisania tekstów prawnych oraz mechanizmami kontroli przeznaczonymi dla firm prawniczych. Wybrane kancelarie otrzymują do niego dostęp w pierwszej kolejności w ramach programu Trusted Access w ChatGPT i Codex. Udostępnienie przez API ma nastąpić później, pod nazwą gpt-6-astra-law.
Wyniki testów i ich ograniczenia
OpenAI przetestowało nową konfigurację na 200 pytaniach prawniczych pochodzących z prywatnego zestawu walidacyjnego Legal Research Bench firmy Vals AI. Przy najwyższym poziomie rozumowania Astra for Law pomyślnie przeszła ogólną weryfikację poprawności w 54,0% przypadków. Dla porównania, sam GPT-6 Astra z wyszukiwaniem internetowym osiągnął wynik 38,7%. OpenAI przedstawia to jako względną poprawę o 40 procent.
Warto jednak zauważyć, że skonfigurowany system nie przechodzi weryfikacji poprawności w niemal połowie przypadków. W pytaniach dotyczących orzecznictwa Astra for Law znalazła o 24% więcej orzeczeń referencyjnych i pozyskała do 54% więcej istotnych fragmentów z właściwych opinii. Testy te są jednak wewnętrzne – przeprowadzone przez samo OpenAI. Firma opublikowała również własne porównanie z modelem Claude Fable 5.1, w którym twierdzi, że konkurencyjny model zacytował uchylone orzeczenie sądu apelacyjnego, a w innym przykładzie nie znalazł żadnego istotnego przypadku. Żadne z tych wyników nie zostały zweryfikowane przez niezależną stronę.
Ekosystem wtyczek i partnerstw
Razem z modelem OpenAI wprowadziło 26 wtyczek zbudowanych przez partnerów, które łączą ChatGPT z narzędziami już wykorzystywanymi przez kancelarie. Wśród nich znajdują się rozwiązania firm Relativity, Clio, iManage, Intapp i DeepJudge. Thomson Reuters wprowadza kontekst spraw z HighQ do ChatGPT i zapowiada konektor CoCounsel Legal. Dziewięć wtyczek społecznościowych od LegalQuants, LECG i Skills.law pojawia się wraz z 47 niestandardowymi umiejętnościami. ChatGPT for Word stał się tego samego dnia ogólnie dostępny.
Sześciu dostawców opublikowało swoje komunikaty w ciągu zaledwie piętnastu minut – iManage, Relativity, Consilio, Litera, Laurel i Everlaw. Pięć z nich zacytowało dokładnie tę samą wypowiedź Jasona Boehmiga, dyrektora generalnego OpenAI ds. branży prawniczej. Everlaw poszło najdalej, umożliwiając prawnikom zadawanie pytań o treść dowodów w sprawie, a nie tylko o metadane. Każdy z dostawców opisuje jednak przede wszystkim zasady zarządzania danymi i miejsce, w którym pozostaje subskrypcja – teraz, gdy pytania zadawane są gdzie indziej.
Reakcja rynku i pakiet zarządzania danymi
Harvey, wyceniany w tym miesiącu na 15,6 miliarda dolarów, oraz Legora, dążąca do wyceny 10 miliardów, również będą budować na Astra for Law poprzez API. Niko Grupen, szef działu badań stosowanych w Harvey, pochwalił precyzję cytowania w oświadczeniu opublikowanym przez OpenAI. Obie firmy to najlepiej finansowane spółki sprzedające AI prawnicze jako samodzielny produkt. Teraz będą budować na infrastrukturze dostarczanej przez firmę, która jednocześnie oferuje wyszukiwanie prawne bezpośrednio kancelariom.
OpenAI odpowiada na obawy dotyczące zarządzania danymi. Kancelarie zakwalifikowane do programu Trusted Access otrzymują Zero Data Retention w API. OpenAI domyślnie wyklucza wykorzystanie ChatGPT Enterprise do przeglądu przez ludzi. Firma współpracuje także z Latham & Watkins nad uprawnieniami do informacji, ścianami etycznymi, instrukcjami klientów i nadzorem kancelarii.
W miarę jak AI staje się coraz bardziej zaawansowana, rośnie również możliwość wdrażania jej w środowiskach wymagających rygorystycznego zarządzania, nadzoru i odpowiedzialności.
Michael Rubin, przewodniczący komitetu ds. strategii AI w Latham & Watkins
OpenAI umieściło swoich inżynierów bezpośrednio w kancelariach. Sullivan and Cromwell zbudowało analizator umów, który przenosi ich playbooki negocjacyjne do przeglądu transakcji. Ropes and Gray stworzyło system due diligence do pracy z data room. Cooley opracowało GO Public do przygotowań IPO. Wachtell, Lipton, Rosen and Katz współpracuje z OpenAI nad sprawami sądowymi i korporacyjnymi.
Ta sama strategia, inny sektor
OpenAI nie improwizowało tego ruchu. Tydzień wcześniej firma uruchomiła ChatGPT for Financial Services z danymi od S&P, LSEG, Moody’s i PitchBook. Model frontier, licencjonowane lub indeksowane dane, warstwa zarządzania, konektory partnerskie – prawo to ten sam szablon z innymi dokumentami. Google prowadzi własną wersję tej strategii, uruchamiając Gemini Enterprise for Legal w sierpniu z udziałem Freshfields, Cleary i Weil.
OpenAI nie ujawniło jednak ceny, listy kancelarii w programie Trusted Access ani terminu dostępności w Europie. Indeks wyszukiwania obejmuje wyłącznie prawo amerykańskie. Dla europejskich firm pytania o zarządzanie danymi są jeszcze bardziej złożone, a ogłoszenie ich nie podejmuje.
Kluczowe pytanie brzmi, jak interpretować strategię OpenAI. Z jednej strony firma daje branży prawniczej lepsze narzędzia, pozwalając specjalistom zachować ich domeny. Z drugiej – przejmuje kontrolę nad modelem, indeksem badawczym, powierzchnią dystrybucji i katalogiem wtyczek, podczas gdy specjaliści zachowują jedynie szafy na dokumenty. Obie interpretacje mogą być prawdziwe przez jakiś czas. Tylko jedna z nich jest stabilna długoterminowo.

