OpenAI 發布 Astra for Law,結合 GPT-6 Astra、法律搜尋索引與客製指令,測試正確率從 38.7% 衝上 54.0%。Sullivan & Cromwell、Cooley 等大所已匯入客製工具,Harvey、Legora 將串接 API。
(前情提要:ChatGPT 捏造證詞:美國律師被判藐視法庭開罰,謀殺案上訴被迫重來)
(背景補充:算力不夠?使用者曝在 Codex 選 GPT-6 Astra 模型卻全程跑 GPT-5.5)
在Vals AI 的 Legal Research Bench 私有驗證集裡,普通 GPT-6 Astra 靠網路搜尋作答,正確率只有 38.7%;換上專門包裝過後的「Astra for Law」,同一批 200 道美國法律研究題,正確率跳到 54.0%,相對提升 40%。撐起這個數字的,是一個涵蓋 2.3 億個網址、每天都在新增資料的判例法規索引。
OpenAI 在週四發布的官方公告裡表示,Astra for Law 不是一款全新模型,而是把 GPT-6 Astra、一套法律搜尋索引、以及一組客製化的法律分析與寫作指令,三者打包成同一套「法律 AI 基礎」。
一張攤開的判例地圖
法律搜尋索引可檢索美國判例法、成文法、法規、法院規則與行政裁決,規模超過 2.3 億個網址。
其中最關鍵的一塊,來自非營利組織 Free Law Project 旗下的 CourtListener,OpenAI 在官方公告中表示,這項合作讓索引涵蓋超過 99.9% 已公開的美國具先例效力判例。換句話說,過去律師得靠 Westlaw、Lexis 這類收費資料庫才查得到的判例,如今被打包進了聊天機器人的搜尋工具裡。
找得更準,寫得更深
在這 200 道題目裡,聚焦判例的題目上,Astra for Law 比單用網路搜尋的 GPT-6 Astra 多找到 24% 的參考案例;在人工審核過的目標段落集合中,最多能多檢索到 54% 的相關段落。
OpenAI 在官方公告中給出一則對照:面對「找出最接近先例並撰寫備忘錄」的同一提示,Astra for Law 準確辨識出兩起貼近事實的判例;對照組 Claude Fable 5.1 在訴訟情境題目中引用了一起已被上訴推翻的判決,交易情境題目中則回報找不到相符案例。
找到判例只是第一步。OpenAI 在官方公告中說明,系統內建的法律分析與寫作指令,會協助模型把研究結果套進客戶的具體事實,區分判決理由與旁論,處理對己方不利的判例,或解釋合約除外條款如何在雙方之間轉移風險。
律所自己動手做的工具
三家美國大型律所已把 Astra for Law 嵌進日常作業。
- Sullivan & Cromwell 打造協議分析工具,把自家談判劇本與判例庫接進合約審閱,協助律師揪出條款疊加後的風險,自動產出改稿建議
- Ropes & Gray 建立盡職調查系統,協助律師在資料室裡追出可能影響併購案的關鍵問題,例如客戶合約是否需要通知或同意
- Cooley 做出名為 GO Public 的工具,把資本市場經驗接進上市準備流程,交易條件一改動,風險就同步反映到申報檔案。
生態系部分,OpenAI 在官方公告中提到已與 26 家外掛開發商合作,把 ChatGPT 接進律所常用工具,包括 Relativity、Clio、iManage、Intapp 與 DeepJudge;湯森路透則把 HighQ 案件管理系統接進 ChatGPT,並預告即將推出 CoCounsel Legal 聯結器。
另有社群開發者提供的 9 個外掛、47 項技能供律師呼叫。ChatGPT for Word 也同日正式開放。API 客戶 Harvey、Legora 已確定會把 Astra for Law 接進自家產品。
掛牌名稱與信任門檻
Astra for Law 將先以「Trusted Access」計畫,提供給經篩選的律所使用,適用於 ChatGPT Enterprise 與 Codex,之後才開放 API。
法律科技媒體 LawSites 報導,初期開放物件鎖定 Am Law 200,也就是美國營收排名前 200 大律所,定價尚未公布。在 ChatGPT 模型選單裡,它叫「GPT-6 Astra Law」;API 裡則叫 gpt-6-astra-law。
OpenAI 在官方公告中表示,符合資格的律所可取得 API 端零資料保留協議(Zero Data Retention,即 ZDR,指使用紀錄不會被儲存或用於訓練),ChatGPT Enterprise 使用紀錄也預設不受人工審閱。治理上,OpenAI 正與 Latham & Watkins 合作設計資訊許可權、隔離牆、客戶指示與律所監督機制;也與 Wachtell, Lipton, Rosen & Katz 合作,把該所訴訟與公司法專長接進前沿研究。
數字背後,還有幾道沒解開的題
不過,這組對照數字目前仍是 OpenAI 自己在官方公告中評測的示範,不是第三方重現結果。另一方面,54.0% 的正確率,代表接近一半題目 Astra for Law 依然答不到位,這在講究一字之差就能左右官司輸贏的法律工作裡,還不是能讓人完全放心的分數。
法律圈對 AI 幻覺的戒心也並非空穴來風。就在這則公告發布前幾天,美國新墨西哥州一名律師才因為用 ChatGPT 生成內容裡包含捏造證詞,被法官依藐視法庭裁罰。OpenAI 在官方公告中強調「可靠的權威資料來源,律師可自行查核」,但查核責任終究落在人身上。
📍相關報導📍
OpenAI 公開 Astra 精選作品:80 款網站、App、遊戲一鍵複製

