Chip Insight 資料庫

#GPT-5

找到 2 篇文章

為什麼 GPT-5、Gemini 都輸給公證人?真正卡住 AI 的不是法律,而是「規劃能力」(下)

雖然 Gemini 2.5 Pro 與 GPT-5 已能在律師與法官考試中超越人類,但四個大型語言模型在義大利公證人考試中全數落敗。研究指出,問題並非法律知識不足,而是目前 LLM 仍缺乏長期規劃、風險預測與法律設計能力,這也可能是下一代 AI Agent 必須突破的關鍵。

晶片觀測站·1 個月前
7 min

GPT-5、Gemini 能考贏人類律師?一場真正的法律圖靈測試揭露 AI 的極限(上)

最新研究以義大利律師、法官與公證人國家考試為基礎,透過雙盲圖靈測試比較 GPT-5、Gemini 2.5 Pro、Claude 4 Opus 與 DeepSeek R1 的表現。結果顯示,Gemini 2.5 Pro 已能在律師與法官考試中超越頂尖人類考生,但所有模型仍無法通過最需要法律規劃能力的公證人考試。

晶片觀測站·1 個月前
6 min