harveyai/harvey-labs
評估大型語言模型代理人在法律工作中能力的基準測試,包含任務資料集與執行框架。 A benchmark built to evaluate and improve agent capabilities for supporting legal work.
查看原圖 Open original 上榜紀錄 Trending history
- 2026-08-12 每日 Daily #13
- 2026-08-10 每日 Daily #11
評估大型語言模型代理人在法律工作中能力的基準測試,包含任務資料集與執行框架。 A benchmark built to evaluate and improve agent capabilities for supporting legal work.
查看原圖 Open original