Harvey公司发布了其首个后训练模型Harvey Tenet的研究预览版。该模型基于Kimi K3基础模型,通过Fireworks平台采用异步强化学习技术,针对长周期法律工作场景进行专门训练。训练语料结合了合成数据、公开法律数据和人类专家数据,未使用客户数据。在Harvey的Legal Agent Benchmark上,Tenet完成的任务量几乎是基础K3模型的两倍,在LAB: Contracts子集上提升20%,全通过率分别提高9个和2个百分点,达到该子集最优水平。这些能力还迁移至其他基准测试。Harvey表示暂不部署,未公开权重或API,但计划逐步将成果整合进产品。其目标是为法律行业构建前沿智能,并让律所拥有专属定制模型的路径。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅