文章配图-1 一个礼拜前,美国法律科技公司Harvey在X上官宣了一则消息:隆重推出基于Kimi K3训练的首个自有模型Harvey Tenet。 消息一出,迅速在AI圈掀起了一场波澜。 基于开源模型后训练的事已经屡见不鲜。早在3月份,Cursor的自研编程模型Composer 2,就被扒出是基于Kimi K2.5训练的;DoorDash、Airbnb等企业,也纷纷部署开源模型进行“降本”。 为何一家法律科技公司的“自有模型”,在国内外引发了如此大的关注?答案在于:Harvey可能是最不应该选择中国模型的AI公司。 诞生于2022年的Harvey,先后获得了OpenAI、红杉资本、a16z等机构的注资,市场估值已经达到110亿美元,全球75家以上Am Law 100律所都是Harvey的客户。而且Harvey的产品原型就是建立在OpenAI模型上的,双方还曾合作训练面向美国判例法的定制模型。 正是这样一家被视为OpenAI“亲儿子”的公司,在训练自己的第一款基础模型时,选择以中国的开源模型为底座。 OpenAI的“亲儿子”,为什么要独立求生? Harvey与OpenAI的关系,远非寻常的“投资者与被投资者”。 一位创始人曾是证券和反垄断律师,另一位创始人有过DeepMind和Meta的工作经历。两人最初只是用GPT-3测试法律问答,随后获得了OpenAI Startup Fund领投的500万美元种子融资。 在Harvey的早期故事里,OpenAI既是资本来源,也是最重要的技术靠山。 到了2023年,Harvey完成8000万美元B轮融资时,OpenAI和红杉资本继续参与。Harvey在融资公告中明确表示,公司正在与OpenAI合作开发面向专业服务行业的领域模型。 双方的分工一度非常清晰。 OpenAI负责提供越来越强的通用模型,Harvey负责理解律师、法律文件和律所工作