估值60亿美元、背后有微软站台的法国AI初创公司Mistral,日前放出了自己的首个编程专用生成式AI模型——Codestral。
这款模型的目标很明确:帮开发者写代码、跟代码打交道。它支持80多种编程语言,从Python、Ja va到C++和Ja vaScript,基本覆盖了主流选择。Mistral官方表示,Codestral能完成代码补全、编写测试、填充代码片段,甚至可以用英语回答关于代码库的问题。

虽说Mistral自称模型是“开放的”,但它的许可证可一点都不开放——禁止任何商业用途,只允许在“开发”过程中使用。更严格的是,员工在公司业务活动中的内部使用也被明确禁止。这很可能是训练数据里包含了受版权保护的内容。
Codestral拥有220亿个参数,想跑起来得有一台性能足够强悍的电脑。在部分基准测试中,它确实击败了竞争对手,但这些测试的可靠性本身还有争议。所以,Codestral真正的实用价值如何,还得打个问号。
根据2023年6月Stack Overflow的调查,44%的开发者已经在工作中使用AI工具,还有26%打算很快跟进。不过,这些工具并非完美无缺。GitClear分析了过去几年里1.5亿多行代码提交记录,发现生成式AI开发工具反而导致更多错误代码被推送进仓库。
普渡大学的一项研究更直接:ChatGPT对编程问题的回答中,超过一半是错的。
就在今天上午,Mistral已经在自己的对话式AI平台Le Chat和付费API上推出了Codestral的托管版本,接下来还打算把它整合到LlamaIndex、LangChain、Continue.dev和Tabnine等主流开发框架和环境中。
