讯飞星火正式向开发者开放了大家期待已久的API长上下文版本——Spark Pro-128K大模型,每万tokens的调用费用直接压到了0.21元起。
大模型和人对话时的"记忆"本质上就是上下文。你和他聊得越长,他能记得的信息上限就越高。一旦对话长度超过了这个容量,前面的内容大概率就会被"遗忘",这和人类短时记忆的机制很像。
而长文本模型,就是为了搞定这个问题而生的。和传统模型不同,它天生更适合处理超长对话、完整创作长篇内容、做详细的深度数据分析——这可不是简单的硬塞更多文本,它更能理解这些信息之间的内在逻辑,局部的细节和全局的脉络,都能兼顾到位。这种能力直接拓宽了模型解决问题的真实边界。
此前的6月27日,讯飞星火4.0版本已经正式发布。升级的最大亮点之一就是长文本能力,而且星火团队还专门针对长文档问答容易出现的"幻觉"问题,做了个值得注意的改动——首次加入了内容溯源功能。也就是说,当你向星火提问,它回答之后,会同步告诉你这个结论是从哪一段内容参考过来的。如果你没时间细读全文,又担心生成结果是否"自说自话",只需要对照溯源信息自己看一眼就行。这个设计非常实用,相当于让模型随时亮出自己的"引用来源"。

现在,Spark Pro-128K版本已经正式面向开发者开放API调用。价格也很明确:每万tokens收费0.21元起步,最高0.30元。对于个人用户,官方还专门提供了200万tokens的免费额度。在这个大模型集体"卷能力"的当下,开源与技术普惠,正在加速把更多可能性的交到开发者手里。
