先说几个核心判断:近期AI行业迎来重要更新——Refly平台正式上线了多模型能力的全面升级。这次版本迭代覆盖大语言模型、代码推理、多模态生成等多个方向,可以说是一次集大成式的能力整合,值得开发者与内容创作者重点关注。
具体而言,本次升级的亮点包括:Claude Opus 4.1在代码理解与Agent任务中展现出突破性表现、GPT-OSS开源大模型系列支持商业使用与二次开发的高度灵活性,以及Qwen-Image专为图文混排场景打造的智能视觉生成能力。

Refly x SOTA 模型
从能力分布来看,这次更新可以归纳为以下几个方向:
Claude Opus 4.1——编程能力再度进阶。在开发者高度关注的代码理解领域,这一次升级对Agent任务完成度的提升令人期待。如果你之前体验过Claude系列的代码生成能力,这次的新模型值得重新尝试。
Qwen-Image——主打文字理解与图文混排。简单来说,在需要将文字描述转化为视觉元素的场景中,它的准确性有了显著提升。尤其对于图文混排这类过去容易出错的任务,这个模型提供了一个更可靠的解决方案。好比以前让AI理解“红色小狗在草地上”可能需要反复调整提示词,现在它基本能一次到位。
Flux-Krea——输出图像的“AI感”明显减弱,整体质感更接近实拍照片或手绘插画。这个说法听起来有些抽象,但如果你见过以前图像生成中常见的“水印感”或“塑料感”,就能理解这次升级的实际价值。
Wan 2.2——在短片段生成领域表现突出,可以说是把提示词真正“拍”成了短片。对于想要进行视频叙事实验的团队,这个工具值得尝试。
ElevenLabs——语音合成同样在升级列表之中。它可以将文本转化为更自然的对白,尤其是语调和停顿的处理更加接近真人发声。如果你对AI配音有较高要求,这是目前比较值得关注的方案之一。
总体来看,这次更新不仅是模型数量的增加,更是能力生态的全面补全。从代码到图像,从视频到语音,覆盖链条越来越完整。对于开发者和内容创作者而言,这意味着更多选择空间和更少妥协代价。
