DeepSeek视觉理解模型性能逼近Opus 4.8

中国人工智能(AI)企业深度求索(DeepSeek)推出一款能够理解视觉提示的实验性AI模型,称该工具的性能逼近美国竞争对手Anthropic PBC的一款高阶模型。

综合彭博社和华尔街见闻报道,总部位于杭州的DeepSeek星期五(8月21日)上线实验性视觉理解模型V4-Flash-Vision-Exp,新增图像理解能力并保持原有文本性能。

DeepSeek在X平台写道:“这款实验性多模态模型在文本能力方面与DeepSeek-V4-Flash相当 ,包括智能体(agent)、推理和世界知识。”

DeepSeek续称,在多模态智能体能力测试中,该模型的表现“接近”Anthropic的高阶模型Opus 4.8。

多模态智能体能力是指模型无需持续监督或提示即可采取行动。

DeepSeek此前曾发布DeepSeek-VL系列等多模态和视觉模型。但这款名为DeepSeek-V4-Flash-Vision-Exp的新模型为DeepSeek最先进的模型系列,增加了图像理解和执行任务能力。用户可以通过DeepSeek的应用编程接口(API)使用该模型。

在API计费方面,V4-Flash-Vision-Exp沿用V4-Flash的定价。图片输入将转换为token计费,单张图片最多占用384个token。

DeepSeek上周发布新模型V4 Pro正式版,该版本的多项智能体能力大幅提升,据指性能已逼近Anthropic的前沿模型Claude Fable 5

中国企业与美国开发商正在AI前沿领域展开激烈竞争,中国模型往往能以低得多的价格提供相近的性能。

您查看的内容可能不完整,部分内容和推荐被拦截!请对本站关闭广告拦截和阅读模式,或使用自带浏览器后恢复正常。