DeepSeek推出一款能够理解视觉提示的实验性人工智能(AI)模型,表示该工具的性能逼近美国竞争对手Anthropic PBC的一款高阶模型。
这家总部位于杭州的公司8月21日表示,新发布的是DeepSeek旗舰纯文本模型V4 Flash的实验版本,新增了多模态能力,这意味着它还可以分析图像和屏幕截图等视觉提示并采取行动。
“这款实验性多模态模型在文本能力方面与DeepSeek-V4-Flash相当 —— 包括智能体、推理和世界知识,”该公司在X上写道。
DeepSeek表示,在多模态智能体能力测试中,该模型的表现“接近”Anthropic的高阶模型Opus 4.8。多模态智能体能力是指模型无需持续监督或提示即可采取行动。
DeepSeek此前曾发布DeepSeek-VL系列等多模态和视觉模型。但这款名为DeepSeek-V4-Flash-Vision-Exp的新模型为其最先进的模型系列增加了图像理解和执行任务的能力。用户可以通过DeepSeek的API使用该模型。
中国企业与美国开发商正在AI前沿领域展开激烈竞争,中国模型往往能以低得多的价格提供相近的性能。
与此同时,Anthropic PBC已聘请谷歌定制芯片项目创始人Amir Salek,为这家AI实验室进军自研半导体领域做准备。
这家Claude平台开发商8月21日表示,Salek将加入Anthropic的算力团队,并向James Bradbury汇报。Salek曾负责谷歌的张量处理单元(TPU)业务直至2022年,并参与推出了前七代TPU芯片。
Anthropic目前从英伟达、谷歌和亚马逊等多个供应商采购芯片,但近期已释放出建立自有芯片业务的意愿。这家总部位于旧金山的公司已开始为相关项目招聘,并发布职位信息。
与其他AI巨头一样,Anthropic正加紧获得足够的数据中心基础设施,以支撑其发展目标。自研芯片有望帮助公司应对供应短缺,同时根据自身需求定制芯片设计。
竞争对手OpenAI也在采取类似行动。这家ChatGPT开发商已发布与博通共同开发的Jalapeno芯片,并计划今年晚些时候开始使用。