2026年8月21日,DeepSeek正式上线V4系列多模态视觉模型DeepSeek-V4-Flash-Vision-Exp(视觉实验版),为首款具备图像理解能力的模型,补齐此前仅支持文本处理的短板。支持JPEG/PNG/GIF/WebP四种图片格式,可Base64/公开URL/Files API上传,单次请求最多输入600张图、最长边8192像素、单张最大64MiB;具备图像识别、图表分析、截图文字提取等能力。基于V4-Flash纯文本模型开发,纯文本推理性能与标准版持平,多模态Agent任务能力大幅跃升、官方称逼近Claude Opus 4.8。支持low/original/auto三种图片细节模式,单张图最多折算384 Token、计费与文本Token一致。已在DeepSeek API平台开放调用,手机端同步上线’识图模式’。
© 版权声明
文章版权归作者所有,未经允许请勿转载。
相关文章
暂无评论...



