DeepSeek 推出 V4-Flash-Vision-Exp 多模態 API,強化視覺理解與智能體表現

DeepSeek 發布 V4-Flash-Vision-Exp 多模態 API,提升多模態代理基準表現。

• DeepSeek 官方正式宣佈推出全新 DeepSeek-V4-Flash-Vision-Exp 實驗性多模態模型,並已在 API 平台全面上線。 • 此模型在保持文字能力不變的同時,大幅提升了多模態智能體(Multimodal Agent)的效能,表現直逼 Opus-4.8。 • 開發者只需將模型參數設為 deepseek-v4-flash-vision-exp 即可輕鬆呼叫,且 DeepSeek Harness 0.1.1 已同步提供原生支援。 • API 完整支援文字與圖片的混合輸入,圖片支援透過 base64、外部 URL 或全新的 Files API 進行傳輸。 • 同步登場的 Files API 提供免費使用,允許開發者上傳一次圖片後透過 file_id 重複引用,有效節省請求頻寬。 • 圖片計費方式採用 Token 化計算,每張圖片最多消耗 384 個 token,並維持與 V4-Flash 相同的高性價比定價。

結合強大視覺理解與豐富工具支援,多模態技術將解鎖更多實務工作流程與智能體應用場景。


來源:DeepSeek

閱讀原文 ↗
← 回首頁