DeepSeek-V4-Flash-Vision-Exp deepseek-ai

Typ
model
Lizenz
mit
Aufgabe
image-text-to-text
Framework
transformers
Downloads
0
Likes
259
Parameter
304,646,824,126
Zugriff
public
Dateien
84

Tags

  • 多模态
  • 视觉模型
  • 大语言模型
  • Agent
  • 多模态生成
  • transformers
  • 推理部署

Zusammenfassung

Dieses experimentelle Modell erweitert die DeepSeek-V4-Flash-Architektur um visuelle Module und trainiert diese weiter, um visuelles Verständnis freizuschalten. Es verbessert die multimodalen Agentenfähigkeiten erheblich gegenüber der Basisversion, während es bei reinen Text-Agenten-Aufgaben vergle…

README

--- license: mit library_name: transformers pipeline_tag: image-text-to-text --- # DeepSeek-V4-Flash-Vision-Exp <!-- markdownlint-disable first-line-h1 --> <!-- markdownlint-disable html --> <!-- markdownlint-disable no-duplicate-header --> <div align="center"> <img src="https://github.com/deepseek…

查看完整页面 · 查看原文