Models / JonnyYu828 / DepthVLM-4B

DepthVLM-4B

JSON →
multimodal

A vision-language model with 4 billion parameters for depth-aware visual reasoning and question answering.

imagetextvisionreasoning
Specs
Context & limits
context window
max output
Lifecycle
Dates
released2024-08-01
Resources