RynnBrain 1.1-2B — Embodied AI Vision-Language Model

A compact 2B parameter VLM by Alibaba DAMO Academy specialized in embodied intelligence, visual grounding, spatial reasoning, and robotic planning. Upload an image, give an instruction, and the model will respond — including bounding-box coordinates when asked for grounding.

Model card

Examples