1 open role mentioning 3D
Stability AI
We are seeking a Research Scientist with deep expertise in training and fine-tuning large Vision-Language and Language Models (VLMs / LLMs) for downstream multimodal tasks. You will be instrumental in advancing models that reason across vision, language, and 3D, translating research breakthroughs into scalable engineering solutions. This role involves designing and fine-tuning large-scale VLMs/LLMs and hybrid architectures for complex tasks like visual reasoning, retrieval, 3D understanding, and embodied interaction.