Home Projects cambrian-s
cambrian-s
Python

cambrian-s

Cambrian-S: Towards Spatial Supersensing in Video

by cambrian-mllm · GitHub
Stars
Forks
License
Created
Last commit
Language
computer-visionllmmultimodal-large-language-modelsApache-2.0Python
View on GitHub
In plain words

Access and utilize a dataset for improving video understanding and spatial awareness in AI models.

You maintain this project?

Claim its page: indexed whatever its rank, translated into six languages, and enriched with what you write yourself.

Claim this page →
cambrian-s — GitHub preview card
📈 Star history
561560
2026-07-202026-08-31
📈 Track cambrian-s

Get an email alert on its next release or when it starts trending — never miss the moment.

Free · no card · unsubscribe anytime
Get email alerts →
📄 About

Cambrian-S: Towards Spatial Supersensing in Video

cambrian-s has 560 stars on GitHub. It has been forked 20 times. cambrian-s is written mainly in Python. It has been in active development since 2025. cambrian-s is available under the Apache-2.0 license. Its main topics are computer-vision, llm, multimodal-large-language-models, spatial-understanding.

Frequently asked questions

What is cambrian-s?

Cambrian-S: Towards Spatial Supersensing in Video

Is cambrian-s open source?

cambrian-s is an open-source project. It is released under the Apache-2.0 license.

Is cambrian-s free?

Yes. cambrian-s is free and open source — you can use, modify and self-host it.

What license does cambrian-s use?

cambrian-s is available under the Apache-2.0 license.

What language is cambrian-s written in?

cambrian-s is written mainly in Python.

🏅 Maintainer of this project?
olud.ai badge — cambrian-s

Add this live badge to your README — your GitHub stars and directory rank, refreshed daily.

[![olud.ai](https://olud.ai/badge.php?tool=cambrian-mllm-cambrian-s)](https://olud.ai/project/cambrian-mllm-cambrian-s.html)
More badge options →
🧬 Shares DNA with🧬 View the DNA map →
Awesome-Medical-Large-Language-Models
Curated papers on Large Language Models in Healthcare and Medical domain
390 · large-language-models
sharesmultimodal-large-language-models
Spatial-MLLM
[NeurIPS 2025 Spotlight] Official implementation of Spatial-MLLM: Boosting MLLM Capabilities in…
477 · aigc
sharesmultimodal-large-language-models
Ovis-U1
An unified model that seamlessly integrates multimodal understanding, text-to-image generation,…
450 · image-editing
sharesmultimodal-large-language-models
Ovis
A novel Multimodal Large Language Model (MLLM) architecture, designed to structurally align vis…
1.5k · chatbot
sharesmultimodal-large-language-models
star-vector
StarVector is a foundation model for SVG generation that transforms vectorization into a code g…
4.6k · llm
sharesmultimodal-large-language-models
RPG-DiffusionMaster
[ICML 2024] Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Mult…
1.8k · image-editting
sharesmultimodal-large-language-models
AudioStory
AudioStory: Generating Long-Form Narrative Audio with Large Language Models
301 · audio-generation
sharesmultimodal-large-language-models
VisionReasoner
[ICLR 2026] VisionReasoner: Unified Reasoning-Integrated Visual Perception via Reinforcement Le…
348 · counting-objects
sharesmultimodal-large-language-models
OmniVinci
OmniVinci is an omni-modal LLM for joint understanding of vision, audio, and language.
677 · audio-language-model
sharesmultimodal-large-language-models
LLaVA-Plus-Codebase
LLaVA-Plus: Large Language and Vision Assistants that Plug and Learn to Use Skills
770 · agent
sharesmultimodal-large-language-models

Measured from GitHub topics shared by both projects, weighted by how rare each topic is.