Skip to content
Closed
Show file tree
Hide file tree
Changes from all commits
Commits
Show all changes
74 commits
Select commit Hold shift + click to select a range
de7432f
adding readme, modeling and params files for dinov3
coder0143 Dec 11, 2025
0f5f9d4
added run and testing
coder0143 Dec 11, 2025
2c24d24
added readme and removed some basic imports
coder0143 Dec 11, 2025
4507250
removed ignore statement for ide
coder0143 Dec 11, 2025
078e933
Added colab link in markdown
coder0143 Dec 11, 2025
6ec2690
Merge branch 'main' into main
coder0143 Dec 12, 2025
5b1a81e
changed config and made changes wrt it, added all outputs, removed co…
coder0143 Dec 16, 2025
d818a67
adding more tests and some final changes
coder0143 Dec 16, 2025
0273b54
final changes to params
coder0143 Dec 16, 2025
a2e0241
fixed ruff based text formatting
coder0143 Dec 17, 2025
5c3d6c6
using random init torch model in test_outputs and removed run_model d…
coder0143 Dec 17, 2025
b0bb52f
using hf_hub constants for path and pre-commit done for ruff
coder0143 Dec 18, 2025
23d3c0a
updating tests
coder0143 Dec 20, 2025
ba596c5
rename test_outputs to be model specific
jenriver Dec 22, 2025
e410e74
Merge branch 'main' into main
jenriver Dec 22, 2025
e0d33b1
inital commit for qwen3vl
coder0143 Jan 1, 2026
039881c
removed initial commit
coder0143 Jan 1, 2026
0b8e32e
vjepa2 base fm, classifier and params done
coder0143 Jan 6, 2026
0e1b4ca
fixed params and testing for model porting
coder0143 Jan 6, 2026
259c8a2
updating for additional testing and stability
coder0143 Jan 6, 2026
542350b
more testing, ruff, classifier works well
coder0143 Jan 6, 2026
48592d1
Merge branch 'main' into main
coder0143 Jan 6, 2026
b66d3dd
Merge branch 'jax-ml:main' into main
coder0143 Jan 8, 2026
63a53ea
fixed foundation model, reformatted modeling.py, fixed testing
coder0143 Jan 9, 2026
ff2a152
adding readme
coder0143 Jan 9, 2026
8da697d
name in readme 😅
coder0143 Jan 9, 2026
450f8a8
initial commit for qwen3-vl
coder0143 Jan 10, 2026
7858ed1
rename to qwen3_vl
coder0143 Jan 10, 2026
96c1439
some more changes
coder0143 Jan 10, 2026
5067fd9
tests fix
coder0143 Jan 14, 2026
b530298
changes for other folder for conflict
coder0143 Jan 15, 2026
8be6b41
Model works well
coder0143 Jan 17, 2026
094832e
done!
coder0143 Jan 19, 2026
206c991
vae implementation (#122)
eari100 Jan 12, 2026
dab4da4
Refactor tutorial to use dataclass for configuration (#119)
Aatman09 Jan 15, 2026
d56e624
Fixed resnet link in README (#127)
vfdev-5 Jan 16, 2026
80834cb
Vjepa2 format fixes (#128)
jenriver Jan 16, 2026
6056d48
[CI] run_selective_tests: handle renamed paths (#129)
jenriver Jan 16, 2026
824c56a
remove dinov3 output class to facilitate jit compilation
coder0143 Jan 17, 2026
df7bb07
Merge branch 'jax-ml:main' into feature/qwen3-vl
coder0143 Jan 19, 2026
6281617
some more test and run changes
coder0143 Jan 19, 2026
339c0e0
Adding Readme
coder0143 Jan 19, 2026
11f3b16
cleaning init
coder0143 Jan 19, 2026
1994a17
Added config for 32B
coder0143 Jan 20, 2026
9fe3006
Merge branch 'main' into feature/qwen3-vl
jenriver Jan 22, 2026
0cca8a2
Merge branch 'main' into feature/qwen3-vl
jenriver Jan 22, 2026
29003eb
readme, params, run_model changed
coder0143 Jan 23, 2026
22a819b
changes to modeling
coder0143 Jan 23, 2026
ed4f56b
fix (test)
coder0143 Jan 23, 2026
095c80a
fixed tests and added more
coder0143 Jan 23, 2026
1f5e429
using tempfile, more accuracy in tests
coder0143 Jan 23, 2026
9ea2bcb
Merge branch 'jax-ml:main' into feature/qwen3-vl
coder0143 Jan 27, 2026
73d300e
sharding!
coder0143 Jan 27, 2026
f25430f
updated sharding
coder0143 Jan 28, 2026
6e9f0d3
fix sharding for 8b
coder0143 Jan 28, 2026
01c1eda
updated tests
coder0143 Jan 28, 2026
87f1d50
fixes
coder0143 Jan 28, 2026
4a70b27
fix with debug
coder0143 Jan 28, 2026
933a3af
fix
coder0143 Jan 28, 2026
813aa64
final fixes
coder0143 Jan 28, 2026
61cbd73
tolerance
coder0143 Jan 28, 2026
d511429
Merge branch 'jax-ml:main' into feature/qwen3-vl
coder0143 Jan 28, 2026
506f47d
Updated readme
coder0143 Jan 28, 2026
e12c7f6
Merge branch 'main' into feature/qwen3-vl
jenriver Jan 30, 2026
cb57afc
changes to modeling
coder0143 Jan 31, 2026
1e03259
vision shd fix
coder0143 Jan 31, 2026
d5f5d35
undo
coder0143 Jan 31, 2026
1aa7f81
retry
coder0143 Jan 31, 2026
533618d
memory efficient tests
coder0143 Jan 31, 2026
bee40da
fixed modeling and tests
coder0143 Jan 31, 2026
5add4f9
Merge branch 'main' into feature/qwen3-vl
jenriver Feb 3, 2026
7ce0224
Merge branch 'main' into feature/qwen3-vl
jenriver Feb 5, 2026
bde722c
Merge branch 'main' into feature/qwen3-vl
coder0143 Feb 6, 2026
74d6396
Merge branch 'main' into feature/qwen3-vl
coder0143 Feb 9, 2026
File filter

Filter by extension

Filter by extension

Conversations
Failed to load comments.
Loading
Jump to
Jump to file
Failed to load files.
Loading
Diff view
Diff view
40 changes: 40 additions & 0 deletions bonsai/models/qwen3_vl/README.md
Original file line number Diff line number Diff line change
@@ -0,0 +1,40 @@
# Qwen3-VL in JAX

Copy link
Copy Markdown
Collaborator

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

Can you update this filename to README.md


This directory contains a pure JAX implementation of the [Qwen3-VL SOTA Vision Language Model](https://github.com/QwenLM/Qwen3-VL), using the [Flax NNX](https://flax.readthedocs.io/en/stable/index.html) API.


## Model Configuration Support Status

| Model Name | Config Support Status |
| :--- | :--- |
| **Dense Models** | |
| [Qwen3-VL-2B-Instruct](https://huggingface.co/Qwen/Qwen3-VL-2B-Instruct) | **✅ Supported** |
| [Qwen3-VL-2B-Thinking](https://huggingface.co/Qwen/Qwen3-VL-2B-Thinking) | **✅ Supported** |
| [Qwen3-VL-4B-Instruct](https://huggingface.co/Qwen/Qwen3-VL-4B-Instruct) | **✅ Supported** |
| [Qwen3-VL-4B-Thinking](https://huggingface.co/Qwen/Qwen3-VL-4B-Thinking) | **✅ Supported** |
| [Qwen3-VL-8B-Instruct](https://huggingface.co/Qwen/Qwen3-VL-8B-Instruct) | **✅ Supported** |
| [Qwen3-VL-8B-Thinking](https://huggingface.co/Qwen/Qwen3-VL-8B-Thinking) | **✅ Supported** |
| [Qwen3-VL-32B-Instruct](https://huggingface.co/Qwen/Qwen3-VL-32B-Instruct) | **✅ Supported** |
| [Qwen3-VL-32B-Thinking](https://huggingface.co/Qwen/Qwen3-VL-32B-Thinking) | **✅ Supported** |
| [NVIDIA-Cosmos-Reason2-2B](https://huggingface.co/nvidia/Cosmos-Reason2-2B) | **✅ Supported** |
| [NVIDIA-Cosmos-Reason2-8B](https://huggingface.co/nvidia/Cosmos-Reason2-8B) | **✅ Supported** |

| **MoE Models** | |
| [Qwen3-VL-30B-A3B](https://huggingface.co/Qwen/Qwen3-30B-A3B) | **🟡 Not started** |
| [Qwen3-VL-235B-A22B](https://huggingface.co/Qwen/Qwen3-235B-A22B) | **🟡 Not started** |


### Running this model

Run Qwen3 in action, implemented in [900 lines of code](bonsai/models/qwen3_vl/modeling.py) in JAX.

```sh
python3 -m bonsai.models.qwen3_vl.tests.run_model
```


## How to contribute to this model

We welcome contributions! You can contribute to this model via the following:
* Add a model config variant from the above `🟡 Not started` to `class ModelConfig` in [modeling.py](modeling.py). Make sure your code is runnable on at least one hardware before creating a PR.
* Got some hardware? Run [run_model.py](tests/run_model.py) the existing configs above on hardwares marked `❔ Needs check`. Mark as `✅ Runs` or `⛔️ Not supported`.
Empty file.
Loading