Any-to-Any
Transformers
Safetensors
gemma4_unified
image-text-to-text
fp8
vllm
compressed-tensors
gemma4
omni
dgx-spark
gb10
quantization
Instructions to use coolthor/gemma-4-12B-it-FP8-dynamic with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use coolthor/gemma-4-12B-it-FP8-dynamic with Transformers:
# Load model directly from transformers import AutoProcessor, AutoModelForMultimodalLM processor = AutoProcessor.from_pretrained("coolthor/gemma-4-12B-it-FP8-dynamic") model = AutoModelForMultimodalLM.from_pretrained("coolthor/gemma-4-12B-it-FP8-dynamic", device_map="auto") - Notebooks
- Google Colab
- Kaggle
Update chat template
#1
by Sidd065 - opened
Sidd065 changed discussion status to closed
Done โ synced chat_template.jinja to the upstream fix (711c1368) in commit 425ac4c8. Thanks for the heads-up! ๐