Commit History

Expose live audio generation API route
58e1c4d
Running
verified

cazyundee commited on

Pass Qwen prompt through async job
d3842e2
verified

cazyundee commited on

Fix Qwen multimodal prompt content
024ac84
verified

cazyundee commited on

Diagnose Qwen generation termination
8f2c140
verified

cazyundee commited on

Enable Qwen reasoning by default
ca39a8e
verified

cazyundee commited on

Add torchvision for Qwen processor
5be5b50
verified

cazyundee commited on

Add CPU Qwen3.8 inference job
e8b6e3f
verified

cazyundee commited on

Normalize TinyLlama chat template inputs
9a9fa33
verified

cazyundee commited on

Fix CPU TinyLlama PyTorch initialization
4380259
verified

cazyundee commited on

Accept JSON body for TinyLlama inference
fc0acf8
verified

cazyundee commited on

Restore Gradio ZeroGPU Space metadata
1d49bf6
verified

cazyundee commited on

Add Transformers runtime for TinyLlama
feb9a9b
verified

cazyundee commited on

Add CPU TinyLlama inference to Gradio Space
95167c1
verified

cazyundee commited on

Remove incompatible Docker entrypoint
ce7edba
verified

cazyundee commited on

Switch Space to Docker experiment
9c40af1
verified

cazyundee commited on

Add standalone CPU server entrypoint
707d14d
verified

cazyundee commited on

Test standalone llama server container
d55cd28
verified

cazyundee commited on

Test RAM loaded GGUF without pipe deadlock
3956ce2
verified

cazyundee commited on

Rebuild llama.cpp with stable CPU backend
f3c6ec5
verified

cazyundee commited on

Limit CPU thread pools to cgroup CPUs
1b0a401
verified

cazyundee commited on

Prevent llama output pipe deadlock
a8a716e
verified

cazyundee commited on

Probe llama CPU process state
8ef48d6
verified

cazyundee commited on

Run loader diagnosis as background job
3fdbf36
verified

cazyundee commited on

Add CPU model loader diagnostics
a5de9d9
verified

cazyundee commited on

Run CPU benchmarks asynchronously
318e7cb
verified

cazyundee commited on

Diagnose single-thread CPU model loading
50b3226
verified

cazyundee commited on

Add tiny GGUF CPU control test
74b57c5
verified

cazyundee commited on

Use RAM loaded CPU model benchmark
6a6f8c0
verified

cazyundee commited on

Separate model loading from CPU warmup
005dc00
verified

cazyundee commited on

Add CPU model smoke diagnostics
a903372
verified

cazyundee commited on

Serialize CPU benchmark requests
75c0e18
verified

cazyundee commited on

Keep local model benchmarks CPU only
677b59e
verified

cazyundee commited on

Select llama benchmark executable
0329f82
verified

cazyundee commited on

Fix llama benchmark binary cache
6e550c2
verified

cazyundee commited on

Use llama bench for bounded CPU measurements
4c94260
verified

cazyundee commited on

Fix CPU benchmark diagnostics
ce1fcf1
verified

cazyundee commited on

Restore stable Space server launch
bc0692a
verified

cazyundee commited on

Add share=True to bypass broken proxy
15d9481
verified

cazyundee commited on

Restore working create_app monkey-patch with staticmethod
afb0c33
verified

cazyundee commited on

Background thread inject routes into running Gradio server
c7f0d89
verified

cazyundee commited on

Fix: inject routes via background thread after launch
5e3fbbf
verified

cazyundee commited on

Fix: patch App.__init__ to inject routes into the actual served app
d0e8976
verified

cazyundee commited on

Fix: monkey-patch without staticmethod wrapper, spaces before torch, ssr_mode=False
e244295
verified

cazyundee commited on

Fix route injection: try demo.app directly, fallback to monkey-patch
e3186fc
verified

cazyundee commited on

Add model filter param to benchmark endpoint
a76c80d
verified

cazyundee commited on

Fix: build llama.cpp with static linking, find binary after build
2ab0e84
verified

cazyundee commited on

Build llama.cpp from source instead of pre-built binaries
37096e6
verified

cazyundee commited on

Add explicit libllama.so verification logging
dd8b7b8
verified

cazyundee commited on

Fix: detect stale cache, re-extract if libs missing
13fbb4e
verified

cazyundee commited on

Fix: extract all llama.cpp libs, set LD_LIBRARY_PATH
47355da
verified

cazyundee commited on