LLMs - a Ryukijano Collection

Ryukijano 's Collections

VILA

Diffusion models

Neural Rendering

Deep Reinforcement Learning

LLMs

Computer vision

Audio

Multi modal foundational models

Text_to_video diffusion

Vision_language_models

Text-3D

2D->3D

LLMs

updated Jan 14

LLM in a flash: Efficient Large Language Model Inference with Limited Memory

Paper • 2312.11514 • Published Dec 12, 2023 • 259
3D-LFM: Lifting Foundation Model

Paper • 2312.11894 • Published Dec 19, 2023 • 15
SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-Scaling

Paper • 2312.15166 • Published Dec 23, 2023 • 58
TinyGPT-V: Efficient Multimodal Large Language Model via Small Backbones

Paper • 2312.16862 • Published Dec 28, 2023 • 31
LARP: Language-Agent Role Play for Open-World Games

Paper • 2312.17653 • Published Dec 24, 2023 • 32
LLaMA Beyond English: An Empirical Study on Language Capability Transfer

Paper • 2401.01055 • Published Jan 2, 2024 • 54
tiiuae/falcon-180B

Text Generation • Updated Sep 6, 2023 • 9.48k • 1.14k
meta-llama/Llama-2-70b-hf

Text Generation • Updated Apr 17, 2024 • 22.2k • • 846
TinyLlama: An Open-Source Small Language Model

Paper • 2401.02385 • Published Jan 4, 2024 • 93
microsoft/phi-2

Text Generation • Updated Apr 29, 2024 • 391k • • 3.29k
Sleeping

40

40

LLaMA Pro 8B Instruct Chat

🏢
MoE-Mamba: Efficient Selective State Space Models with Mixture of Experts

Paper • 2401.04081 • Published Jan 8, 2024 • 71
Blending Is All You Need: Cheaper, Better Alternative to Trillion-Parameters LLM

Paper • 2401.02994 • Published Jan 4, 2024 • 49
Secrets of RLHF in Large Language Models Part II: Reward Modeling

Paper • 2401.06080 • Published Jan 11, 2024 • 28
EmbeddedLLM/Mistral-7B-Merge-14-v0.1

Text Generation • Updated Jan 20, 2024 • 158 • 24
Meta-Prompting: Enhancing Language Models with Task-Agnostic Scaffolding

Paper • 2401.12954 • Published Jan 23, 2024 • 30
MM-LLMs: Recent Advances in MultiModal Large Language Models

Paper • 2401.13601 • Published Jan 24, 2024 • 47
Running

4.16k

4.16k

Chatbot Arena Leaderboard

🏆

Display chatbot leaderboard and statistics
MoE-LLaVA: Mixture of Experts for Large Vision-Language Models

Paper • 2401.15947 • Published Jan 29, 2024 • 51
RWKV/v5-Eagle-7B-pth

Updated Feb 24, 2024 • 199
Zyphra/BlackMamba-2.8B

Updated Feb 6, 2024 • 72 • 30
abacusai/Smaug-72B-v0.1

Text Generation • Updated Feb 23, 2024 • 284 • 468
CohereForAI/aya-101

Text2Text Generation • Updated Mar 31, 2024 • 2.66k • 636
Runtime error

31

31

Pivot Prompt Demo

🚀
SubGen: Token Generation in Sublinear Time and Memory

Paper • 2402.06082 • Published Feb 8, 2024 • 12
InternLM-Math: Open Math Large Language Models Toward Verifiable Reasoning

Paper • 2402.06332 • Published Feb 9, 2024 • 20
MPIrigen: MPI Code Generation through Domain-Specific Language Models

Paper • 2402.09126 • Published Feb 14, 2024 • 15
BioMistral/BioMistral-7B

Text Generation • Updated Feb 21, 2024 • 11.1k • 425
SaulLM-7B: A pioneering Large Language Model for Law

Paper • 2403.03883 • Published Mar 6, 2024 • 80
PERL: Parameter Efficient Reinforcement Learning from Human Feedback

Paper • 2403.10704 • Published Mar 15, 2024 • 58
LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models

Paper • 2403.13372 • Published Mar 20, 2024 • 69
raincandy-u/Llama-3-Aplite-Instruct-4x8B-MoE

Text Generation • Updated May 12, 2024 • 570 • 38
nvidia/Llama3-70B-SteerLM-RM

Updated Jun 19, 2024 • 21 • 42
meta-llama/Llama-3.1-405B-FP8

Text Generation • Updated Dec 6, 2024 • 416 • 111
nvidia/Llama-3.1-Nemotron-70B-Instruct-HF

Text Generation • Updated Oct 25, 2024 • 264k • • 2.03k
nvidia/Hymba-1.5B-Base

Text Generation • Updated Jan 2 • 3.66k • 139
nvidia/Hymba-1.5B-Instruct

Text Generation • Updated Jan 2 • 2.85k • 224
Qwen/QwQ-32B-Preview

Text Generation • Updated Jan 12 • 249k • • 1.72k
meta-llama/Llama-3.3-70B-Instruct

Text Generation • Updated Dec 21, 2024 • 855k • • 2.13k
NovaSky-AI/Sky-T1-32B-Preview

Text Generation • Updated Jan 13 • 4.42k • 540