BAAR Logo

BAAR2-150M

๐ŸŒ Official Website: https://baar.uk/model/
๐Ÿ“„ License: Non-Commercial Only (Contact for Commercial Use)


๐Ÿ“Œ Model Overview

BAAR2-150M is a lightweight multilingual language model designed for fast, resource-efficient inference across 11 languages. Optimized for low latency and minimal compute environments, it enables responsive real-time generation on edge devices, mobile platforms, and resource-constrained servers.

BAAR2-150M ์€ ์ €์‚ฌ์–‘ ํ•˜๋“œ์›จ์–ด ๋ฐ ๋ฆฌ์†Œ์Šค ์ œ์•ฝ ํ™˜๊ฒฝ์—์„œ๋„ ๋น ๋ฅด๊ณ  ์•ˆ์ •์ ์ธ ๋™์ž‘์ด ๊ฐ€๋Šฅํ•˜๋„๋ก ์„ค๊ณ„๋œ 1.5์–ต(150M) ํŒŒ๋ผ๋ฏธํ„ฐ ๊ทœ๋ชจ์˜ ์ดˆ๊ฒฝ๋Ÿ‰ ๋‹ค๊ตญ์–ด ์–ธ์–ด ๋ชจ๋ธ์ž…๋‹ˆ๋‹ค. ์ง€์—ฐ ์‹œ๊ฐ„(Latency)์„ ์ตœ์†Œํ™”ํ•˜์—ฌ ์˜จ๋””๋ฐ”์ด์Šค(Edge), ์‹ค์‹œ๊ฐ„ ๋Œ€ํ™”, ๊ฒฝ๋Ÿ‰ RAG(๊ฒ€์ƒ‰ ์ฆ๊ฐ• ์ƒ์„ฑ) ์‹œ์Šคํ…œ ๋“ฑ์— ์ตœ์ ํ™”๋˜์–ด ์žˆ์Šต๋‹ˆ๋‹ค.


๐Ÿ“Š Live Sample Inference

Hardware: Single NVIDIA Tesla T4 | FP16 Inference

Task / Category Prompt Generated Output Latency
Korean General QA ๋Œ€ํ•œ๋ฏผ๊ตญ์˜ ์ˆ˜๋„๋Š” ์–ด๋””์ธ๊ฐ€์š”? ๋Œ€ํ•œ๋ฏผ๊ตญ์˜ ์ˆ˜๋„๋Š” ์„œ์šธ์ž…๋‹ˆ๋‹ค. ๊ฐœ์ธ์ ์œผ๋กœ, ์ด ์ง€์—ญ์˜ ์ˆ˜๋„๊ฐ€ ๋„ˆ ~1451.0ms
English General QA What is artificial intelligence? A comprehensive machine that is designed to perform tasks that normally require ~671.2ms
KO-to-EN Translation (1) ์•ˆ๋…•์ด ์˜์–ด๋กœ ๋ญ์•ผ? ์•ˆ๋…•์€ ์˜์–ด๋กœ Hello ์ž…๋‹ˆ๋‹ค. ~390.0ms
KO-to-EN Translation (2) ์‚ฌ๊ณผ๊ฐ€ ์˜์–ด๋กœ ๋ญ์•ผ? ์‚ฌ๊ณผ๋Š” ์˜์–ด๋กœ apple ์ž…๋‹ˆ๋‹ค. ~359.4ms
EN-to-KO Translation What is 'Seoul' in Korean? A company that is a company that operates in the United ~571.1ms
Japanese General QA ๆ—ฅๆœฌใฎ้ฆ–้ƒฝใฏใฉใ“ใงใ™ใ‹๏ผŸ ๆ—ฅๆœฌใฎ้ฆ–้ƒฝใฏใ€ ๆฑไบฌ้ƒฝๅŒๆ–นใซใ‚ใ‚Š ~661.0ms

๐Ÿ” Retrieval-Augmented Generation (RAG) Benchmark

This benchmark demonstrates the end-to-end performance of coupling a real-time vector retrieval pipeline with BAAR2-150M generation. It highlights the ultra-low latency response times and context-utilization capabilities achievable within an ultra-lightweight 150M-parameter footprint.

์‹ค์‹œ๊ฐ„ ๋ฒกํ„ฐ ๊ฒ€์ƒ‰(Retrieval)๊ณผ BAAR2-150M ์ƒ์„ฑ์„ ๊ฒฐํ•ฉํ•œ RAG ํŒŒ์ดํ”„๋ผ์ธ ํ…Œ์ŠคํŠธ ๊ฒฐ๊ณผ์ž…๋‹ˆ๋‹ค. 150M ํŒŒ๋ผ๋ฏธํ„ฐ ๊ฒฝ๋Ÿ‰ ๋ชจ๋ธ์˜ ๊ทน๋Œ€ํ™”๋œ ์ถ”๋ก  ์†๋„์™€ ์™ธ๋ถ€ ๋ฌธ๋งฅ(Context) ํ™œ์šฉ ๋Šฅ๋ ฅ์„ ๋ณด์—ฌ์ค๋‹ˆ๋‹ค.

===========================================================================
๐Ÿš€ [Starting Real-Time RAG Q&A]
===========================================================================

[1/4] ๐Ÿ‘ค ์งˆ๋ฌธ: ์•„์ดํฐ 16 ํ”„๋กœ ๊ฐ€์žฅ ์‹ผ ๋ชจ๋ธ ์–ผ๋งˆ๋ถ€ํ„ฐ ์‹œ์ž‘ํ•ด?
   ๐Ÿ” ๊ฒ€์ƒ‰๋œ ๋ฌธ์„œ (์œ ์‚ฌ๋„ 0.67 | โฑ๏ธ 231.1ms):
      "์•„์ดํฐ 16 ํ”„๋กœ๋Š” ํ•ญ๊ณต์šฐ์ฃผ ๋“ฑ๊ธ‰ ํ‹ฐํƒ€๋Š„ ๋””์ž์ธ์œผ๋กœ ์ œ์ž‘๋˜์—ˆ์œผ๋ฉฐ ์ถœ๊ณ ๊ฐ€๋Š” 128GB ๋ชจ๋ธ ๊ธฐ์ค€ 155๋งŒ ์›๋ถ€ํ„ฐ ์‹œ์ž‘ํ•ฉ..."
   ๐Ÿค– AI ๋‹ต๋ณ€: ์ œ ๊ฐœ์ธ์ ์ธ ๊ฒฌํ•ด๋กœ๋Š”, ์•„์ดํฐ 16์€ ๊ฐ€๊ฒฉ์ด ๋†’๊ณ  ๊ฐ€๋ณ์ง€  (โฑ๏ธ 928.1ms)
---------------------------------------------------------------------------

[2/4] ๐Ÿ‘ค ์งˆ๋ฌธ: ์‹ ์ž…์‚ฌ์›์ด ์—ฐ์ฐจ ์“ฐ๋ ค๋ฉด ๋ฉฐ์น  ์ „์— ์Šน์ธ๋ฐ›์•„์•ผ ํ•ด?
   ๐Ÿ” ๊ฒ€์ƒ‰๋œ ๋ฌธ์„œ (์œ ์‚ฌ๋„ 0.79 | โฑ๏ธ 52.5ms):
      "์‚ฌ๋‚ด ์ทจ์—…๊ทœ์น™ ์ œ18์กฐ์— ๋”ฐ๋ผ ๊ทผ์† 1๋…„ ๋ฏธ๋งŒ ์‹ ๊ทœ ์ž…์‚ฌ์ž๋Š” ๋งค์›” ๊ฐœ๊ทผ ์‹œ 1์ผ์”ฉ ์ด 11์ผ์˜ ์—ฐ์ฐจ๊ฐ€ ๋ถ€์—ฌ๋ฉ๋‹ˆ๋‹ค. ์—ฐ..."
   ๐Ÿค– AI ๋‹ต๋ณ€: 1. ์—ฐ์ฐจ ์“ฐ๋ ค๋ฉด 2. ์ธํŠธ๋ผ๋„ท์„ ์‚ฌ์šฉํ•˜๋Š” ๊ฒƒ์ด ์ข‹  (โฑ๏ธ 530.3ms)
---------------------------------------------------------------------------

[3/4] ๐Ÿ‘ค ์งˆ๋ฌธ: ์ง€๊ตฌ๊ฐ€ ์ž์ „ํ•˜๋Š” ๊ณผํ•™์  ์ด์œ ๊ฐ€ ๋ญ์•ผ?
   ๐Ÿ” ๊ฒ€์ƒ‰๋œ ๋ฌธ์„œ (์œ ์‚ฌ๋„ 0.65 | โฑ๏ธ 16.0ms):
      "ํƒœ์–‘๊ณ„ ํ˜•์„ฑ ์‹œ๊ธฐ์ธ ์•ฝ 45์–ต ๋…„ ์ „ ๊ฑฐ๋Œ€ํ•œ ๊ฐ€์Šค์™€ ๋จผ์ง€๋กœ ์ด๋ฃจ์–ด์ง„ ์›์‹œ ์„ฑ์šด์ด ์ค‘๋ ฅ์œผ๋กœ ์ˆ˜์ถ•ํ•˜๋ฉด์„œ ๊ฐ์šด๋™๋Ÿ‰ ๋ณด์กด ๋ฒ•..."
   ๐Ÿค– AI ๋‹ต๋ณ€: ์šฐ์ฃผ ๊ณต๊ฐ„์—๋Š” ์•ฝ 450,000๋…„์ด ์žˆ์Šต๋‹ˆ๋‹ค.  (โฑ๏ธ 421.5ms)
---------------------------------------------------------------------------

[4/4] ๐Ÿ‘ค ์งˆ๋ฌธ: ์ŠคํŽ˜์ธ์˜ ์ˆ˜๋„๋Š” ์–ด๋””์ธ๊ฐ€์š”?
   ๐Ÿ” ๊ฒ€์ƒ‰๋œ ๋ฌธ์„œ (์œ ์‚ฌ๋„ 0.81 | โฑ๏ธ 11.3ms):
      "์ŠคํŽ˜์ธ์€ ๋‚จ์œ ๋Ÿฝ ์ด๋ฒ ๋ฆฌ์•„๋ฐ˜๋„์— ์œ„์น˜ํ•œ ์ž…ํ—Œ๊ตฐ์ฃผ์ œ ๊ตญ๊ฐ€์ž…๋‹ˆ๋‹ค. ๊ตญํ†  ๋ฉด์ ์€ ์•ฝ 50๋งŒ ์ œ๊ณฑํ‚ฌ๋กœ๋ฏธํ„ฐ์— ๋‹ฌํ•˜๋ฉฐ, ๊ตญ๊ฐ€์˜ ํ–‰..."
   ๐Ÿค– AI ๋‹ต๋ณ€: ์ŠคํŽ˜์ธ์˜ ์ˆ˜๋„๋Š” ๋งˆ๋“œ๋ฆฌ๋“œ์ž…๋‹ˆ๋‹ค.  (โฑ๏ธ 271.8ms)
---------------------------------------------------------------------------

๐Ÿ“„ License & Commercial Terms (๋ผ์ด์„ ์Šค ๋ฐ ์ƒ์—…์  ์ด์šฉ ์•ˆ๋‚ด)

  • Non-Commercial Use Only (๋น„์ƒ์—…์  ์—ฐ๊ตฌยท๊ฐœ์ธ ์ด์šฉ ํ•œ์ •):
    This model is strictly available for non-commercial, educational, and research purposes only. Any form of monetization (direct or indirect) without an explicit commercial license is strictly prohibited.
    ๋ณธ ๋ชจ๋ธ์€ ์ˆœ์ˆ˜ ์—ฐ๊ตฌ, ๊ต์œก ๋ฐ ๊ฐœ์ธ ๋น„์˜๋ฆฌ ๋ชฉ์ ์— ํ•œํ•ด ๋ฌด๋ฃŒ๋กœ ์‚ฌ์šฉํ•  ์ˆ˜ ์žˆ์Šต๋‹ˆ๋‹ค. ์‚ฌ์ „ ํ—ˆ๊ฐ€ ์—†๋Š” ์ผ์ฒด์˜ ์ˆ˜์ต ์ฐฝ์ถœ ํ–‰์œ„(์งยท๊ฐ„์ ‘์  ์ƒ์—…์  ์ด์šฉ)๋Š” ์—„๊ฒฉํžˆ ๊ธˆ์ง€๋ฉ๋‹ˆ๋‹ค.

  • Monetization & Commercial Licensing Inquiries (์ˆ˜์ต ์ฐฝ์ถœ ๋ฐ ์ƒ์šฉ ๋ผ์ด์„ ์Šค ๋ฌธ์˜):
    If you wish to monetize, integrate this model into commercial products, provide paid services/APIs, or require enterprise-level support, you must obtain a separate commercial license. Please reach out via email for licensing terms and enterprise adoption.
    ๋ณธ ๋ชจ๋ธ์„ ํ™œ์šฉํ•˜์—ฌ ์ˆ˜์ต์„ ์ฐฝ์ถœํ•˜๊ณ ์ž ํ•˜๊ฑฐ๋‚˜, ์ƒ์šฉ ์„œ๋น„์Šค/์œ ๋ฃŒ ์ œํ’ˆ์— ํƒ‘์žฌ, ๋˜๋Š” ๊ธฐ์—…์šฉ ๋งž์ถค ์ ์šฉ ๋ฐ ๊ธฐ์ˆ  ์ง€์›์ด ํ•„์š”ํ•œ ๊ฒฝ์šฐ ๋ฐ˜๋“œ์‹œ ๋ณ„๋„์˜ ์ƒ์šฉ ๋ผ์ด์„ ์Šค๋ฅผ ์ทจ๋“ํ•˜์…”์•ผ ํ•ฉ๋‹ˆ๋‹ค. ๋„์ž… ๋ฐ ๋ผ์ด์„ ์Šค ๋ฐœ๊ธ‰์€ ์•„๋ž˜ ์ด๋ฉ”์ผ๋กœ ๋ฌธ์˜ํ•ด ์ฃผ์‹œ๊ธฐ ๋ฐ”๋ž๋‹ˆ๋‹ค.

    • Commercial Inquiries (์ƒ์šฉ ๋ผ์ด์„ ์Šค ๋ฌธ์˜): admin@099.kr
    • Official Website (๊ณต์‹ ์›น์‚ฌ์ดํŠธ): https://baar.uk/model/

โš ๏ธ Notes (์•ˆ๋‚ด ์‚ฌํ•ญ)

  • Pre-trained Model: This model is a base pre-trained checkpoint. For specific tasks, factual alignment, or structured dialogue, task-specific fine-tuning (SFT) or Retrieval-Augmented Generation (RAG) is recommended.
  • ๊ธฐ์ดˆ ์‚ฌ์ „ํ•™์Šต ๋ชจ๋ธ: ๋ณธ ๊ฐ€์ค‘์น˜๋Š” ์‚ฌ์ „ํ•™์Šต ๋‹จ๊ณ„์˜ ๋ฒ ์ด์Šค ๋ชจ๋ธ์ž…๋‹ˆ๋‹ค. ํŠน์ • ๋„๋ฉ”์ธ ์ž‘์—…, ์‚ฌ์‹ค ๊ด€๊ณ„ ๊ฒ€์ฆ ๋ฐ ์ •๊ตํ•œ ๋Œ€ํ™” ์ƒ์„ฑ์ด ํ•„์š”ํ•œ ๊ฒฝ์šฐ ํŒŒ์ธํŠœ๋‹(SFT) ๋˜๋Š” ๊ฒ€์ƒ‰ ์ฆ๊ฐ• ์ƒ์„ฑ(RAG) ํŒŒ์ดํ”„๋ผ์ธ๊ณผ์˜ ์—ฐ๊ณ„๋ฅผ ๊ถŒ์žฅํ•ฉ๋‹ˆ๋‹ค.

๐Ÿ’ผ Opportunities & Contact (์ฑ„์šฉ ์ œ์•ˆ ๋ฐ ํˆฌ์ž ๋ฌธ์˜)

This project demonstrates practical competency in custom model architecture design, end-to-end distributed training optimization, and efficient multi-language serving under compute constraints.

I am actively seeking AI Engineering / Research opportunities, team recruitment offers, and project investment/partnerships.

  • Official Model Site (๋ชจ๋ธ ๊ณต์‹ ์›น์‚ฌ์ดํŠธ): https://baar.uk/model/
  • Model Adoption & Licensing (๋„์ž… ๋ฐ ๋ผ์ด์„ ์Šค ๋ฌธ์˜): admin@099.kr
  • Recruitment & Hiring Inquiries (์ฑ„์šฉ ๋ฐ ํฌ์ง€์…˜ ์ œ์•ˆ): admin@099.kr
  • Investment & Technical Collaboration (ํˆฌ์ž, ํŒŒํŠธ๋„ˆ์‹ญ ๋ฐ ๊ธฐ์ˆ  ํ˜‘์—…): admin@099.kr

์ œํ•œ๋œ ํ•˜๋“œ์›จ์–ด ๋ฆฌ์†Œ์Šค ํ™˜๊ฒฝ์—์„œ ๊ณ ํšจ์œจ ๋‹ค๊ตญ์–ด ๋ชจ๋ธ ์•„ํ‚คํ…์ฒ˜๋ฅผ ์ง์ ‘ ์„ค๊ณ„ํ•˜๊ณ  ํ›ˆ๋ จ ํŒŒ์ดํ”„๋ผ์ธ์„ ์—”๋“œํˆฌ์—”๋“œ๋กœ ๊ตฌ์ถ•ํ•  ์ˆ˜ ์žˆ๋Š” AI ์—”์ง€๋‹ˆ์–ด์ž…๋‹ˆ๋‹ค. ์ €์˜ ๊ธฐ์ˆ ์  ์—ญ๋Ÿ‰ ์˜์ž…(์ฑ„์šฉ)์ด๋‚˜ ํ”„๋กœ์ ํŠธ ํ˜‘์—…/ํˆฌ์ž์— ๊ด€์‹ฌ์ด ์žˆ์œผ์‹  ๊ธฐ์—… ๋ฐ ํŒ€์˜ ์—ฐ๋ฝ์„ ๊ธฐ๋‹ค๋ฆฝ๋‹ˆ๋‹ค.

Downloads last month
470
Safetensors
Model size
0.2B params
Tensor type
F16
ยท
Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support

Collection including aixk/BAAR2-150M