BAAR1-150M

BAAR1-150M is a lightweight multilingual language model designed for fast, resource-efficient inference across 11 languages. Optimized for low latency and minimal compute environments, it enables responsive real-time generation on edge devices and standard cloud GPUs.

BAAR1-150M์€ 11๊ฐœ ์–ธ์–ด๋ฅผ ์ง€์›ํ•˜๋Š” ์ดˆ๊ฒฝ๋Ÿ‰ ๋‹ค๊ตญ์–ด ์–ธ์–ด ๋ชจ๋ธ์ž…๋‹ˆ๋‹ค. ์ €์‚ฌ์–‘ ํ•˜๋“œ์›จ์–ด ๋ฐ ๋ฆฌ์†Œ์Šค ์ œ์•ฝ ํ™˜๊ฒฝ์—์„œ๋„ ๋น ๋ฅด๊ณ  ์•ˆ์ •์ ์ธ ๋™์ž‘์ด ๊ฐ€๋Šฅํ•˜๋„๋ก ๊ฒฝ๋Ÿ‰ํ™”๋˜์–ด, ์‹ค์‹œ๊ฐ„ ํ…์ŠคํŠธ ์ƒ์„ฑ ํ™˜๊ฒฝ์— ์ตœ์ ํ™”๋˜์–ด ์žˆ์Šต๋‹ˆ๋‹ค.

โš ๏ธ Experimental Test Release / ์‹คํ—˜์  ํ…Œ์ŠคํŠธ ๋ชจ๋ธ
This checkpoint is an experimental test build (Proof-of-Concept) released strictly for latency evaluation, research, and multilingual inference testing. Outputs may exhibit incomplete phrasing or factual errors and are not intended for production deployments.
๋ณธ ๊ฐ€์ค‘์น˜๋Š” ๋‹ค๊ตญ์–ด ์ถ”๋ก  ์ง€์—ฐ ์‹œ๊ฐ„ ๊ฒ€์ฆ ๋ฐ ๊ธฐ์ˆ  ์‹ค์ฆ์„ ์œ„ํ•œ ์‹คํ—˜์šฉ ํ…Œ์ŠคํŠธ ์ฒดํฌํฌ์ธํŠธ(PoC)์ž…๋‹ˆ๋‹ค. ํ”„๋กœํ† ํƒ€์ž… ๋‹จ๊ณ„์ด๋ฏ€๋กœ ์‚ฌ์‹ค ๊ด€๊ณ„ ์™œ๊ณก์ด๋‚˜ ๋ฌธ์žฅ ๋ฏธ์™„์„ฑ์ด ๋ฐœ์ƒํ•  ์ˆ˜ ์žˆ์œผ๋ฉฐ, ์ƒ์šฉ ๋ฐฐํฌ์šฉ์ด ์•„๋‹Œ ์—ฐ๊ตฌ ๋ฐ ์„ฑ๋Šฅ ๊ฒ€์ฆ ๋ชฉ์ ์œผ๋กœ ๊ณต๊ฐœ๋˜์—ˆ์Šต๋‹ˆ๋‹ค.


๐Ÿ“Š Live Sample Inference (11๊ฐœ๊ตญ ์‹ค์‹œ๊ฐ„ ์ถ”๋ก  ํ…Œ์ŠคํŠธ ๊ฒฐ๊ณผ)

Hardware: Single NVIDIA Tesla T4 | FP16 Inference

Language Prompt Generated Output Latency
KO (Korean) ๋„Œ ๋ˆ„๊ตฌ๋‹ˆ? AI๋กœ์„œ ๋‚˜๋Š” ๋ฌผ๋ฆฌ์ ์ธ ์กด์žฌ์ด๋ฉฐ, ์ œ๊ฐ€ ํ•  ์ˆ˜ ์žˆ๋Š” ์ผ์€ ~614.5ms
EN (English) What is artificial intelligence? Artificial intelligence, often abbreviated as AI ~687.4ms
JA (Japanese) ๆ—ฅๆœฌใฎ้ฆ–้ƒฝใฏใฉใ“ใงใ™ใ‹๏ผŸ ๆ—ฅๆœฌใฎ้ฆ–่ฆ‹ใ‚‹ใ“ใจใฏๆฑไบฌใงใ™ใŒ็ด„ 20 , 587 km ~702.8ms
ZH (Chinese) ไบบๅทฅๆ™บ่ƒฝ็š„ไธป่ฆ็‰น็‚นๆ˜ฏไป€ไนˆ๏ผŸ ไบบไบบ็š„ไธป่ฆๆ€ๆƒณๆ˜ฏ็†่งฃๅ’Œ่งฃ้‡Šไบบ็ฑป่ฏญ่จ€ๅ’Œ่กŒไธบ็š„่ƒฝๅŠ› ~782.3ms
ES (Spanish) ยฟCuรกl es la capital de Espaรฑa? La capital del Espaรฑa, tambiรฉn conocida como la capital de ~511.2ms
PT (Portuguese) Qual รฉ a capital do Brasil? A capital do Brasil, tambรฉm conocida como Canciller, รฉ ~513.1ms
DE (German) Was ist kรผnstliche Intelligenz? Kรผnstliche Intelligenz, auch bekannt ~521.5ms
RU (Russian) ะšะฐะบะฐั ัั‚ะพะปะธั†ะฐ ะ ะพััะธะธ? ะกั‚ะพะปะธั†ะฐ ะ ะพััะธะธ, ัˆั‚ะฐั‚ ะšะฐะปะธั„ะพั€ะฝะธั, ัะฒะปัะตั‚ัั ~522.0ms
HI (Hindi) เคญเคพเคฐเคค เค•เฅ€ เคฐเคพเคœเคงเคพเคจเฅ€ เค•เฅเคฏเคพ เคนเฅˆ? เคญเคพเคฐเคค, เคœเคจเคฎเค‚เคฆ เค”เคฐ เคฌเคขเคธเฅ‡ เคธเค‚เคฌเค‚เคงเคฟเคค เคนเฅˆ, เคเค• เคฆเฅ‡เคถ เคœเฅ‹ เค…เคชเคจเฅ‡ เค‡เคคเคฟเคนเคพเคธ ~518.2ms
VI (Vietnamese) Thแปง ฤ‘รด cแปงa Viแป‡t Nam lร  gรฌ? Viแป‡t Nam, cรฒn ฤ‘ฦฐแปฃc gแปi lร  Chiแบฟn tranh Tรขy ~536.6ms
TH (Thai) เน€เธกเธทเธญเธ‡เธซเธฅเธงเธ‡เธ‚เธญเธ‡เธ›เธฃเธฐเน€เธ—เธจเน„เธ—เธขเธ„เธทเธญเธญเธฐเน„เธฃ? เน€เธกเธทเธญเธ‡เธ—เธตเนˆเธกเธตเธŠเธตเธงเธดเธ•เธŠเธฅเธตเธ‚เธญเธ‡เธ›เธฃเธฐเน€เธ—เธจเธ„เธทเธญเน‚เธ•เน€เธเธตเธขเธง ~343.6ms

๐Ÿ“„ License & Commercial Terms (๋ผ์ด์„ ์Šค ๋ฐ ์ƒ์—…์  ์ด์šฉ ์•ˆ๋‚ด)

  • Non-Commercial Use Only (๋น„์ƒ์—…์  ์—ฐ๊ตฌยท๊ฐœ์ธ ์ด์šฉ ํ•œ์ •):
    This model is strictly available for non-commercial, educational, and research purposes only. Any form of monetization (direct or indirect) without an explicit commercial license is strictly prohibited.
    ๋ณธ ๋ชจ๋ธ์€ ์ˆœ์ˆ˜ ์—ฐ๊ตฌ, ๊ต์œก ๋ฐ ๊ฐœ์ธ ๋น„์˜๋ฆฌ ๋ชฉ์ ์— ํ•œํ•ด ๋ฌด๋ฃŒ๋กœ ์‚ฌ์šฉํ•  ์ˆ˜ ์žˆ์Šต๋‹ˆ๋‹ค. ์‚ฌ์ „ ํ—ˆ๊ฐ€ ์—†๋Š” ์ผ์ฒด์˜ ์ˆ˜์ต ์ฐฝ์ถœ ํ–‰์œ„(์งยท๊ฐ„์ ‘์  ์ƒ์—…์  ์ด์šฉ)๋Š” ์—„๊ฒฉํžˆ ๊ธˆ์ง€๋ฉ๋‹ˆ๋‹ค.

  • Monetization & Commercial Licensing Inquiries (์ˆ˜์ต ์ฐฝ์ถœ ๋ฐ ์ƒ์šฉ ๋ผ์ด์„ ์Šค ๋ฌธ์˜):
    If you wish to monetize, integrate this model into commercial products, provide paid services/APIs, or require enterprise-level support, you must obtain a separate commercial license. Please reach out via email for licensing terms and enterprise adoption.
    ๋ณธ ๋ชจ๋ธ์„ ํ™œ์šฉํ•˜์—ฌ ์ˆ˜์ต์„ ์ฐฝ์ถœํ•˜๊ณ ์ž ํ•˜๊ฑฐ๋‚˜, ์ƒ์šฉ ์„œ๋น„์Šค/์œ ๋ฃŒ ์ œํ’ˆ์— ํƒ‘์žฌ, ๋˜๋Š” ๊ธฐ์—…์šฉ ๋งž์ถค ์ ์šฉ ๋ฐ ๊ธฐ์ˆ  ์ง€์›์ด ํ•„์š”ํ•œ ๊ฒฝ์šฐ ๋ฐ˜๋“œ์‹œ ๋ณ„๋„์˜ ์ƒ์šฉ ๋ผ์ด์„ ์Šค๋ฅผ ์ทจ๋“ํ•˜์…”์•ผ ํ•ฉ๋‹ˆ๋‹ค. ๋„์ž… ๋ฐ ๋ผ์ด์„ ์Šค ๋ฐœ๊ธ‰์€ ์•„๋ž˜ ์ด๋ฉ”์ผ๋กœ ๋ฌธ์˜ํ•ด ์ฃผ์‹œ๊ธฐ ๋ฐ”๋ž๋‹ˆ๋‹ค.

    • Commercial Inquiries (์ƒ์šฉ ๋ผ์ด์„ ์Šค ๋ฌธ์˜): admin@099.kr

โš ๏ธ Notes (์•ˆ๋‚ด ์‚ฌํ•ญ)

  • Pre-trained Model: This model is a base pre-trained checkpoint. For specific tasks, factual alignment, or structured dialogue, task-specific fine-tuning (SFT) or Retrieval-Augmented Generation (RAG) is recommended.
  • ๊ธฐ์ดˆ ์‚ฌ์ „ํ•™์Šต ๋ชจ๋ธ: ๋ณธ ๊ฐ€์ค‘์น˜๋Š” ์‚ฌ์ „ํ•™์Šต ๋‹จ๊ณ„์˜ ๋ฒ ์ด์Šค ๋ชจ๋ธ์ž…๋‹ˆ๋‹ค. ํŠน์ • ๋„๋ฉ”์ธ ์ž‘์—…, ์‚ฌ์‹ค ๊ด€๊ณ„ ๊ฒ€์ฆ ๋ฐ ์ •๊ตํ•œ ๋Œ€ํ™” ์ƒ์„ฑ์ด ํ•„์š”ํ•œ ๊ฒฝ์šฐ ํŒŒ์ธํŠœ๋‹(SFT) ๋˜๋Š” ๊ฒ€์ƒ‰ ์ฆ๊ฐ• ์ƒ์„ฑ(RAG) ํŒŒ์ดํ”„๋ผ์ธ๊ณผ์˜ ์—ฐ๊ณ„๋ฅผ ๊ถŒ์žฅํ•ฉ๋‹ˆ๋‹ค.

๐Ÿ’ผ Opportunities & Contact (์ฑ„์šฉ ์ œ์•ˆ ๋ฐ ํˆฌ์ž ๋ฌธ์˜)

This project demonstrates practical competency in custom model architecture design, end-to-end distributed training optimization, and efficient multi-language serving under compute constraints.

I am actively seeking AI Engineering / Research opportunities, team recruitment offers, and project investment/partnerships.

  • Model Adoption & Licensing (๋„์ž… ๋ฐ ๋ผ์ด์„ ์Šค ๋ฌธ์˜): admin@099.kr
  • Recruitment & Hiring Inquiries (์ฑ„์šฉ ๋ฐ ํฌ์ง€์…˜ ์ œ์•ˆ): admin@099.kr
  • Investment & Technical Collaboration (ํˆฌ์ž, ํŒŒํŠธ๋„ˆ์‹ญ ๋ฐ ๊ธฐ์ˆ  ํ˜‘์—…): admin@099.kr

์ œํ•œ๋œ ํ•˜๋“œ์›จ์–ด ๋ฆฌ์†Œ์Šค ํ™˜๊ฒฝ์—์„œ ๊ณ ํšจ์œจ ๋‹ค๊ตญ์–ด ๋ชจ๋ธ ์•„ํ‚คํ…์ฒ˜๋ฅผ ์ง์ ‘ ์„ค๊ณ„ํ•˜๊ณ  ํ›ˆ๋ จ ํŒŒ์ดํ”„๋ผ์ธ์„ ์—”๋“œํˆฌ์—”๋“œ๋กœ ๊ตฌ์ถ•ํ•  ์ˆ˜ ์žˆ๋Š” AI ์—”์ง€๋‹ˆ์–ด์ž…๋‹ˆ๋‹ค. ์ €์˜ ๊ธฐ์ˆ ์  ์—ญ๋Ÿ‰ ์˜์ž…(์ฑ„์šฉ)์ด๋‚˜ ํ”„๋กœ์ ํŠธ ํ˜‘์—…/ํˆฌ์ž์— ๊ด€์‹ฌ์ด ์žˆ์œผ์‹  ๊ธฐ์—… ๋ฐ ํŒ€์˜ ์—ฐ๋ฝ์„ ๊ธฐ๋‹ค๋ฆฝ๋‹ˆ๋‹ค.

Downloads last month
317
Safetensors
Model size
0.2B params
Tensor type
F16
ยท
Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support