gyung/lfm2-1.2b-koen-mt-v6.4-merged
114
π LFM2-1.2B-KoEn-MT-v6.4-merged
LiquidAI LFM2-1.2B κΈ°λ° κ³ νμ§ νμ/μν μλ°©ν₯ λ²μ λͺ¨λΈ (SFT)
π― v8 RL Adapterμ Base Modelμ λλ€. RL Adapter: gyung/lfm2-1.2b-koen-mt-v8-rl-10k-adapter (CHrF++ 34.61 π)
π λ²€μΉλ§ν¬ (Flores-200, 1012 Samples, EnβKo)
β v6.4λ GRPO νμ΅μ μ΅μ νλ μμ μ μΈ λ² μ΄μ€ λͺ¨λΈ
π§ v6.4μ νΉμ§
β¨ κ°μ
- Quote Bug μμ ν΄κ²°: v6.1/v6.3μμ λ°μνλ
""ν¨ν΄μ΄ μμ ν μ¬λΌμ§ - μμ°μ€λ¬μ΄ λ¬Έμ₯ ꡬ쑰: μ΄μ λ²μ λ³΄λ€ νλμ μ΄κ³ μ λ €ν λ²μ
- μλ°©ν₯ λ²μ: EN β KO λͺ¨λ λ¨μΌ λͺ¨λΈλ‘ μ§μ
- RL νμ΅ μ΅μ λ² μ΄μ€: v8 GRPO νμ΅μμ κ²μ¦λ μμ μ±
β οΈ μλ €μ§ νκ³
- Tone Inconsistency: μ‘΄λλ§/λ°λ§μ΄ μμ¬ λμ€λ κ²½μ° μμ (β RLλ‘ ν΄κ²°λ¨)
- μΌλΆ κ³ μ λͺ μ¬ νκ°: λ² μ΄μ€ λͺ¨λΈμμ μμλ νΈν₯ μ‘΄μ¬
π‘ κΆμ₯: νλ‘λμ νκ²½μμλ RL Adapterκ° μ μ©λ v8 μ¬μ© κΆμ₯
π μ¬μ©λ²
κΈ°λ³Έ λ‘λ
import torch
from transformers import AutoModelForCausalLM, AutoTokenizer
model_id = "gyung/lfm2-1.2b-koen-mt-v6.4-merged"
tokenizer = AutoTokenizer.from_pretrained(model_id)
model = AutoModelForCausalLM.from_pretrained(
model_id,
device_map="auto",
torch_dtype=torch.float16
)μμ΄ β νκ΅μ΄ λ²μ
messages = [
{"role": "system", "content": "Translate to Korean."},
{"role": "user", "content": "The training is progressing smoothly."}
]
input_ids = tokenizer.apply_chat_template(
messages,
return_tensors="pt",
add_generation_prompt=True
).to(model.device)
outputs = model.generate(
input_ids,
max_new_tokens=256,
do_sample=True,
temperature=0.3,
min_p=0.15,
repetition_penalty=1.05
)
decoded = tokenizer.decode(outputs[0][input_ids.shape[1]:], skip_special_tokens=True)
print(decoded)
# μΆλ ₯: νμ΅μ΄ μμ‘°λ‘κ² μ§νλκ³ μμ΅λλ€.νκ΅μ΄ β μμ΄ λ²μ
messages = [
{"role": "system", "content": "Translate to English."},
{"role": "user", "content": "μ€λ λ μ¨κ° μ λ§ μ’μ΅λλ€."}
]
# λμΌν generate μ½λ μ¬μ©
# μΆλ ₯: The weather is really nice today.π νμ΅ μμΈ
2λ¨κ³ 컀리νλΌ νμ΅
νμ΅ μ€μ
νμ΅ λ‘κ·Έ (Phase 2)
π κ΄λ ¨ λ§ν¬
- RL Adapter (v8): gyung/lfm2-1.2b-koen-mt-v8-rl-10k-adapter
- Previous SFT (v6.1): gyung/lfm2-1.2b-koen-mt-v6.1-curriculum
- Training Dataset: gyung/lfm2_koen_v6_sft_200k
- GitHub Repository: LFM2-KoEn-Tuning
π Citation
@misc{lfm2-koen-v6.4,
author = {gyung},
title = {LFM2-1.2B-KoEn-MT-v6.4: SFT-Enhanced Bidirectional Korean-English Translation Model},
year = {2024},
publisher = {Hugging Face},
url = {https://huggingface.co/gyung/lfm2-1.2b-koen-mt-v6.4-merged}
}π License
μ΄ λͺ¨λΈμ Liquid AI LFM Open License v1.0μ λ°λ¦ λλ€.
- νμ©: νμ μ°κ΅¬ λ° κ°μΈμ μ¬μ©
- μμ μ μ΄μ©: μ° λ§€μΆ 1,000λ§ λ¬λ¬ λ―Έλ§ λ¬΄λ£
