Korean story continuation
Haru πΈ
A compact recurrent language model that continues short Korean stories. Haru is distributed as a standard Transformers model with Safetensors and reviewed custom architecture code.
6.8M
parameters
512
token context
2 / 4 / 6
recurrent depths
7.436
best validation PPL
from transformers import AutoModelForCausalLM, AutoTokenizer
model_id = "gaon12/haru"
tokenizer = AutoTokenizer.from_pretrained(model_id, trust_remote_code=True)
model = AutoModelForCausalLM.from_pretrained(model_id, trust_remote_code=True)
inputs = tokenizer("μμ λ§μμ μ‘°μ©ν μμΉ¨μ΄ μ°Ύμμμ΄μ.", return_tensors="pt")
output = model.generate(**inputs, max_new_tokens=120, use_cache=False)
print(tokenizer.decode(output[0], skip_special_tokens=True))