74 1 year ago

A tiny fine-tuned and distillate model from Llama with GRPO for enhance reasoning to use like a personal assistant on smaller devices

af0ddbdaaa26 · 70B
<|system|>
{{ .System }}</s>
<|user|>
{{ .Prompt }}</s>
<|assistant|>