Skip to content

Fine-tune bake-off: LFM2.5-350M vs Gemma-3-270M/FunctionGemma vs Qwen2.5-0.5B-Instruct #4

Description

@espetro

LoRA/QLoRA (peft/trl or unsloth) on identical data, cloud/rented GPU. Same recipe as ScribeAgent / distil labs LFM2.5 fine-tune.

Metadata

Metadata

Assignees

Labels

featureClassification: feature

Projects

No projects

    Milestone

    No milestone

    Relationships

    None yet

    Development

    No branches or pull requests

    Issue actions