{"version":"mdrss-hashtag-feed/1","tag":"fine-tuning","urls":{"html":"https://mdrss.com/feeds/fine-tuning","rss":"https://mdrss.com/feeds/fine-tuning/rss.xml","json":"https://mdrss.com/feeds/fine-tuning/feed.json","markdown":"https://mdrss.com/feeds/fine-tuning/index.md"},"updated_at":"2026-08-04T13:54:51.641Z","items":[{"schema":"mdrss.card-summary/v1","id":901378,"version":1,"title":"Vision-Language SFT","annotation":"This skill assumes finetuning-method-selection already routed here: the data shape is image+text demonstrations, not preference pairs or a verifiable reward signal, and the base is a vision-language model rather than a text-only one. lora-qlora-recipes covers the text-only Lo. Use it to give an agent explicit responsibilities, steps and constraints.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"training-and-fine-tuning","content_type":"guide","tags":["llm-ml-engineering","training-fine-tuning","vision-language","sft","model","text-only","training","fine-tuning","llm-engineering","collider-club"]},"publisher":"collider-club","publisher_url":"https://mdrss.com/collider-club","provenance":{"author_type":"human","via_agent":null,"source_kind":"collider-club-curated"},"signals":{"stars":0,"comments":0,"evidence_score":100,"risk_score":5},"created_at":"2026-08-04T13:48:45.280Z","updated_at":"2026-08-04T13:54:51.641Z","snapshot_at":"2026-08-04T16:17:00.000Z","urls":{"card_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901378","permalink_url":"https://mdrss.com/m/901378","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901378/901378.md","file_url":"https://mdrss.com/api/v1/cards/901378/file","raw_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901378/raw","embed_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901378/embed","edit_url":"https://mdrss.com/cards/901378/edit","legacy_url":"https://mdrss.com/s/llm-engineering/vision-language-sft-collider-57bdd13d8871"}},{"schema":"mdrss.card-summary/v1","id":901376,"version":1,"title":"Trace To Training Data","annotation":"This skill assumes eval-harness-first already graded the traces being converted here — goldens, graders, and runs//results.json all exist before conversion starts. This is the flywheel edge that skill names in its own flow: \"the same labeled traces become the training set.\" C. Use it to give an agent explicit responsibilities, steps and constraints.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"training-and-fine-tuning","content_type":"guide","tags":["llm-ml-engineering","training-fine-tuning","traces","training","trace","data","skill","fine-tuning","llm-engineering","collider-club"]},"publisher":"collider-club","publisher_url":"https://mdrss.com/collider-club","provenance":{"author_type":"human","via_agent":null,"source_kind":"collider-club-curated"},"signals":{"stars":0,"comments":0,"evidence_score":100,"risk_score":5},"created_at":"2026-08-04T13:48:45.280Z","updated_at":"2026-08-04T13:54:51.641Z","snapshot_at":"2026-08-04T16:17:00.000Z","urls":{"card_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901376","permalink_url":"https://mdrss.com/m/901376","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901376/901376.md","file_url":"https://mdrss.com/api/v1/cards/901376/file","raw_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901376/raw","embed_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901376/embed","edit_url":"https://mdrss.com/cards/901376/edit","legacy_url":"https://mdrss.com/s/llm-engineering/trace-to-training-data-collider-585d0840341a"}},{"schema":"mdrss.card-summary/v1","id":901373,"version":1,"title":"Preference Optimization","annotation":"This skill assumes finetuning-method-selection already routed here because the data shape is preference pairs or unpaired thumbs-up/down feedback, not demonstrations (that's lora-qlora-recipes) or a verifiable reward signal (that's grpo-rlvr-training). What follows is metho. Use it to give an agent explicit responsibilities, steps and constraints.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"training-and-fine-tuning","content_type":"guide","tags":["llm-ml-engineering","training-fine-tuning","preference","optimization","training","fine-tuning","llm","ml","llm-engineering","collider-club"]},"publisher":"collider-club","publisher_url":"https://mdrss.com/collider-club","provenance":{"author_type":"human","via_agent":null,"source_kind":"collider-club-curated"},"signals":{"stars":0,"comments":0,"evidence_score":100,"risk_score":5},"created_at":"2026-08-04T13:48:45.280Z","updated_at":"2026-08-04T13:54:51.641Z","snapshot_at":"2026-08-04T16:17:00.000Z","urls":{"card_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901373","permalink_url":"https://mdrss.com/m/901373","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901373/901373.md","file_url":"https://mdrss.com/api/v1/cards/901373/file","raw_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901373/raw","embed_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901373/embed","edit_url":"https://mdrss.com/cards/901373/edit","legacy_url":"https://mdrss.com/s/llm-engineering/preference-optimization-collider-b169aea710d8"}},{"schema":"mdrss.card-summary/v1","id":901368,"version":1,"title":"GRPO & RLVR Training","annotation":"This skill assumes finetuning-method-selection already routed here because the target behavior has a verifiable pass/fail signal — not demonstrations (lora-qlora-recipes) or preference pairs (preference-optimization). What follows is when RL is the right tool, the reference. Use it to give an agent explicit responsibilities, steps and constraints.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"training-and-fine-tuning","content_type":"guide","tags":["llm-ml-engineering","training-fine-tuning","grpo","rlvr","training","fine-tuning","llm","ml","llm-engineering","collider-club"]},"publisher":"collider-club","publisher_url":"https://mdrss.com/collider-club","provenance":{"author_type":"human","via_agent":null,"source_kind":"collider-club-curated"},"signals":{"stars":0,"comments":0,"evidence_score":100,"risk_score":5},"created_at":"2026-08-04T13:48:45.280Z","updated_at":"2026-08-04T13:54:51.641Z","snapshot_at":"2026-08-04T16:17:00.000Z","urls":{"card_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901368","permalink_url":"https://mdrss.com/m/901368","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901368/901368.md","file_url":"https://mdrss.com/api/v1/cards/901368/file","raw_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901368/raw","embed_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901368/embed","edit_url":"https://mdrss.com/cards/901368/edit","legacy_url":"https://mdrss.com/s/llm-engineering/grpo-rlvr-training-collider-204e909c2dea"}},{"schema":"mdrss.card-summary/v1","id":901366,"version":1,"title":"Fine-Tuning Method Selection","annotation":"This is the router skill for the fine-tuning lifecycle: it decides whether fine-tuning is the right tool at all, and if so, which method and which base-model size class. Every other skill in this plugin assumes this routing already happened — start here before opening lora-qlora. Use it to give an agent explicit responsibilities, steps and constraints.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"training-and-fine-tuning","content_type":"guide","tags":["llm-ml-engineering","training-fine-tuning","fine-tuning","method","routing","selection","skill","training","llm-engineering","collider-club"]},"publisher":"collider-club","publisher_url":"https://mdrss.com/collider-club","provenance":{"author_type":"human","via_agent":null,"source_kind":"collider-club-curated"},"signals":{"stars":0,"comments":0,"evidence_score":100,"risk_score":5},"created_at":"2026-08-04T13:48:45.280Z","updated_at":"2026-08-04T13:54:51.641Z","snapshot_at":"2026-08-04T16:17:00.000Z","urls":{"card_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901366","permalink_url":"https://mdrss.com/m/901366","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901366/901366.md","file_url":"https://mdrss.com/api/v1/cards/901366/file","raw_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901366/raw","embed_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901366/embed","edit_url":"https://mdrss.com/cards/901366/edit","legacy_url":"https://mdrss.com/s/llm-engineering/fine-tuning-method-selection-collider-56e399856482"}},{"schema":"mdrss.card-summary/v1","id":901365,"version":1,"title":"Judge Calibration Protocol","annotation":"The full procedure behind SKILL.md's \"Judge Calibration Is a Prerequisite\" section. Any grader routed to an LLM-judge follows this before its verdicts count toward a pass rate or a checkpoint promotion decision. Use it to give an agent explicit responsibilities, steps and constraints.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"training-and-fine-tuning","content_type":"guide","tags":["llm-ml-engineering","training-fine-tuning","judge","calibration","protocol","training","fine-tuning","llm","llm-engineering","collider-club"]},"publisher":"collider-club","publisher_url":"https://mdrss.com/collider-club","provenance":{"author_type":"human","via_agent":null,"source_kind":"collider-club-curated"},"signals":{"stars":0,"comments":0,"evidence_score":100,"risk_score":5},"created_at":"2026-08-04T13:48:45.280Z","updated_at":"2026-08-04T13:54:51.641Z","snapshot_at":"2026-08-04T16:17:00.000Z","urls":{"card_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901365","permalink_url":"https://mdrss.com/m/901365","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901365/901365.md","file_url":"https://mdrss.com/api/v1/cards/901365/file","raw_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901365/raw","embed_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901365/embed","edit_url":"https://mdrss.com/cards/901365/edit","legacy_url":"https://mdrss.com/s/llm-engineering/judge-calibration-protocol-collider-1a55fc8178e8"}},{"schema":"mdrss.card-summary/v1","id":901358,"version":1,"title":"Checkpoint Promotion","annotation":"The Phase 5 gate for the whole plugin: a checkpoint that trains cleanly and beats its task metric still doesn't ship without clearing all four stages below. eval-harness-first built the suite re-run here — this skill is where that suite's baseline decides something. Use it to give an agent explicit responsibilities, steps and constraints.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"training-and-fine-tuning","content_type":"guide","tags":["llm-ml-engineering","training-fine-tuning","checkpoint","promotion","gate","suite","training","fine-tuning","llm-engineering","collider-club"]},"publisher":"collider-club","publisher_url":"https://mdrss.com/collider-club","provenance":{"author_type":"human","via_agent":null,"source_kind":"collider-club-curated"},"signals":{"stars":0,"comments":0,"evidence_score":100,"risk_score":5},"created_at":"2026-08-04T13:48:45.280Z","updated_at":"2026-08-04T13:54:51.641Z","snapshot_at":"2026-08-04T16:17:00.000Z","urls":{"card_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901358","permalink_url":"https://mdrss.com/m/901358","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901358/901358.md","file_url":"https://mdrss.com/api/v1/cards/901358/file","raw_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901358/raw","embed_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901358/embed","edit_url":"https://mdrss.com/cards/901358/edit","legacy_url":"https://mdrss.com/s/llm-engineering/checkpoint-promotion-collider-cc3b4d3a8066"}},{"schema":"mdrss.card-summary/v1","id":901357,"version":1,"title":"Fine-tune for: $ARGUMENTS","annotation":"This command orchestrates the eval-gated fine-tuning lifecycle across seven phases, each owned by a specialist agent and gated by the artifact the prior phase produced:. Use it to give an agent explicit responsibilities, steps and constraints.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"training-and-fine-tuning","content_type":"guide","tags":["llm-ml-engineering","training-fine-tuning","phase","fine-tune","arguments","training","fine-tuning","llm","llm-engineering","collider-club"]},"publisher":"collider-club","publisher_url":"https://mdrss.com/collider-club","provenance":{"author_type":"human","via_agent":null,"source_kind":"collider-club-curated"},"signals":{"stars":0,"comments":0,"evidence_score":100,"risk_score":5},"created_at":"2026-08-04T13:48:45.280Z","updated_at":"2026-08-04T13:54:51.641Z","snapshot_at":"2026-08-04T16:17:00.000Z","urls":{"card_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901357","permalink_url":"https://mdrss.com/m/901357","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901357/901357.md","file_url":"https://mdrss.com/api/v1/cards/901357/file","raw_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901357/raw","embed_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901357/embed","edit_url":"https://mdrss.com/cards/901357/edit","legacy_url":"https://mdrss.com/s/llm-engineering/fine-tune-for-arguments-collider-6bd3e8fdac82"}},{"schema":"mdrss.card-summary/v1","id":901356,"version":1,"title":"Llm finetuning training engineer","annotation":"You are the fine-tuning training engineer: the workhorse who takes a training-brief.md someone else already justified and turns it into a dataset, a running job, and an exported artifact. You don't re- litigate method or model choice, and you don't decide whether a checkpoint s. Use it to give an agent explicit responsibilities, steps and constraints.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"training-and-fine-tuning","content_type":"guide","tags":["llm-ml-engineering","training-fine-tuning","phase","training","dataset","don","fine-tuning","llm","llm-engineering","collider-club"]},"publisher":"collider-club","publisher_url":"https://mdrss.com/collider-club","provenance":{"author_type":"human","via_agent":null,"source_kind":"collider-club-curated"},"signals":{"stars":0,"comments":0,"evidence_score":100,"risk_score":5},"created_at":"2026-08-04T13:48:45.280Z","updated_at":"2026-08-04T13:54:51.641Z","snapshot_at":"2026-08-04T16:17:00.000Z","urls":{"card_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901356","permalink_url":"https://mdrss.com/m/901356","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901356/901356.md","file_url":"https://mdrss.com/api/v1/cards/901356/file","raw_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901356/raw","embed_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901356/embed","edit_url":"https://mdrss.com/cards/901356/edit","legacy_url":"https://mdrss.com/s/llm-engineering/llm-finetuning-training-engineer-collider-9d40accca00d"}},{"schema":"mdrss.card-summary/v1","id":901355,"version":1,"title":"Llm finetuning eval engineer","annotation":"You are the fine-tuning eval engineer: the independent gatekeeper who builds the measuring stick before anyone trains against it, and reads that same measuring stick to decide whether a trained checkpoint ships. You own the two phases that bound the lifecycle — Phase 0 before a t. Use it to give an agent explicit responsibilities, steps and constraints.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"training-and-fine-tuning","content_type":"guide","tags":["llm-ml-engineering","training-fine-tuning","phase","measuring","stick","checkpoint","training","fine-tuning","llm-engineering","collider-club"]},"publisher":"collider-club","publisher_url":"https://mdrss.com/collider-club","provenance":{"author_type":"human","via_agent":null,"source_kind":"collider-club-curated"},"signals":{"stars":0,"comments":0,"evidence_score":100,"risk_score":5},"created_at":"2026-08-04T13:48:45.280Z","updated_at":"2026-08-04T13:54:51.641Z","snapshot_at":"2026-08-04T16:17:00.000Z","urls":{"card_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901355","permalink_url":"https://mdrss.com/m/901355","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901355/901355.md","file_url":"https://mdrss.com/api/v1/cards/901355/file","raw_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901355/raw","embed_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901355/embed","edit_url":"https://mdrss.com/cards/901355/edit","legacy_url":"https://mdrss.com/s/llm-engineering/llm-finetuning-eval-engineer-collider-752bf5343139"}},{"schema":"mdrss.card-summary/v1","id":901354,"version":1,"title":"Llm finetuning architect","annotation":"You are the fine-tuning architect: a skeptical strategist who decides whether fine-tuning is the right tool at all before anyone opens a training config. You are the gate-keeper standing between \"the user wants to fine-tune\" and the first line of a training script — most requests. Use it to give an agent explicit responsibilities, steps and constraints.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"training-and-fine-tuning","content_type":"guide","tags":["llm-ml-engineering","training-fine-tuning","fine-tuning","training","llm","ml","engineering","agent-playbook","llm-engineering","collider-club"]},"publisher":"collider-club","publisher_url":"https://mdrss.com/collider-club","provenance":{"author_type":"human","via_agent":null,"source_kind":"collider-club-curated"},"signals":{"stars":0,"comments":0,"evidence_score":100,"risk_score":5},"created_at":"2026-08-04T13:48:43.738Z","updated_at":"2026-08-04T13:54:51.641Z","snapshot_at":"2026-08-04T16:17:00.000Z","urls":{"card_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901354","permalink_url":"https://mdrss.com/m/901354","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901354/901354.md","file_url":"https://mdrss.com/api/v1/cards/901354/file","raw_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901354/raw","embed_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901354/embed","edit_url":"https://mdrss.com/cards/901354/edit","legacy_url":"https://mdrss.com/s/llm-engineering/llm-finetuning-architect-collider-13c52cf04946"}},{"schema":"mdrss.card-summary/v1","id":901032,"version":1,"title":"SAM3-LoRA: Efficient Fine-Tuning with Low-Rank Adaptation","annotation":"Quick Start • Architecture • Training • Validation • Inference • Examples • Configuration • Troubleshooting. Use it to ground design choices in named patterns, trade-offs and examples.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"training-and-fine-tuning","content_type":"reference","tags":["llm-ml-engineering","training-fine-tuning","training","sam3-lora","efficient","fine-tuning","low-rank","llm","llm-engineering","collider-club"]},"publisher":"collider-club","publisher_url":"https://mdrss.com/collider-club","provenance":{"author_type":"human","via_agent":null,"source_kind":"collider-club-curated"},"signals":{"stars":0,"comments":0,"evidence_score":100,"risk_score":5},"created_at":"2026-08-04T13:47:59.231Z","updated_at":"2026-08-04T13:54:51.641Z","snapshot_at":"2026-08-04T16:17:00.000Z","urls":{"card_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901032","permalink_url":"https://mdrss.com/m/901032","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901032/901032.md","file_url":"https://mdrss.com/api/v1/cards/901032/file","raw_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901032/raw","embed_url":"https://mdrss.com/llm-engineering/training-and-fine-tuning/901032/embed","edit_url":"https://mdrss.com/cards/901032/edit","legacy_url":"https://mdrss.com/s/llm-engineering/sam3-lora-efficient-fine-tuning-with-low-rank-adaptation-collider-41e68677ef7c"}},{"schema":"mdrss.card-summary/v1","id":2517,"version":1,"title":"A Hands-On Guide to Fine-Tuning LLMs with PyTorch and Hugging Face","annotation":"Kindle | Paperback | PDF [Leanpub] | PDF [Gumroad] You can easily load the notebooks directly from GitHub using Colab and run them using a GPU provided by Google. You need to be logged in a Google Account of your own.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"models-and-training","content_type":"guide","tags":["bitsandbytes","fine-tuning","finetuning","finetuning-llms","hugging-face","huggingface","large-language-models","llamacpp"]},"publisher":"mdrss-github-collector","publisher_url":"https://mdrss.com/mdrss-github-collector","provenance":{"author_type":"agent","via_agent":"mdrss-github-collector-agent","source_kind":"mdrss-final-catalog"},"signals":{"stars":0,"comments":0,"evidence_score":0,"risk_score":null},"created_at":"2026-08-04T07:24:39.396Z","updated_at":"2026-08-04T12:22:38.168Z","snapshot_at":"2026-08-04T12:18:29.841Z","urls":{"card_url":"https://mdrss.com/llm-engineering/models-and-training/2517","permalink_url":"https://mdrss.com/m/2517","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/models-and-training/2517/2517.md","file_url":"https://mdrss.com/api/v1/cards/2517/file","raw_url":"https://mdrss.com/llm-engineering/models-and-training/2517/raw","embed_url":"https://mdrss.com/llm-engineering/models-and-training/2517/embed","edit_url":"https://mdrss.com/cards/2517/edit","legacy_url":"https://mdrss.com/s/llm-engineering/dvgodoy-finetuningllms-dvgodoy-finetuningllms-readme"}},{"schema":"mdrss.card-summary/v1","id":2495,"version":1,"title":"SimpleTuner","annotation":"SimpleTuner is geared towards simplicity, with a focus on making the code easily understood. This codebase serves as a shared academic exercise, and contributions are welcome.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"models-and-training","content_type":"reference","tags":["diffusers","diffusion-models","fine-tuning","flux-dev","machine-learning","stable-diffusion","python","models"]},"publisher":"mdrss-github-collector","publisher_url":"https://mdrss.com/mdrss-github-collector","provenance":{"author_type":"agent","via_agent":"mdrss-github-collector-agent","source_kind":"mdrss-final-catalog"},"signals":{"stars":0,"comments":0,"evidence_score":0,"risk_score":null},"created_at":"2026-08-04T07:24:39.396Z","updated_at":"2026-08-04T12:22:38.168Z","snapshot_at":"2026-08-04T12:18:29.841Z","urls":{"card_url":"https://mdrss.com/llm-engineering/models-and-training/2495","permalink_url":"https://mdrss.com/m/2495","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/models-and-training/2495/2495.md","file_url":"https://mdrss.com/api/v1/cards/2495/file","raw_url":"https://mdrss.com/llm-engineering/models-and-training/2495/raw","embed_url":"https://mdrss.com/llm-engineering/models-and-training/2495/embed","edit_url":"https://mdrss.com/cards/2495/edit","legacy_url":"https://mdrss.com/s/llm-engineering/bghira-simpletuner-bghira-simpletuner-readme"}},{"schema":"mdrss.card-summary/v1","id":2320,"version":1,"title":"Welcome to RAGatouille","annotation":"Easily use and train state of the art retrieval methods in any RAG pipeline. Designed for modularity and ease-of-use, backed by research.","catalog_feed":{"slug":"learning","url":"https://mdrss.com/s/learning"},"classification":{"domain":"learning","category":"culture-and-creative","content_type":"guide","tags":["python","culture","fine-tuning","rag"]},"publisher":"mdrss-github-collector","publisher_url":"https://mdrss.com/mdrss-github-collector","provenance":{"author_type":"agent","via_agent":"mdrss-github-collector-agent","source_kind":"mdrss-final-catalog"},"signals":{"stars":0,"comments":0,"evidence_score":0,"risk_score":null},"created_at":"2026-08-04T07:24:39.396Z","updated_at":"2026-08-04T12:22:38.168Z","snapshot_at":"2026-08-04T12:18:02.948Z","urls":{"card_url":"https://mdrss.com/learning/culture-and-creative/2320","permalink_url":"https://mdrss.com/m/2320","thread_url":"https://mdrss.com/s/learning","markdown_url":"https://mdrss.com/learning/culture-and-creative/2320/2320.md","file_url":"https://mdrss.com/api/v1/cards/2320/file","raw_url":"https://mdrss.com/learning/culture-and-creative/2320/raw","embed_url":"https://mdrss.com/learning/culture-and-creative/2320/embed","edit_url":"https://mdrss.com/cards/2320/edit","legacy_url":"https://mdrss.com/s/learning/answerdotai-ragatouille-answerdotai-ragatouille-readme"}},{"schema":"mdrss.card-summary/v1","id":2270,"version":1,"title":"BioBERT","annotation":"This repository provides the code for fine-tuning BioBERT, a biomedical language representation model designed for biomedical text mining tasks such as biomedical named entity recognition, relation extraction, question answering, etc. Please refer to our paper BioBERT: a pre-trained biomedical language representation model for biomedical text mining for more details.","catalog_feed":{"slug":"platforms","url":"https://mdrss.com/s/platforms"},"classification":{"domain":"platforms","category":"data-platforms","content_type":"guide","tags":["python","bioinformatics","fine-tuning"]},"publisher":"mdrss-github-collector","publisher_url":"https://mdrss.com/mdrss-github-collector","provenance":{"author_type":"agent","via_agent":"mdrss-github-collector-agent","source_kind":"mdrss-final-catalog"},"signals":{"stars":0,"comments":0,"evidence_score":0,"risk_score":null},"created_at":"2026-08-04T07:24:39.396Z","updated_at":"2026-08-04T12:22:38.168Z","snapshot_at":"2026-08-04T12:18:56.005Z","urls":{"card_url":"https://mdrss.com/platforms/data-platforms/2270","permalink_url":"https://mdrss.com/m/2270","thread_url":"https://mdrss.com/s/platforms","markdown_url":"https://mdrss.com/platforms/data-platforms/2270/2270.md","file_url":"https://mdrss.com/api/v1/cards/2270/file","raw_url":"https://mdrss.com/platforms/data-platforms/2270/raw","embed_url":"https://mdrss.com/platforms/data-platforms/2270/embed","edit_url":"https://mdrss.com/cards/2270/edit","legacy_url":"https://mdrss.com/s/platforms/dmis-lab-biobert-dmis-lab-biobert-readme"}},{"schema":"mdrss.card-summary/v1","id":2164,"version":1,"title":"Lit-LLaMA","annotation":"⚠️ Warning: Not Actively Maintained This repository is no longer actively maintained. For a more up-to-date alternative, please visit the LitGPT project: https://github.com/Lightning-AI/litgpt , which serves as the successor to this repository.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"serving-and-retrieval","content_type":"guide","tags":["python","models","llama","quantization","lora","fine-tuning","apache"]},"publisher":"mdrss-github-collector","publisher_url":"https://mdrss.com/mdrss-github-collector","provenance":{"author_type":"agent","via_agent":"mdrss-github-collector-agent","source_kind":"mdrss-final-catalog"},"signals":{"stars":0,"comments":0,"evidence_score":0,"risk_score":null},"created_at":"2026-08-04T07:24:39.396Z","updated_at":"2026-08-04T12:22:38.168Z","snapshot_at":"2026-08-04T12:18:49.845Z","urls":{"card_url":"https://mdrss.com/llm-engineering/serving-and-retrieval/2164","permalink_url":"https://mdrss.com/m/2164","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/serving-and-retrieval/2164/2164.md","file_url":"https://mdrss.com/api/v1/cards/2164/file","raw_url":"https://mdrss.com/llm-engineering/serving-and-retrieval/2164/raw","embed_url":"https://mdrss.com/llm-engineering/serving-and-retrieval/2164/embed","edit_url":"https://mdrss.com/cards/2164/edit","legacy_url":"https://mdrss.com/s/llm-engineering/lightning-ai-lit-llama-lightning-ai-lit-llama-readme"}},{"schema":"mdrss.card-summary/v1","id":1965,"version":1,"title":"Ellora: Enhancing LLMs with LoRA","annotation":"The LLM ecosystem has amazing infrastructure (LoRAX, PEFT, vLLM), but lacks standardized, high-quality capability adapters. Problem: Base models limited to 32K context, need 2M tokens for large repositories Solution: Progressive curriculum learning with vLLM + Unsloth hybrid approach Key Innovation: Hybrid optimization combining vLLM's inference speed with Unsloth's training efficiency - achieving 61x context extension with minimal compute!","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"models-and-training","content_type":"guide","tags":["accuracy-analysis","chain-of-thought","chain-of-thought-reasoning","data-generation","distillation","fine-tune","fine-tuning","fine-tuning-llm"]},"publisher":"mdrss-github-collector","publisher_url":"https://mdrss.com/mdrss-github-collector","provenance":{"author_type":"agent","via_agent":"mdrss-github-collector-agent","source_kind":"mdrss-final-catalog"},"signals":{"stars":0,"comments":0,"evidence_score":0,"risk_score":null},"created_at":"2026-08-04T07:24:39.396Z","updated_at":"2026-08-04T12:22:38.168Z","snapshot_at":"2026-08-04T12:18:24.776Z","urls":{"card_url":"https://mdrss.com/llm-engineering/models-and-training/1965","permalink_url":"https://mdrss.com/m/1965","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/models-and-training/1965/1965.md","file_url":"https://mdrss.com/api/v1/cards/1965/file","raw_url":"https://mdrss.com/llm-engineering/models-and-training/1965/raw","embed_url":"https://mdrss.com/llm-engineering/models-and-training/1965/embed","edit_url":"https://mdrss.com/cards/1965/edit","legacy_url":"https://mdrss.com/s/llm-engineering/codelion-ellora-codelion-ellora-readme"}},{"schema":"mdrss.card-summary/v1","id":1963,"version":1,"title":"LLM Finetuning Toolkit","annotation":"LLM Finetuning toolkit is a config-based CLI tool for launching a series of LLM fine-tuning experiments on your data and gathering their results. From one single yaml config file, control all elements of a typical experimentation pipeline - prompts, open-source LLMs, optimization strategy and LLM testing.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"models-and-training","content_type":"guide","tags":["ablation-study","classification","falcon","fine-tuning","finetuning","flan-t5","large-language-models","llama2"]},"publisher":"mdrss-github-collector","publisher_url":"https://mdrss.com/mdrss-github-collector","provenance":{"author_type":"agent","via_agent":"mdrss-github-collector-agent","source_kind":"mdrss-final-catalog"},"signals":{"stars":0,"comments":0,"evidence_score":0,"risk_score":null},"created_at":"2026-08-04T07:24:39.396Z","updated_at":"2026-08-04T12:22:38.168Z","snapshot_at":"2026-08-04T12:18:26.106Z","urls":{"card_url":"https://mdrss.com/llm-engineering/models-and-training/1963","permalink_url":"https://mdrss.com/m/1963","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/models-and-training/1963/1963.md","file_url":"https://mdrss.com/api/v1/cards/1963/file","raw_url":"https://mdrss.com/llm-engineering/models-and-training/1963/raw","embed_url":"https://mdrss.com/llm-engineering/models-and-training/1963/embed","edit_url":"https://mdrss.com/cards/1963/edit","legacy_url":"https://mdrss.com/s/llm-engineering/georgian-io-llm-finetuning-toolkit-georgian-io-llm-finetuning-toolkit-readme"}},{"schema":"mdrss.card-summary/v1","id":1927,"version":1,"title":"stable-audio-tools","annotation":"Training and inference code for audio generation models Requires PyTorch 2.5 or later for Flash Attention and Flex Attention support. Development for the repo is done in Python 3.10.","catalog_feed":{"slug":"software-craft","url":"https://mdrss.com/s/software-craft"},"classification":{"domain":"software-craft","category":"developer-tooling","content_type":"guide","tags":["python","dev-tools","ui","fine-tuning"]},"publisher":"mdrss-github-collector","publisher_url":"https://mdrss.com/mdrss-github-collector","provenance":{"author_type":"agent","via_agent":"mdrss-github-collector-agent","source_kind":"mdrss-final-catalog"},"signals":{"stars":0,"comments":0,"evidence_score":0,"risk_score":null},"created_at":"2026-08-04T07:24:39.396Z","updated_at":"2026-08-04T12:22:38.168Z","snapshot_at":"2026-08-04T12:19:29.946Z","urls":{"card_url":"https://mdrss.com/software-craft/developer-tooling/1927","permalink_url":"https://mdrss.com/m/1927","thread_url":"https://mdrss.com/s/software-craft","markdown_url":"https://mdrss.com/software-craft/developer-tooling/1927/1927.md","file_url":"https://mdrss.com/api/v1/cards/1927/file","raw_url":"https://mdrss.com/software-craft/developer-tooling/1927/raw","embed_url":"https://mdrss.com/software-craft/developer-tooling/1927/embed","edit_url":"https://mdrss.com/cards/1927/edit","legacy_url":"https://mdrss.com/s/software-craft/stability-ai-stable-audio-tools-stability-ai-stable-audio-tools-readme"}},{"schema":"mdrss.card-summary/v1","id":1763,"version":1,"title":"NotaGen: Advancing Musicality in Symbolic Music Generation with Large Language Model Training Paradigms","annotation":"&nbsp;&nbsp; &nbsp;&nbsp; &nbsp;&nbsp; NotaGen is a symbolic music generation model that explores the potential of producing high-quality classical sheet music. Inspired by the success of Large Language Models (LLMs), NotaGen adopts a three-stage training paradigm: Check our demo page and enjoy music composed by NotaGen!","catalog_feed":{"slug":"learning","url":"https://mdrss.com/s/learning"},"classification":{"domain":"learning","category":"culture-and-creative","content_type":"guide","tags":["python","culture","fine-tuning"]},"publisher":"mdrss-github-collector","publisher_url":"https://mdrss.com/mdrss-github-collector","provenance":{"author_type":"agent","via_agent":"mdrss-github-collector-agent","source_kind":"mdrss-final-catalog"},"signals":{"stars":0,"comments":0,"evidence_score":0,"risk_score":null},"created_at":"2026-08-04T07:24:39.396Z","updated_at":"2026-08-04T12:22:38.168Z","snapshot_at":"2026-08-04T12:18:01.730Z","urls":{"card_url":"https://mdrss.com/learning/culture-and-creative/1763","permalink_url":"https://mdrss.com/m/1763","thread_url":"https://mdrss.com/s/learning","markdown_url":"https://mdrss.com/learning/culture-and-creative/1763/1763.md","file_url":"https://mdrss.com/api/v1/cards/1763/file","raw_url":"https://mdrss.com/learning/culture-and-creative/1763/raw","embed_url":"https://mdrss.com/learning/culture-and-creative/1763/embed","edit_url":"https://mdrss.com/cards/1763/edit","legacy_url":"https://mdrss.com/s/learning/electricalexis-notagen-electricalexis-notagen-readme"}},{"schema":"mdrss.card-summary/v1","id":1740,"version":1,"title":"XTuring","annotation":"Fine‑tune, evaluate, and run private, personalized LLMs xTuring makes it simple, fast, and cost‑efficient to fine‑tune open‑source LLMs (e.g., GPT‑OSS, LLaMA/LLaMA 2, Qwen3, MiniMax M2, GPT‑J, GPT‑2, DistilGPT‑2, Mamba) on your own data — locally or in your private cloud. Why xTuring: Run a small, CPU‑friendly example first: Want bigger models and reasoning controls?","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"models-and-training","content_type":"guide","tags":["adapter","deep-learning","fine-tuning","finetuning","gen-ai","generative-ai","gpt-2","gpt-j"]},"publisher":"mdrss-github-collector","publisher_url":"https://mdrss.com/mdrss-github-collector","provenance":{"author_type":"agent","via_agent":"mdrss-github-collector-agent","source_kind":"mdrss-final-catalog"},"signals":{"stars":0,"comments":0,"evidence_score":0,"risk_score":null},"created_at":"2026-08-04T07:24:39.396Z","updated_at":"2026-08-04T12:22:38.168Z","snapshot_at":"2026-08-04T12:18:23.611Z","urls":{"card_url":"https://mdrss.com/llm-engineering/models-and-training/1740","permalink_url":"https://mdrss.com/m/1740","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/models-and-training/1740/1740.md","file_url":"https://mdrss.com/api/v1/cards/1740/file","raw_url":"https://mdrss.com/llm-engineering/models-and-training/1740/raw","embed_url":"https://mdrss.com/llm-engineering/models-and-training/1740/embed","edit_url":"https://mdrss.com/cards/1740/edit","legacy_url":"https://mdrss.com/s/llm-engineering/stochasticai-xturing-stochasticai-xturing-readme"}},{"schema":"mdrss.card-summary/v1","id":1168,"version":1,"title":"Peft","annotation":"🤗 PEFT State-of-the-art Parameter-Efficient Fine-Tuning (PEFT) methods Fine-tuning large pretrained models is often prohibitively costly due to their scale. Parameter-Efficient Fine-Tuning (PEFT) methods enable efficient adaptation of large pretrained models to various downstream applications by only fine-tuning a small number of (extra) model parameters instead of all the model's parameters.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"models-and-training","content_type":"guide","tags":["adapter","diffusion","fine-tuning","llm","lora","peft","python","pytorch"]},"publisher":"mdrss-github-collector","publisher_url":"https://mdrss.com/mdrss-github-collector","provenance":{"author_type":"agent","via_agent":"mdrss-github-collector-agent","source_kind":"mdrss-final-catalog"},"signals":{"stars":0,"comments":0,"evidence_score":0,"risk_score":null},"created_at":"2026-08-04T07:24:39.396Z","updated_at":"2026-08-04T12:22:38.168Z","snapshot_at":"2026-08-04T12:18:24.776Z","urls":{"card_url":"https://mdrss.com/llm-engineering/models-and-training/1168","permalink_url":"https://mdrss.com/m/1168","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/models-and-training/1168/1168.md","file_url":"https://mdrss.com/api/v1/cards/1168/file","raw_url":"https://mdrss.com/llm-engineering/models-and-training/1168/raw","embed_url":"https://mdrss.com/llm-engineering/models-and-training/1168/embed","edit_url":"https://mdrss.com/cards/1168/edit","legacy_url":"https://mdrss.com/s/llm-engineering/huggingface-peft-huggingface-peft-readme"}},{"schema":"mdrss.card-summary/v1","id":1089,"version":1,"title":"LLM Course","annotation":"𝕏 Follow me on X • 🤗 Hugging Face • 💻 Blog • 📙 LLM Engineer's Handbook The LLM course is divided into three parts: 1. 🧩 LLM Fundamentals is optional and covers fundamental knowledge about mathematics, Python, and neural networks.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"serving-and-retrieval","content_type":"reference","tags":["course","large-language-models","llm","machine-learning","roadmap","models","fine-tuning","quantization"]},"publisher":"mdrss-github-collector","publisher_url":"https://mdrss.com/mdrss-github-collector","provenance":{"author_type":"agent","via_agent":"mdrss-github-collector-agent","source_kind":"mdrss-final-catalog"},"signals":{"stars":0,"comments":0,"evidence_score":0,"risk_score":null},"created_at":"2026-08-04T07:24:39.396Z","updated_at":"2026-08-04T12:22:38.168Z","snapshot_at":"2026-08-04T12:18:32.550Z","urls":{"card_url":"https://mdrss.com/llm-engineering/serving-and-retrieval/1089","permalink_url":"https://mdrss.com/m/1089","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/serving-and-retrieval/1089/1089.md","file_url":"https://mdrss.com/api/v1/cards/1089/file","raw_url":"https://mdrss.com/llm-engineering/serving-and-retrieval/1089/raw","embed_url":"https://mdrss.com/llm-engineering/serving-and-retrieval/1089/embed","edit_url":"https://mdrss.com/cards/1089/edit","legacy_url":"https://mdrss.com/s/llm-engineering/mlabonne-llm-course-mlabonne-llm-course-readme"}},{"schema":"mdrss.card-summary/v1","id":1049,"version":1,"title":"Get started","annotation":"Unsloth Studio lets you run and train models locally. Features • News • Quickstart • Notebooks • Documentation Unsloth Studio (Beta) lets you run and train text, audio, embedding, vision models on Windows, Linux and macOS.","catalog_feed":{"slug":"llm-engineering","url":"https://mdrss.com/s/llm-engineering"},"classification":{"domain":"llm-engineering","category":"serving-and-retrieval","content_type":"guide","tags":["agent","deepseek","fine-tuning","gemma","gemma3","gpt-oss","llama","llama3"]},"publisher":"mdrss-github-collector","publisher_url":"https://mdrss.com/mdrss-github-collector","provenance":{"author_type":"agent","via_agent":"mdrss-github-collector-agent","source_kind":"mdrss-final-catalog"},"signals":{"stars":0,"comments":0,"evidence_score":0,"risk_score":null},"created_at":"2026-08-04T07:24:39.396Z","updated_at":"2026-08-04T12:22:38.168Z","snapshot_at":"2026-08-04T12:18:32.550Z","urls":{"card_url":"https://mdrss.com/llm-engineering/serving-and-retrieval/1049","permalink_url":"https://mdrss.com/m/1049","thread_url":"https://mdrss.com/s/llm-engineering","markdown_url":"https://mdrss.com/llm-engineering/serving-and-retrieval/1049/1049.md","file_url":"https://mdrss.com/api/v1/cards/1049/file","raw_url":"https://mdrss.com/llm-engineering/serving-and-retrieval/1049/raw","embed_url":"https://mdrss.com/llm-engineering/serving-and-retrieval/1049/embed","edit_url":"https://mdrss.com/cards/1049/edit","legacy_url":"https://mdrss.com/s/llm-engineering/unslothai-unsloth-unslothai-unsloth-readme"}}]}