Stemma Machinarum

Stemma Machinarum

A genealogy of machine-learning models, starting with open-weight language models. It records which model descends from which, what changed at each step, and the evidence for every claim.

The name comes from textual criticism: a stemma is the family tree of manuscript copies, and stemmatics already has a term, contamination, for a copy that draws on two lines at once. Distillation and model merging are contamination in exactly that sense, so the structure here is a network, not a strict tree.

It is built for people and for LLM agents alike. More about the project.

2022-11 2022-12 2023-01 2023-02 2023-03 2023-04 2023-05 2023-06 2023-07 2023-08 2023-09 2023-10 2023-11 2023-12 2024-01 Closed · known by outputs Datasets Open weights alpaca-7b ← fine_tuned_from ← llama-7b (declared) llama-2-7b-chat ← fine_tuned_from ← llama-2-7b (declared) llama-2-7b ← successor_in_series ← llama-7b (declared) code-llama-7b ← fine_tuned_from ← llama-2-7b (declared) vicuna-7b-v1-3 ← fine_tuned_from ← llama-7b (declared) alpaca-52k ← distilled_from_outputs ← text-davinci-003 (declared) alpaca-7b ← trained_on ← alpaca-52k (declared) sharegpt-vicuna ← distilled_from_outputs ← chatgpt (declared) vicuna-7b-v1-3 ← trained_on ← sharegpt-vicuna (declared) ultrafeedback ← feedback_from ← gpt-4 (declared) codellama-7b-instruct ← fine_tuned_from ← code-llama-7b (declared) codellama-7b-python ← fine_tuned_from ← code-llama-7b (declared) llama-2-13b ← successor_in_series ← llama-7b (declared) llama-2-70b ← successor_in_series ← llama-7b (declared) nous-hermes-llama-2-7b ← fine_tuned_from ← llama-2-7b (declared_by_uploader) open-llama-7b ← design_follows ← llama-7b (declared) vicuna-7b-v1-5 ← fine_tuned_from ← llama-2-7b (declared) vicuna-7b-v1-5 ← trained_on ← sharegpt-vicuna (declared) vicuna-13b-v1-5 ← fine_tuned_from ← llama-2-13b (declared) vicuna-13b-v1-5 ← trained_on ← sharegpt-vicuna (declared) wizardlm-13b-v1-2 ← fine_tuned_from ← llama-2-13b (declared_by_uploader) openorca ← distilled_from_outputs ← gpt-4 (declared) openorca ← distilled_from_outputs ← chatgpt (declared) baize ← distilled_from_outputs ← chatgpt (declared) alpaca-cleaned ← distilled_from_outputs ← text-davinci-003 (declared) tulu-v2-sft-mixture ← distilled_from_outputs ← gpt-4 (declared) orca-1-data ← distilled_from_outputs ← chatgpt (declared) orca-1-data ← distilled_from_outputs ← gpt-4 (declared) orca-2-data ← distilled_from_outputs ← gpt-4 (declared) baize-sdf ← feedback_from ← chatgpt (declared) alpaca-lora-7b ← adapter_on ← llama-7b (declared) alpaca-lora-7b ← trained_on ← alpaca-cleaned (declared) baize-v2-7b ← fine_tuned_from ← llama-7b (declared) baize-v2-7b ← trained_on ← baize (declared) baize-v2-7b ← trained_on ← baize-sdf (declared) guanaco-7b ← adapter_on ← llama-7b (declared) guanaco-7b ← trained_on ← oasst1 (declared) openorcaxopenchat-preview2-13b ← fine_tuned_from ← llama-2-13b (declared) openorcaxopenchat-preview2-13b ← trained_on ← openorca (declared) orca-2-7b ← fine_tuned_from ← llama-2-7b (declared) orca-2-7b ← trained_on ← flan-v2 (declared) orca-2-7b ← trained_on ← orca-1-data (declared) orca-2-7b ← trained_on ← orca-2-data (declared) platypus2-13b ← fine_tuned_from ← llama-2-13b (declared) platypus2-13b ← trained_on ← open-platypus (declared) tinyllama-1-1b-intermediate-step-1431k-3t ← same_architecture_retrained ← llama-2-7b (declared) tinyllama-1-1b-intermediate-step-1431k-3t ← trained_on ← slimpajama (declared) tinyllama-1-1b-intermediate-step-1431k-3t ← trained_on ← starcoderdata (declared) tulu-2-7b ← fine_tuned_from ← llama-2-7b (declared) tulu-2-7b ← trained_on ← tulu-v2-sft-mixture (declared) openorca-platypus2-13b ← merged_from ← platypus2-13b (declared) openorca-platypus2-13b ← merged_from ← openorcaxopenchat-preview2-13b (declared) tulu-2-dpo-7b ← fine_tuned_from ← tulu-2-7b (declared) tulu-2-dpo-7b ← trained_on ← ultrafeedback (declared) text-davinci-003closedtext-davinci-003 ChatGPTclosedChatGPT (Nov. 2022 launch model) GPT-4closedGPT-4 (Mar. 2023) FLAN v22023-01-31FLAN-v2 Collection (Flan 2022) Alpaca 52K2023-03-13Alpaca instruction data (52K) Alpaca-cleaned2023-03-24Alpaca-Cleaned Baize data2023-04-03Baize self-chat data Baize SDF2023-04-03Baize SDF data (ChatGPT-ranked self-generations) StarCoderData2023-03-30StarCoderData OASST12023-04-14OpenAssistant Conversations (OASST1) Orca 1 data2023-06-05Orca 1 explanation-tuning data (FLAN-5M / FLAN-1M) OpenOrca2023-06-15OpenOrca Open-Platypus2023-08-03Open-Platypus UltraFeedback2023-10-02UltraFeedback Tulu v2 mix2023-11-13Tulu V2 SFT mixture Orca 2 data2023-11-18Orca 2 dataset (~817K) Alpaca 7B2023-03-13Alpaca 7B Alpaca-LoRA 7B2023-03-14alpaca-lora-7b Guanaco 7B2023-05-22guanaco-7b Baize v2 7B2023-05-23Baize v2 7B Vicuna 7B v1.32023-06-22Vicuna 7B v1.3 Vicuna 7B v1.52023-08-01vicuna-7b-v1.5 OpenLLaMA 7B2023-06-07open_llama_7b LLaMA 7B2023-02-24LLaMA 7B Llama 2 7B2023-07-18Llama 2 7B Code Llama 7B2023-08-24Code Llama 7B … Instruct2023-08-24CodeLlama-7b-Instruct-hf … Python2023-08-24CodeLlama-7b-Python-hf Llama 2-Chat 7B2023-07-18Llama 2-Chat 7B Nous-Hermes 7B2023-07-25Nous-Hermes-llama-2-7b Llama 2 13B2023-07-18Llama-2-13b-hf WizardLM 13B2023-07-25WizardLM-13B-V1.2 Vicuna 13B v1.52023-08-01vicuna-13b-v1.5 OpenOrca-Preview22023-07-31OpenOrcaxOpenChat-Preview2-13B Platypus2 13B2023-08-05Platypus2-13B OpenOrca-Platypus22023-08-11OpenOrca-Platypus2-13B Llama 2 70B2023-07-18Llama-2-70b-hf ?parents not recordedMythoLogic-L2-13b: no parents recorded in Stemma MythoLogic 13B2023-08-03MythoLogic-L2-13b ?parents not recordedMythoMax-L2-13b: no parents recorded in Stemma MythoMax 13B2023-08-10MythoMax-L2-13b Tulu 2 7B2023-11-13Tulu 2 7B Tulu 2-DPO 7B2023-11-13Tulu 2 DPO 7B Orca 2 7B2023-11-18Orca 2 7B TinyLlama 1.1B2023-12-28TinyLlama-1.1B (intermediate-step-1431k-3T) ShareGPTundatedShareGPT conversations (LMSYS collection) SlimPajamaundatedSlimPajama alpaca-52k ← distilled_from_outputs ← text-davinci-003 (declared) alpaca-cleaned ← distilled_from_outputs ← text-davinci-003 (declared) alpaca-7b ← trained_on ← alpaca-52k (declared) alpaca-lora-7b ← trained_on ← alpaca-cleaned (declared) guanaco-7b ← trained_on ← oasst1 (declared) sharegpt-vicuna ← distilled_from_outputs ← chatgpt (declared) openorca ← distilled_from_outputs ← chatgpt (declared) baize ← distilled_from_outputs ← chatgpt (declared) orca-1-data ← distilled_from_outputs ← chatgpt (declared) baize-sdf ← feedback_from ← chatgpt (declared) baize-v2-7b ← trained_on ← baize (declared) baize-v2-7b ← trained_on ← baize-sdf (declared) vicuna-7b-v1-3 ← trained_on ← sharegpt-vicuna (declared) vicuna-7b-v1-5 ← trained_on ← sharegpt-vicuna (declared) vicuna-13b-v1-5 ← trained_on ← sharegpt-vicuna (declared) ultrafeedback ← feedback_from ← gpt-4 (declared) openorca ← distilled_from_outputs ← gpt-4 (declared) tulu-v2-sft-mixture ← distilled_from_outputs ← gpt-4 (declared) orca-1-data ← distilled_from_outputs ← gpt-4 (declared) orca-2-data ← distilled_from_outputs ← gpt-4 (declared) tulu-2-7b ← trained_on ← tulu-v2-sft-mixture (declared) tulu-2-dpo-7b ← trained_on ← ultrafeedback (declared) orca-2-7b ← trained_on ← flan-v2 (declared) orca-2-7b ← trained_on ← orca-1-data (declared) orca-2-7b ← trained_on ← orca-2-data (declared) tinyllama-1-1b-intermediate-step-1431k-3t ← trained_on ← slimpajama (declared) tinyllama-1-1b-intermediate-step-1431k-3t ← trained_on ← starcoderdata (declared) openorcaxopenchat-preview2-13b ← trained_on ← openorca (declared) platypus2-13b ← trained_on ← open-platypus (declared) llama-2-7b ← successor_in_series ← llama-7b (declared) llama-2-13b ← successor_in_series ← llama-7b (declared) llama-2-70b ← successor_in_series ← llama-7b (declared) open-llama-7b ← design_follows ← llama-7b (declared) tinyllama-1-1b-intermediate-step-1431k-3t ← same_architecture_retrained ← llama-2-7b (declared) alpaca-7b ← fine_tuned_from ← llama-7b (declared) llama-2-7b-chat ← fine_tuned_from ← llama-2-7b (declared) code-llama-7b ← fine_tuned_from ← llama-2-7b (declared) vicuna-7b-v1-3 ← fine_tuned_from ← llama-7b (declared) codellama-7b-instruct ← fine_tuned_from ← code-llama-7b (declared) codellama-7b-python ← fine_tuned_from ← code-llama-7b (declared) nous-hermes-llama-2-7b ← fine_tuned_from ← llama-2-7b (declared_by_uploader) vicuna-7b-v1-5 ← fine_tuned_from ← llama-2-7b (declared) vicuna-13b-v1-5 ← fine_tuned_from ← llama-2-13b (declared) wizardlm-13b-v1-2 ← fine_tuned_from ← llama-2-13b (declared_by_uploader) alpaca-lora-7b ← adapter_on ← llama-7b (declared) baize-v2-7b ← fine_tuned_from ← llama-7b (declared) guanaco-7b ← adapter_on ← llama-7b (declared) openorcaxopenchat-preview2-13b ← fine_tuned_from ← llama-2-13b (declared) orca-2-7b ← fine_tuned_from ← llama-2-7b (declared) platypus2-13b ← fine_tuned_from ← llama-2-13b (declared) tulu-2-7b ← fine_tuned_from ← llama-2-7b (declared) openorca-platypus2-13b ← merged_from ← platypus2-13b (declared) tulu-2-dpo-7b ← fine_tuned_from ← tulu-2-7b (declared) openorca-platypus2-13b ← merged_from ← openorcaxopenchat-preview2-13b (declared) text-davinci-003 closedtext-davinci-003 Alpaca 52K 2023-03-13Alpaca instruction data (52K) Alpaca-cleaned 2023-03-24Alpaca-Cleaned OASST1 2023-04-14OpenAssistant Conversations (OASST1) ChatGPT closedChatGPT (Nov. 2022 launch model) Baize data 2023-04-03Baize self-chat data Baize SDF 2023-04-03Baize SDF data (ChatGPT-ranked self-generations) ShareGPT undatedShareGPT conversations (LMSYS collection) GPT-4 closedGPT-4 (Mar. 2023) Tulu v2 mix 2023-11-13Tulu V2 SFT mixture UltraFeedback 2023-10-02UltraFeedback FLAN v2 2023-01-31FLAN-v2 Collection (Flan 2022) Orca 1 data 2023-06-05Orca 1 explanation-tuning data (FLAN-5M / FLAN-1M) Orca 2 data 2023-11-18Orca 2 dataset (~817K) SlimPajama undatedSlimPajama StarCoderData 2023-03-30StarCoderData OpenOrca 2023-06-15OpenOrca Open-Platypus 2023-08-03Open-Platypus LLaMA 7B2023-02-24LLaMA 7B Alpaca 7B2023-03-13Alpaca 7B Alpaca-LoRA 7B2023-03-14alpaca-lora-7b Guanaco 7B2023-05-22guanaco-7b Baize v2 7B2023-05-23Baize v2 7B OpenLLaMA 7B2023-06-07open_llama_7b Vicuna 7B v1.32023-06-22Vicuna 7B v1.3 Llama 2 7B2023-07-18Llama 2 7B Llama 2-Chat 7B2023-07-18Llama 2-Chat 7B Nous-Hermes 7B2023-07-25Nous-Hermes-llama-2-7b Vicuna 7B v1.52023-08-01vicuna-7b-v1.5 Code Llama 7B2023-08-24Code Llama 7B … Instruct2023-08-24CodeLlama-7b-Instruct-hf … Python2023-08-24CodeLlama-7b-Python-hf Tulu 2 7B2023-11-13Tulu 2 7B Tulu 2-DPO 7B2023-11-13Tulu 2 DPO 7B Orca 2 7B2023-11-18Orca 2 7B TinyLlama 1.1B2023-12-28TinyLlama-1.1B (intermediate-step-1431k-3T) Llama 2 13B2023-07-18Llama-2-13b-hf WizardLM 13B2023-07-25WizardLM-13B-V1.2 OpenOrca-Preview22023-07-31OpenOrcaxOpenChat-Preview2-13B Vicuna 13B v1.52023-08-01vicuna-13b-v1.5 Platypus2 13B2023-08-05Platypus2-13B OpenOrca-Platypus22023-08-11OpenOrca-Platypus2-13B Llama 2 70B2023-07-18Llama-2-70b-hf ? MythoLogic 13B2023-08-03 · parents not recordedMythoLogic-L2-13b ? MythoMax 13B2023-08-10 · parents not recordedMythoMax-L2-13b See the whole family →

The LLaMA family, drawn as a manuscript stemma. Dashed lines are contamination: text written by closed models (hollow) that became training data for open ones.

96models
33datasets
154edges

Last data change: 2026-09-24. Counts are computed from the data at build time.

The Graph

Every model and dataset, every lineage edge, each with an evidence tag and a source. Raw JSON is served as-is.

The stemma · Browse records · edges.jsonl

The Notebook

The reading path through the primary sources, with dated notes and hands-on exercises. Each station links to the records it produced.

Follow the path · 0 of 6 stations read · 0 notes

Evidence tags

Every edge carries one. Definitions are in the method.