Stemma Machinarum

The stemma

The stemma

Two families so far, drawn by hand. Each is its own drawing: a model appears in the family its weights descend from, so a Llama-2-derived reward model that feeds a Mistral-family policy (Starling) is shown as a dashed link back to the LLaMA drawing, not repeated.

The LLaMA family

Textual critics draw the family tree of a text’s manuscripts as a stemma: the oldest copies at the top, each copy below the one it was made from. This is the same drawing for one family of language models, from LLaMA (February 2023) through Llama 2, Code Llama, TinyLlama, and the fine-tunes, adapters and merges built on them.

Time runs down the page. The hollow circles at the top left are closed models: their weights were never published, so, like a lost manuscript, they are known only through what descends from them. The dashed lines are what stemmatics calls contamination: text written or graded by those closed models became the training data for Alpaca, Vicuna, Baize, Orca, Tulu and others, so those open models draw on two lines at once.

2022-11 2022-12 2023-01 2023-02 2023-03 2023-04 2023-05 2023-06 2023-07 2023-08 2023-09 2023-10 2023-11 2023-12 2024-01 Closed · known by outputs Datasets Open weights alpaca-7b ← fine_tuned_from ← llama-7b (declared) llama-2-7b-chat ← fine_tuned_from ← llama-2-7b (declared) llama-2-7b ← successor_in_series ← llama-7b (declared) code-llama-7b ← fine_tuned_from ← llama-2-7b (declared) vicuna-7b-v1-3 ← fine_tuned_from ← llama-7b (declared) alpaca-52k ← distilled_from_outputs ← text-davinci-003 (declared) alpaca-7b ← trained_on ← alpaca-52k (declared) sharegpt-vicuna ← distilled_from_outputs ← chatgpt (declared) vicuna-7b-v1-3 ← trained_on ← sharegpt-vicuna (declared) ultrafeedback ← feedback_from ← gpt-4 (declared) codellama-7b-instruct ← fine_tuned_from ← code-llama-7b (declared) codellama-7b-python ← fine_tuned_from ← code-llama-7b (declared) llama-2-13b ← successor_in_series ← llama-7b (declared) llama-2-70b ← successor_in_series ← llama-7b (declared) nous-hermes-llama-2-7b ← fine_tuned_from ← llama-2-7b (declared_by_uploader) open-llama-7b ← design_follows ← llama-7b (declared) vicuna-7b-v1-5 ← fine_tuned_from ← llama-2-7b (declared) vicuna-7b-v1-5 ← trained_on ← sharegpt-vicuna (declared) vicuna-13b-v1-5 ← fine_tuned_from ← llama-2-13b (declared) vicuna-13b-v1-5 ← trained_on ← sharegpt-vicuna (declared) wizardlm-13b-v1-2 ← fine_tuned_from ← llama-2-13b (declared_by_uploader) openorca ← distilled_from_outputs ← gpt-4 (declared) openorca ← distilled_from_outputs ← chatgpt (declared) baize ← distilled_from_outputs ← chatgpt (declared) alpaca-cleaned ← distilled_from_outputs ← text-davinci-003 (declared) tulu-v2-sft-mixture ← distilled_from_outputs ← gpt-4 (declared) orca-1-data ← distilled_from_outputs ← chatgpt (declared) orca-1-data ← distilled_from_outputs ← gpt-4 (declared) orca-2-data ← distilled_from_outputs ← gpt-4 (declared) baize-sdf ← feedback_from ← chatgpt (declared) alpaca-lora-7b ← adapter_on ← llama-7b (declared) alpaca-lora-7b ← trained_on ← alpaca-cleaned (declared) baize-v2-7b ← fine_tuned_from ← llama-7b (declared) baize-v2-7b ← trained_on ← baize (declared) baize-v2-7b ← trained_on ← baize-sdf (declared) guanaco-7b ← adapter_on ← llama-7b (declared) guanaco-7b ← trained_on ← oasst1 (declared) openorcaxopenchat-preview2-13b ← fine_tuned_from ← llama-2-13b (declared) openorcaxopenchat-preview2-13b ← trained_on ← openorca (declared) orca-2-7b ← fine_tuned_from ← llama-2-7b (declared) orca-2-7b ← trained_on ← flan-v2 (declared) orca-2-7b ← trained_on ← orca-1-data (declared) orca-2-7b ← trained_on ← orca-2-data (declared) platypus2-13b ← fine_tuned_from ← llama-2-13b (declared) platypus2-13b ← trained_on ← open-platypus (declared) tinyllama-1-1b-intermediate-step-1431k-3t ← same_architecture_retrained ← llama-2-7b (declared) tinyllama-1-1b-intermediate-step-1431k-3t ← trained_on ← slimpajama (declared) tinyllama-1-1b-intermediate-step-1431k-3t ← trained_on ← starcoderdata (declared) tulu-2-7b ← fine_tuned_from ← llama-2-7b (declared) tulu-2-7b ← trained_on ← tulu-v2-sft-mixture (declared) openorca-platypus2-13b ← merged_from ← platypus2-13b (declared) openorca-platypus2-13b ← merged_from ← openorcaxopenchat-preview2-13b (declared) tulu-2-dpo-7b ← fine_tuned_from ← tulu-2-7b (declared) tulu-2-dpo-7b ← trained_on ← ultrafeedback (declared) text-davinci-003closedtext-davinci-003 ChatGPTclosedChatGPT (Nov. 2022 launch model) GPT-4closedGPT-4 (Mar. 2023) FLAN v22023-01-31FLAN-v2 Collection (Flan 2022) Alpaca 52K2023-03-13Alpaca instruction data (52K) Alpaca-cleaned2023-03-24Alpaca-Cleaned Baize data2023-04-03Baize self-chat data Baize SDF2023-04-03Baize SDF data (ChatGPT-ranked self-generations) StarCoderData2023-03-30StarCoderData OASST12023-04-14OpenAssistant Conversations (OASST1) Orca 1 data2023-06-05Orca 1 explanation-tuning data (FLAN-5M / FLAN-1M) OpenOrca2023-06-15OpenOrca Open-Platypus2023-08-03Open-Platypus UltraFeedback2023-10-02UltraFeedback Tulu v2 mix2023-11-13Tulu V2 SFT mixture Orca 2 data2023-11-18Orca 2 dataset (~817K) Alpaca 7B2023-03-13Alpaca 7B Alpaca-LoRA 7B2023-03-14alpaca-lora-7b Guanaco 7B2023-05-22guanaco-7b Baize v2 7B2023-05-23Baize v2 7B Vicuna 7B v1.32023-06-22Vicuna 7B v1.3 Vicuna 7B v1.52023-08-01vicuna-7b-v1.5 OpenLLaMA 7B2023-06-07open_llama_7b LLaMA 7B2023-02-24LLaMA 7B Llama 2 7B2023-07-18Llama 2 7B Code Llama 7B2023-08-24Code Llama 7B … Instruct2023-08-24CodeLlama-7b-Instruct-hf … Python2023-08-24CodeLlama-7b-Python-hf Llama 2-Chat 7B2023-07-18Llama 2-Chat 7B Nous-Hermes 7B2023-07-25Nous-Hermes-llama-2-7b Llama 2 13B2023-07-18Llama-2-13b-hf WizardLM 13B2023-07-25WizardLM-13B-V1.2 Vicuna 13B v1.52023-08-01vicuna-13b-v1.5 OpenOrca-Preview22023-07-31OpenOrcaxOpenChat-Preview2-13B Platypus2 13B2023-08-05Platypus2-13B OpenOrca-Platypus22023-08-11OpenOrca-Platypus2-13B Llama 2 70B2023-07-18Llama-2-70b-hf ?parents not recordedMythoLogic-L2-13b: no parents recorded in Stemma MythoLogic 13B2023-08-03MythoLogic-L2-13b ?parents not recordedMythoMax-L2-13b: no parents recorded in Stemma MythoMax 13B2023-08-10MythoMax-L2-13b Tulu 2 7B2023-11-13Tulu 2 7B Tulu 2-DPO 7B2023-11-13Tulu 2 DPO 7B Orca 2 7B2023-11-18Orca 2 7B TinyLlama 1.1B2023-12-28TinyLlama-1.1B (intermediate-step-1431k-3T) ShareGPTundatedShareGPT conversations (LMSYS collection) SlimPajamaundatedSlimPajama
alpaca-52k ← distilled_from_outputs ← text-davinci-003 (declared) alpaca-cleaned ← distilled_from_outputs ← text-davinci-003 (declared) alpaca-7b ← trained_on ← alpaca-52k (declared) alpaca-lora-7b ← trained_on ← alpaca-cleaned (declared) guanaco-7b ← trained_on ← oasst1 (declared) sharegpt-vicuna ← distilled_from_outputs ← chatgpt (declared) openorca ← distilled_from_outputs ← chatgpt (declared) baize ← distilled_from_outputs ← chatgpt (declared) orca-1-data ← distilled_from_outputs ← chatgpt (declared) baize-sdf ← feedback_from ← chatgpt (declared) baize-v2-7b ← trained_on ← baize (declared) baize-v2-7b ← trained_on ← baize-sdf (declared) vicuna-7b-v1-3 ← trained_on ← sharegpt-vicuna (declared) vicuna-7b-v1-5 ← trained_on ← sharegpt-vicuna (declared) vicuna-13b-v1-5 ← trained_on ← sharegpt-vicuna (declared) ultrafeedback ← feedback_from ← gpt-4 (declared) openorca ← distilled_from_outputs ← gpt-4 (declared) tulu-v2-sft-mixture ← distilled_from_outputs ← gpt-4 (declared) orca-1-data ← distilled_from_outputs ← gpt-4 (declared) orca-2-data ← distilled_from_outputs ← gpt-4 (declared) tulu-2-7b ← trained_on ← tulu-v2-sft-mixture (declared) tulu-2-dpo-7b ← trained_on ← ultrafeedback (declared) orca-2-7b ← trained_on ← flan-v2 (declared) orca-2-7b ← trained_on ← orca-1-data (declared) orca-2-7b ← trained_on ← orca-2-data (declared) tinyllama-1-1b-intermediate-step-1431k-3t ← trained_on ← slimpajama (declared) tinyllama-1-1b-intermediate-step-1431k-3t ← trained_on ← starcoderdata (declared) openorcaxopenchat-preview2-13b ← trained_on ← openorca (declared) platypus2-13b ← trained_on ← open-platypus (declared) llama-2-7b ← successor_in_series ← llama-7b (declared) llama-2-13b ← successor_in_series ← llama-7b (declared) llama-2-70b ← successor_in_series ← llama-7b (declared) open-llama-7b ← design_follows ← llama-7b (declared) tinyllama-1-1b-intermediate-step-1431k-3t ← same_architecture_retrained ← llama-2-7b (declared) alpaca-7b ← fine_tuned_from ← llama-7b (declared) llama-2-7b-chat ← fine_tuned_from ← llama-2-7b (declared) code-llama-7b ← fine_tuned_from ← llama-2-7b (declared) vicuna-7b-v1-3 ← fine_tuned_from ← llama-7b (declared) codellama-7b-instruct ← fine_tuned_from ← code-llama-7b (declared) codellama-7b-python ← fine_tuned_from ← code-llama-7b (declared) nous-hermes-llama-2-7b ← fine_tuned_from ← llama-2-7b (declared_by_uploader) vicuna-7b-v1-5 ← fine_tuned_from ← llama-2-7b (declared) vicuna-13b-v1-5 ← fine_tuned_from ← llama-2-13b (declared) wizardlm-13b-v1-2 ← fine_tuned_from ← llama-2-13b (declared_by_uploader) alpaca-lora-7b ← adapter_on ← llama-7b (declared) baize-v2-7b ← fine_tuned_from ← llama-7b (declared) guanaco-7b ← adapter_on ← llama-7b (declared) openorcaxopenchat-preview2-13b ← fine_tuned_from ← llama-2-13b (declared) orca-2-7b ← fine_tuned_from ← llama-2-7b (declared) platypus2-13b ← fine_tuned_from ← llama-2-13b (declared) tulu-2-7b ← fine_tuned_from ← llama-2-7b (declared) openorca-platypus2-13b ← merged_from ← platypus2-13b (declared) tulu-2-dpo-7b ← fine_tuned_from ← tulu-2-7b (declared) openorca-platypus2-13b ← merged_from ← openorcaxopenchat-preview2-13b (declared) text-davinci-003 closedtext-davinci-003 Alpaca 52K 2023-03-13Alpaca instruction data (52K) Alpaca-cleaned 2023-03-24Alpaca-Cleaned OASST1 2023-04-14OpenAssistant Conversations (OASST1) ChatGPT closedChatGPT (Nov. 2022 launch model) Baize data 2023-04-03Baize self-chat data Baize SDF 2023-04-03Baize SDF data (ChatGPT-ranked self-generations) ShareGPT undatedShareGPT conversations (LMSYS collection) GPT-4 closedGPT-4 (Mar. 2023) Tulu v2 mix 2023-11-13Tulu V2 SFT mixture UltraFeedback 2023-10-02UltraFeedback FLAN v2 2023-01-31FLAN-v2 Collection (Flan 2022) Orca 1 data 2023-06-05Orca 1 explanation-tuning data (FLAN-5M / FLAN-1M) Orca 2 data 2023-11-18Orca 2 dataset (~817K) SlimPajama undatedSlimPajama StarCoderData 2023-03-30StarCoderData OpenOrca 2023-06-15OpenOrca Open-Platypus 2023-08-03Open-Platypus LLaMA 7B2023-02-24LLaMA 7B Alpaca 7B2023-03-13Alpaca 7B Alpaca-LoRA 7B2023-03-14alpaca-lora-7b Guanaco 7B2023-05-22guanaco-7b Baize v2 7B2023-05-23Baize v2 7B OpenLLaMA 7B2023-06-07open_llama_7b Vicuna 7B v1.32023-06-22Vicuna 7B v1.3 Llama 2 7B2023-07-18Llama 2 7B Llama 2-Chat 7B2023-07-18Llama 2-Chat 7B Nous-Hermes 7B2023-07-25Nous-Hermes-llama-2-7b Vicuna 7B v1.52023-08-01vicuna-7b-v1.5 Code Llama 7B2023-08-24Code Llama 7B … Instruct2023-08-24CodeLlama-7b-Instruct-hf … Python2023-08-24CodeLlama-7b-Python-hf Tulu 2 7B2023-11-13Tulu 2 7B Tulu 2-DPO 7B2023-11-13Tulu 2 DPO 7B Orca 2 7B2023-11-18Orca 2 7B TinyLlama 1.1B2023-12-28TinyLlama-1.1B (intermediate-step-1431k-3T) Llama 2 13B2023-07-18Llama-2-13b-hf WizardLM 13B2023-07-25WizardLM-13B-V1.2 OpenOrca-Preview22023-07-31OpenOrcaxOpenChat-Preview2-13B Vicuna 13B v1.52023-08-01vicuna-13b-v1.5 Platypus2 13B2023-08-05Platypus2-13B OpenOrca-Platypus22023-08-11OpenOrca-Platypus2-13B Llama 2 70B2023-07-18Llama-2-70b-hf ? MythoLogic 13B2023-08-03 · parents not recordedMythoLogic-L2-13b ? MythoMax 13B2023-08-10 · parents not recordedMythoMax-L2-13b

On a phone the families are drawn as one indented column: each model sits under the model it came from, siblings in date order. The closed models and datasets sit in the left margin, and their lines run into each model that trained on them.

Show the full drawing (scrolls sideways)
2022-11 2022-12 2023-01 2023-02 2023-03 2023-04 2023-05 2023-06 2023-07 2023-08 2023-09 2023-10 2023-11 2023-12 2024-01 Closed · known by outputs Datasets Open weights alpaca-7b ← fine_tuned_from ← llama-7b (declared) llama-2-7b-chat ← fine_tuned_from ← llama-2-7b (declared) llama-2-7b ← successor_in_series ← llama-7b (declared) code-llama-7b ← fine_tuned_from ← llama-2-7b (declared) vicuna-7b-v1-3 ← fine_tuned_from ← llama-7b (declared) alpaca-52k ← distilled_from_outputs ← text-davinci-003 (declared) alpaca-7b ← trained_on ← alpaca-52k (declared) sharegpt-vicuna ← distilled_from_outputs ← chatgpt (declared) vicuna-7b-v1-3 ← trained_on ← sharegpt-vicuna (declared) ultrafeedback ← feedback_from ← gpt-4 (declared) codellama-7b-instruct ← fine_tuned_from ← code-llama-7b (declared) codellama-7b-python ← fine_tuned_from ← code-llama-7b (declared) llama-2-13b ← successor_in_series ← llama-7b (declared) llama-2-70b ← successor_in_series ← llama-7b (declared) nous-hermes-llama-2-7b ← fine_tuned_from ← llama-2-7b (declared_by_uploader) open-llama-7b ← design_follows ← llama-7b (declared) vicuna-7b-v1-5 ← fine_tuned_from ← llama-2-7b (declared) vicuna-7b-v1-5 ← trained_on ← sharegpt-vicuna (declared) vicuna-13b-v1-5 ← fine_tuned_from ← llama-2-13b (declared) vicuna-13b-v1-5 ← trained_on ← sharegpt-vicuna (declared) wizardlm-13b-v1-2 ← fine_tuned_from ← llama-2-13b (declared_by_uploader) openorca ← distilled_from_outputs ← gpt-4 (declared) openorca ← distilled_from_outputs ← chatgpt (declared) baize ← distilled_from_outputs ← chatgpt (declared) alpaca-cleaned ← distilled_from_outputs ← text-davinci-003 (declared) tulu-v2-sft-mixture ← distilled_from_outputs ← gpt-4 (declared) orca-1-data ← distilled_from_outputs ← chatgpt (declared) orca-1-data ← distilled_from_outputs ← gpt-4 (declared) orca-2-data ← distilled_from_outputs ← gpt-4 (declared) baize-sdf ← feedback_from ← chatgpt (declared) alpaca-lora-7b ← adapter_on ← llama-7b (declared) alpaca-lora-7b ← trained_on ← alpaca-cleaned (declared) baize-v2-7b ← fine_tuned_from ← llama-7b (declared) baize-v2-7b ← trained_on ← baize (declared) baize-v2-7b ← trained_on ← baize-sdf (declared) guanaco-7b ← adapter_on ← llama-7b (declared) guanaco-7b ← trained_on ← oasst1 (declared) openorcaxopenchat-preview2-13b ← fine_tuned_from ← llama-2-13b (declared) openorcaxopenchat-preview2-13b ← trained_on ← openorca (declared) orca-2-7b ← fine_tuned_from ← llama-2-7b (declared) orca-2-7b ← trained_on ← flan-v2 (declared) orca-2-7b ← trained_on ← orca-1-data (declared) orca-2-7b ← trained_on ← orca-2-data (declared) platypus2-13b ← fine_tuned_from ← llama-2-13b (declared) platypus2-13b ← trained_on ← open-platypus (declared) tinyllama-1-1b-intermediate-step-1431k-3t ← same_architecture_retrained ← llama-2-7b (declared) tinyllama-1-1b-intermediate-step-1431k-3t ← trained_on ← slimpajama (declared) tinyllama-1-1b-intermediate-step-1431k-3t ← trained_on ← starcoderdata (declared) tulu-2-7b ← fine_tuned_from ← llama-2-7b (declared) tulu-2-7b ← trained_on ← tulu-v2-sft-mixture (declared) openorca-platypus2-13b ← merged_from ← platypus2-13b (declared) openorca-platypus2-13b ← merged_from ← openorcaxopenchat-preview2-13b (declared) tulu-2-dpo-7b ← fine_tuned_from ← tulu-2-7b (declared) tulu-2-dpo-7b ← trained_on ← ultrafeedback (declared) text-davinci-003closedtext-davinci-003 ChatGPTclosedChatGPT (Nov. 2022 launch model) GPT-4closedGPT-4 (Mar. 2023) FLAN v22023-01-31FLAN-v2 Collection (Flan 2022) Alpaca 52K2023-03-13Alpaca instruction data (52K) Alpaca-cleaned2023-03-24Alpaca-Cleaned Baize data2023-04-03Baize self-chat data Baize SDF2023-04-03Baize SDF data (ChatGPT-ranked self-generations) StarCoderData2023-03-30StarCoderData OASST12023-04-14OpenAssistant Conversations (OASST1) Orca 1 data2023-06-05Orca 1 explanation-tuning data (FLAN-5M / FLAN-1M) OpenOrca2023-06-15OpenOrca Open-Platypus2023-08-03Open-Platypus UltraFeedback2023-10-02UltraFeedback Tulu v2 mix2023-11-13Tulu V2 SFT mixture Orca 2 data2023-11-18Orca 2 dataset (~817K) Alpaca 7B2023-03-13Alpaca 7B Alpaca-LoRA 7B2023-03-14alpaca-lora-7b Guanaco 7B2023-05-22guanaco-7b Baize v2 7B2023-05-23Baize v2 7B Vicuna 7B v1.32023-06-22Vicuna 7B v1.3 Vicuna 7B v1.52023-08-01vicuna-7b-v1.5 OpenLLaMA 7B2023-06-07open_llama_7b LLaMA 7B2023-02-24LLaMA 7B Llama 2 7B2023-07-18Llama 2 7B Code Llama 7B2023-08-24Code Llama 7B … Instruct2023-08-24CodeLlama-7b-Instruct-hf … Python2023-08-24CodeLlama-7b-Python-hf Llama 2-Chat 7B2023-07-18Llama 2-Chat 7B Nous-Hermes 7B2023-07-25Nous-Hermes-llama-2-7b Llama 2 13B2023-07-18Llama-2-13b-hf WizardLM 13B2023-07-25WizardLM-13B-V1.2 Vicuna 13B v1.52023-08-01vicuna-13b-v1.5 OpenOrca-Preview22023-07-31OpenOrcaxOpenChat-Preview2-13B Platypus2 13B2023-08-05Platypus2-13B OpenOrca-Platypus22023-08-11OpenOrca-Platypus2-13B Llama 2 70B2023-07-18Llama-2-70b-hf ?parents not recordedMythoLogic-L2-13b: no parents recorded in Stemma MythoLogic 13B2023-08-03MythoLogic-L2-13b ?parents not recordedMythoMax-L2-13b: no parents recorded in Stemma MythoMax 13B2023-08-10MythoMax-L2-13b Tulu 2 7B2023-11-13Tulu 2 7B Tulu 2-DPO 7B2023-11-13Tulu 2 DPO 7B Orca 2 7B2023-11-18Orca 2 7B TinyLlama 1.1B2023-12-28TinyLlama-1.1B (intermediate-step-1431k-3T) ShareGPTundatedShareGPT conversations (LMSYS collection) SlimPajamaundatedSlimPajama

Every line is a recorded edge and links to its source; every node links to its record.

The Mistral family

Mistral 7B (September 2023) and its fine-tunes, quantization, and Mixtral. This family shows a case the LLaMA drawing does not: feedback from a reward model (Starling-RM, trained on GPT-4’s rankings) rather than from a dataset directly, and a cross-family parent — Starling-RM was itself fine-tuned from Llama 2-Chat 7B, drawn back in the LLaMA family above.

2023-08 2023-09 2023-10 2023-11 2023-12 2024-01 2024-02 Closed Datasets Open weights zephyr-7b-beta ← fine_tuned_from ← mistral-7b-v0-1 (declared) zephyr-7b-beta ← trained_on ← ultrachat (declared) ultrafeedback ← feedback_from ← gpt-4 (declared) zephyr-7b-beta ← trained_on ← ultrafeedback (declared) mistral-7b-instruct-v0-1 ← fine_tuned_from ← mistral-7b-v0-1 (declared) mistral-7b-openorca ← fine_tuned_from ← mistral-7b-v0-1 (declared_by_uploader) mixtral-8x7b-v0-1 ← same_architecture_retrained ← mistral-7b-v0-1 (declared) openhermes-2-5-mistral-7b ← fine_tuned_from ← mistral-7b-v0-1 (declared_by_uploader) solar-10-7b-v1-0 ← fine_tuned_from ← mistral-7b-v0-1 (declared) zephyr-7b-alpha ← fine_tuned_from ← mistral-7b-v0-1 (declared_by_uploader) zephyr-7b-alpha ← trained_on ← ultrachat (declared_by_uploader) zephyr-7b-alpha ← trained_on ← ultrafeedback (declared_by_uploader) mistral-7b-instruct-v0-1-gptq ← quantized_from ← mistral-7b-instruct-v0-1 (declared_by_uploader) mixtral-8x7b-instruct-v0-1 ← fine_tuned_from ← mixtral-8x7b-v0-1 (declared) openorca ← distilled_from_outputs ← gpt-4 (declared) nectar ← feedback_from ← gpt-4 (declared) mistral-7b-sft-beta ← fine_tuned_from ← mistral-7b-v0-1 (declared) mistral-7b-sft-beta ← trained_on ← ultrachat (declared) openchat-3-5 ← fine_tuned_from ← mistral-7b-v0-1 (declared_by_uploader) openchat-3-5 ← trained_on ← openorca (declared) starling-rm-7b-alpha ← fine_tuned_from ← llama-2-7b-chat (declared) starling-rm-7b-alpha ← trained_on ← nectar (declared) starling-lm-7b-alpha ← fine_tuned_from ← openchat-3-5 (declared) starling-lm-7b-alpha ← feedback_from ← starling-rm-7b-alpha (declared) zephyr-7b-beta ← fine_tuned_from ← mistral-7b-sft-beta (declared) GPT-4closedGPT-4 (Mar. 2023) UltraChat2023-05-23UltraChat UltraFeedback2023-10-02UltraFeedback OpenOrca2023-06-15OpenOrca Nectar2023-10-06Nectar Llama 2-Chat 7Bsee the LLaMA family →Llama 2-Chat 7B Mistral 7B2023-09-27Mistral 7B (v0.1) Mistral 7B Instruct2023-09-27Mistral-7B-Instruct-v0.1 … GPTQ2023-09-28Mistral-7B-Instruct-v0.1-GPTQ Mistral-OpenOrca2023-09-29Mistral-7B-OpenOrca OpenHermes-2.52023-10-29OpenHermes-2.5-Mistral-7B SOLAR 10.7B2023-12-23SOLAR-10.7B-v1.0 Zephyr-α2023-10-09zephyr-7b-alpha Zephyr SFT (β)2023-10-26Mistral 7B SFT β Zephyr-β2023-10-25Zephyr 7B β OpenChat 3.52023-11-01OpenChat 3.5 Starling-RM2023-11-25Starling-RM-7B-alpha Starling-LM2023-11-25Starling-LM-7B-alpha Mixtral 8x7B2023-12-11Mixtral-8x7B-v0.1 … Instruct2023-12-11Mixtral-8x7B-Instruct-v0.1
ultrafeedback ← feedback_from ← gpt-4 (declared) openorca ← distilled_from_outputs ← gpt-4 (declared) nectar ← feedback_from ← gpt-4 (declared) starling-rm-7b-alpha ← trained_on ← nectar (declared) zephyr-7b-beta ← trained_on ← ultrachat (declared) zephyr-7b-alpha ← trained_on ← ultrachat (declared_by_uploader) mistral-7b-sft-beta ← trained_on ← ultrachat (declared) zephyr-7b-beta ← trained_on ← ultrafeedback (declared) zephyr-7b-alpha ← trained_on ← ultrafeedback (declared_by_uploader) openchat-3-5 ← trained_on ← openorca (declared) mixtral-8x7b-v0-1 ← same_architecture_retrained ← mistral-7b-v0-1 (declared) zephyr-7b-beta ← fine_tuned_from ← mistral-7b-v0-1 (declared) mistral-7b-instruct-v0-1 ← fine_tuned_from ← mistral-7b-v0-1 (declared) mistral-7b-openorca ← fine_tuned_from ← mistral-7b-v0-1 (declared_by_uploader) openhermes-2-5-mistral-7b ← fine_tuned_from ← mistral-7b-v0-1 (declared_by_uploader) solar-10-7b-v1-0 ← fine_tuned_from ← mistral-7b-v0-1 (declared) zephyr-7b-alpha ← fine_tuned_from ← mistral-7b-v0-1 (declared_by_uploader) mistral-7b-instruct-v0-1-gptq ← quantized_from ← mistral-7b-instruct-v0-1 (declared_by_uploader) mixtral-8x7b-instruct-v0-1 ← fine_tuned_from ← mixtral-8x7b-v0-1 (declared) mistral-7b-sft-beta ← fine_tuned_from ← mistral-7b-v0-1 (declared) openchat-3-5 ← fine_tuned_from ← mistral-7b-v0-1 (declared_by_uploader) starling-rm-7b-alpha ← fine_tuned_from ← llama-2-7b-chat (declared) starling-lm-7b-alpha ← fine_tuned_from ← openchat-3-5 (declared) zephyr-7b-beta ← fine_tuned_from ← mistral-7b-sft-beta (declared) GPT-4 closedGPT-4 (Mar. 2023) Nectar 2023-10-06Nectar UltraChat 2023-05-23UltraChat UltraFeedback 2023-10-02UltraFeedback OpenOrca 2023-06-15OpenOrca Llama 2-Chat 7Bsee the LLaMA family →Llama 2-Chat 7B Starling-RM2023-11-25Starling-RM-7B-alpha Mistral 7B2023-09-27Mistral 7B (v0.1) Mistral 7B Instruct2023-09-27Mistral-7B-Instruct-v0.1 … GPTQ2023-09-28Mistral-7B-Instruct-v0.1-GPTQ Mistral-OpenOrca2023-09-29Mistral-7B-OpenOrca Zephyr-α2023-10-09zephyr-7b-alpha Zephyr-β2023-10-25Zephyr 7B β Zephyr SFT (β)2023-10-26Mistral 7B SFT β OpenHermes-2.52023-10-29OpenHermes-2.5-Mistral-7B OpenChat 3.52023-11-01OpenChat 3.5 Starling-LM2023-11-25Starling-LM-7B-alpha Mixtral 8x7B2023-12-11Mixtral-8x7B-v0.1 … Instruct2023-12-11Mixtral-8x7B-Instruct-v0.1 SOLAR 10.7B2023-12-23SOLAR-10.7B-v1.0
Show the full drawing (scrolls sideways)
2023-08 2023-09 2023-10 2023-11 2023-12 2024-01 2024-02 Closed Datasets Open weights zephyr-7b-beta ← fine_tuned_from ← mistral-7b-v0-1 (declared) zephyr-7b-beta ← trained_on ← ultrachat (declared) ultrafeedback ← feedback_from ← gpt-4 (declared) zephyr-7b-beta ← trained_on ← ultrafeedback (declared) mistral-7b-instruct-v0-1 ← fine_tuned_from ← mistral-7b-v0-1 (declared) mistral-7b-openorca ← fine_tuned_from ← mistral-7b-v0-1 (declared_by_uploader) mixtral-8x7b-v0-1 ← same_architecture_retrained ← mistral-7b-v0-1 (declared) openhermes-2-5-mistral-7b ← fine_tuned_from ← mistral-7b-v0-1 (declared_by_uploader) solar-10-7b-v1-0 ← fine_tuned_from ← mistral-7b-v0-1 (declared) zephyr-7b-alpha ← fine_tuned_from ← mistral-7b-v0-1 (declared_by_uploader) zephyr-7b-alpha ← trained_on ← ultrachat (declared_by_uploader) zephyr-7b-alpha ← trained_on ← ultrafeedback (declared_by_uploader) mistral-7b-instruct-v0-1-gptq ← quantized_from ← mistral-7b-instruct-v0-1 (declared_by_uploader) mixtral-8x7b-instruct-v0-1 ← fine_tuned_from ← mixtral-8x7b-v0-1 (declared) openorca ← distilled_from_outputs ← gpt-4 (declared) nectar ← feedback_from ← gpt-4 (declared) mistral-7b-sft-beta ← fine_tuned_from ← mistral-7b-v0-1 (declared) mistral-7b-sft-beta ← trained_on ← ultrachat (declared) openchat-3-5 ← fine_tuned_from ← mistral-7b-v0-1 (declared_by_uploader) openchat-3-5 ← trained_on ← openorca (declared) starling-rm-7b-alpha ← fine_tuned_from ← llama-2-7b-chat (declared) starling-rm-7b-alpha ← trained_on ← nectar (declared) starling-lm-7b-alpha ← fine_tuned_from ← openchat-3-5 (declared) starling-lm-7b-alpha ← feedback_from ← starling-rm-7b-alpha (declared) zephyr-7b-beta ← fine_tuned_from ← mistral-7b-sft-beta (declared) GPT-4closedGPT-4 (Mar. 2023) UltraChat2023-05-23UltraChat UltraFeedback2023-10-02UltraFeedback OpenOrca2023-06-15OpenOrca Nectar2023-10-06Nectar Llama 2-Chat 7Bsee the LLaMA family →Llama 2-Chat 7B Mistral 7B2023-09-27Mistral 7B (v0.1) Mistral 7B Instruct2023-09-27Mistral-7B-Instruct-v0.1 … GPTQ2023-09-28Mistral-7B-Instruct-v0.1-GPTQ Mistral-OpenOrca2023-09-29Mistral-7B-OpenOrca OpenHermes-2.52023-10-29OpenHermes-2.5-Mistral-7B SOLAR 10.7B2023-12-23SOLAR-10.7B-v1.0 Zephyr-α2023-10-09zephyr-7b-alpha Zephyr SFT (β)2023-10-26Mistral 7B SFT β Zephyr-β2023-10-25Zephyr 7B β OpenChat 3.52023-11-01OpenChat 3.5 Starling-RM2023-11-25Starling-RM-7B-alpha Starling-LM2023-11-25Starling-LM-7B-alpha Mixtral 8x7B2023-12-11Mixtral-8x7B-v0.1 … Instruct2023-12-11Mixtral-8x7B-Instruct-v0.1

Every line is a recorded edge and links to its source; every node links to its record.

Key

How to read it

What this drawing is not

It is one family, laid out by hand, as a test of the drawing conventions. The whole network (every record, laid out from the data) is the next step. The data behind it is already public: edges.jsonl and the records.