jnjj
/

xd_v1

@@ -23,14 +23,14 @@ The fully merged model weights and tokenizer are updated periodically at the roo
 - **Dynamic Dataset Source:** The script iterates through a wide array of Hugging Face Hub datasets.
 - **Rapid Iteration Strategy:** Training per dataset configuration is brief (`max_steps=1`), prioritizing breadth of exposure over depth on any single dataset.
 ## Training Progress
-- **Datasets Processed (Successfully trained on at least one config):** 11
-- **Text Examples Streamed (Total):** 66
-- **Tokens Processed (Total):** 33792
-- **Last Successful Model Update:** 2025-05-08 15:53:23 UTC
 ### Evaluation Snapshot (Approximate)
-- **Current Perplexity (wikitext Subset):** 283.21
-- **Perplexity Change:** `-0.22` ⬇️ (vs previous cycle's perplexity)
 #### Generated Examples (Qualitative Assessment)

 - **Dynamic Dataset Source:** The script iterates through a wide array of Hugging Face Hub datasets.
 - **Rapid Iteration Strategy:** Training per dataset configuration is brief (`max_steps=1`), prioritizing breadth of exposure over depth on any single dataset.
 ## Training Progress
+- **Datasets Processed (Successfully trained on at least one config):** 1
+- **Text Examples Streamed (Total):** 6
+- **Tokens Processed (Total):** 3072
+- **Last Successful Model Update:** 2025-05-08 18:02:08 UTC
 ### Evaluation Snapshot (Approximate)
+- **Current Perplexity (wikitext Subset):** 282.70
+- **Perplexity Change:** `-0.51` ⬇️ (vs previous cycle's perplexity)
 #### Generated Examples (Qualitative Assessment)