LLM Training Datasets Collection A collection of datasets for training LLMs. • 132 items • Updated Aug 16 • 46
DFM Mimir v1: An Open HRM Delivering Frontier Performance at 1B Parameters Using Only Permissible Post-Training Data Paper • 2608.13517 • Published Aug 13 • 33
Dynamic Multi-Byte Prediction With Hierarchical Language Models Paper • 2608.15454 • Published Aug 16 • 19
Thinking in a Low-Resource Language: What SFT Builds, What RL Fixes, What Accuracy Cannot See Paper • 2608.17744 • Published Aug 18 • 16
Daedalus-150M: A Convolution-Attention Hybrid Designed for CPU Inference Paper • 2608.20210 • Published 30 days ago • 8
FwPKM Collection Checkpoints for Fast-weight Product Key Memory (https://arxiv.org/abs/2601.00671) • 8 items • Updated Jul 27 • 2
IMU-1: Sample-Efficient Pre-training of Small Language Models Paper • 2602.02522 • Published Jan 25 • 9
Darwin Family: MRI-Trust-Weighted Evolutionary Merging for Training-Free Scaling of Language-Model Reasoning Paper • 2605.14386 • Published May 14 • 52
Jackrong/Qwen3.5-2B-Claude-4.6-Opus-Reasoning-Distilled-GGUF Text Generation • 2B • Updated Jul 4 • 13.3k • 187
Jackrong/Qwen3.5-27B-Claude-4.6-Opus-Reasoning-Distilled Image-Text-to-Text • 28B • Updated Jul 7 • 1.05k • • 2.94k