% Base Architecture
@misc{qwen3,
title={Qwen3 Technical Report},
author={Qwen Team},
year={2025},
eprint={2505.09388},
archivePrefix={arXiv},
primaryClass={cs.CL},
url={https://arxiv.org/abs/2505.09388}
}
% Evolutionary Model Merging
@article{akiba2025evolutionary,
title={Evolutionary Optimization of Model Merging Recipes},
author={Akiba, Takuya and Shing, Makoto and Tang, Yujin and Sun, Qi and Ha, David},
journal={Nature Machine Intelligence},
year={2025},
doi={10.1038/s42256-024-00975-8}
}
% MergeKit
@article{goddard2024mergekit,
title={Arcee's MergeKit: A Toolkit for Merging Large Language Models},
author={Goddard, Charles and Siriwardhana, Shamane and Ehghaghi, Malikeh and Meyers, Luke and Karpukhin, Vlad and Benedict, Brian and McQuade, Mark and Solawetz, Jacob},
journal={arXiv preprint arXiv:2403.13257},
year={2024}
}
% DELLA-Merging
@article{deep2024dellamerging,
title={DELLA-Merging: Reducing Interference in Model Merging through Magnitude-Based Sampling},
author={Deep, Pala Tej and Bhardwaj, Rishabh and Poria, Soujanya},
journal={arXiv preprint arXiv:2406.11617},
year={2024}
}
% Ancestor Seed Models
@article{qian2025fino1,
title={Fino1: On the Transferability of Reasoning Enhanced LLMs to Finance},
author={Qian, Lingfei and Zhou, Weipeng and Wang, Yan and Peng, Xueqing and Huang, Jimin and Xie, Qianqian},
journal={arXiv preprint arXiv:2502.08127},
year={2025}
}
@article{lin2025goedelproverv2,
title={Goedel-Prover-V2: Scaling Formal Theorem Proving with Scaffolded Data Synthesis and Self-Correction},
author={Lin, Yong and Tang, Shange and Lyu, Bohan and Yang, Ziran and Chung, Jui-Hui and Zhao, Haoyu and Jiang, Lai and Geng, Yihan and Ge, Jiawei and Sun, Jingruo and others},
journal={arXiv preprint arXiv:2508.03613},
year={2025}
}
@misc{xu2026logicsstem,
title={Logics-STEM: Empowering LLM Reasoning via Failure-Driven Post-Training and Document Knowledge Enhancement},
author={Xu, Mingyu and Fang, Cheng and Jiang, Keyue and Zheng, Yuqian and Xiao, Yanghua and Zhou, Baojian and Zhao, Qifang and Zheng, Suhang and Zhu, Xiuwen and Tang, Jiyang and others},
year={2026},
eprint={2601.01562},
archivePrefix={arXiv}
}
@article{chandak2025openforecaster,
title={Scaling Open-Ended Reasoning to Predict the Future},
author={Chandak, Nikhil and Goel, Shashwat and Prabhu, Ameya and Hardt, Moritz and Geiping, Jonas},
journal={arXiv preprint arXiv:2512.25070},
year={2025}
}
@misc{yang2026abcbench,
title={ABC-Bench: Benchmarking Agentic Backend Coding in Real-World Development},
author={Yang, Jie and Guo, Honglin and Ji, Li and Zhou, Jiazheng and Zheng, Rui and Lei, Zhikai and Zhang, Shuo and Xi, Zhiheng and Liu, Shichun and Wang, Yuxin and others},
year={2026},
eprint={2601.11077},
archivePrefix={arXiv}
}
% Other Seed Pool Models
@misc{deepseekai2025deepseekr1,
title={DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning},
author={DeepSeek-AI},
year={2025},
eprint={2501.12948},
archivePrefix={arXiv}
}
@article{fan2025megascience,
title={MegaScience: Pushing the Frontiers of Post-Training Datasets for Science Reasoning},
author={Fan, Run-Ze and Wang, Zengzhi and Liu, Pengfei},
journal={arXiv preprint arXiv:2507.16812},
year={2025}
}
@misc{su2025toolorchestra,
title={ToolOrchestra: Elevating Intelligence via Efficient Model and Tool Orchestration},
author={Su, Hongjin and Diao, Shizhe and Lu, Ximing and Liu, Mingjie and Xu, Jiacheng and Dong, Xin and Fu, Yonggan and others},
year={2025},
eprint={2511.21689},
archivePrefix={arXiv}
}
@misc{wang2025lightif,
title={Light-IF: Endowing LLMs with Generalizable Reasoning via Preview and Self-Checking for Complex Instruction Following},
author={Wang, Chenyang and Wen, Liang and Jia, Shousheng and Zhang, Xiangzheng and Xu, Liang},
year={2025},
eprint={2508.03178},
archivePrefix={arXiv}
}
@misc{shen2026sera,
title={SERA: Soft-Verified Efficient Repository Agents},
author={Shen, Ethan and Tormoen, Danny and Shah, Saurabh and Farhadi, Ali and Dettmers, Tim},
year={2026},
eprint={2601.20789},
archivePrefix={arXiv}
}
@misc{yang2025tablegptr1,
title={TableGPT-R1: Advancing Tabular Reasoning Through Reinforcement Learning},
author={Yang, Saisai and Huang, Qingyi and Yuan, Jing and Zha, Liangyu and Tang, Kai and others},
year={2025},
eprint={2512.20312},
archivePrefix={arXiv}
}
@article{ruan2025critiquecoder,
title={Critique-Coder: Enhancing Coder Models by Critique Reinforcement Learning},
author={Ruan, Chi and Jiang, Dongfu and Wang, Yubo and Chen, Wenhu},
journal={arXiv preprint arXiv:2509.22824},
year={2025}
}
@article{cai2025smartsnap,
title={SmartSnap: Proactive Evidence Seeking for Self-Verifying Agents},
author={Cai, Shaofei and Qin, Yulei and Lin, Haojia and Xu, Zihan and Li, Gang and Shi, Yuchen and others},
journal={arXiv preprint arXiv:2512.22322},
year={2025}
}