Reasoning models trained on synthetic data using reinforcement learning.
Yichao 'Peak' Ji PRO
peakji
AI & ML interests
Agents, Small Language Models, Retrieval-Augmented Generation, Information Extraction
Recent Activity
liked a model about 7 hours ago
meta-models/Muse-Glimmer-30B liked a dataset 13 days ago
HuggingFaceCode/stack-v3-train liked a model 26 days ago
thinkingmachines/Inkling