MINE-USTC
Popular repositories Loading
-
Xiangqi-R1
Xiangqi-R1 PublicCode for the paper Xiangqi-R1: Enhancing Spatial Strategic Reasoning in LLMs for Chinese Chess via Reinforcement Learning
-
Repositories
Showing 10 of 16 repositories
- PTD Public
- SAFE-G Public
[CIKM'26]SAFE-G: Structure-aware Faithful Evidence-guided Generation for Knowledge-based Visual Question Answering
- StableEdit Public
[ICML'26] Official code for "More Edits, More Stable: Understanding the Lifelong Normalization in Sequential Model Editing"
- SmellBench Public
- EKSFT Public
The code of Entropy-KL Divergence-based Token Masking: A Novel Approach for Selective Fine-tuning of Large Language Models.
- MALMAS Public
Memory-Augmented LLM-based Multi-Agent System for Automated Feature Generation on Tabular Data
- STRIDE Public
- vigil Public
Top languages
Loading…
Most used topics
Loading…