Is One Layer Enough? Training A Single Transformer Layer Can Match Full-Parameter RL Training Paper • 2607.01232 • Published Jul 2 • 8
CudaForge: An Agent Framework with Hardware Feedback for CUDA Kernel Optimization Paper • 2511.01884 • Published Oct 23, 2025 • 1
GRAPE: Generalizing Robot Policy via Preference Alignment Paper • 2411.19309 • Published Nov 28, 2024 • 47
GRAPE: Generalizing Robot Policy via Preference Alignment Paper • 2411.19309 • Published Nov 28, 2024 • 47