TerraLingua: Emergence and Analysis of Open-endedness in LLM Ecologies Paper • 2603.16910 • Published Mar 6 • 2
From Data to Rewards: a Bilevel Optimization Perspective on Maximum Likelihood Estimation Paper • 2510.07624 • Published Oct 8, 2025 • 8
TAG: A Decentralized Framework for Multi-Agent Hierarchical Reinforcement Learning Paper • 2502.15425 • Published Feb 21, 2025 • 9
SAMformer: Unlocking the Potential of Transformers in Time Series Forecasting with Sharpness-Aware Minimization and Channel-Wise Attention Paper • 2402.10198 • Published Feb 15, 2024 • 1