Command Palette
Search for a command to run...
Papers
Daily updated cutting-edge AI research papers to help you keep up with the latest AI trends
papers

X-AuT: Progressive Audio-Encoder Compression for Speech LLMs with Cross-Scale Distillation

Mi-Ripple: Restoring Images Degraded by Iterative AI Editing






























EvoSafeHarness: Evolving Modeland Domain-Specific Harnesses for Securing Agents
SpatialBlock: Enhancing Spatial Intelligence in LVLMs via Synthetic Block-Stacking Problem
SenseNova-U1.5: Towards Native Unified Visual Intelligence
NCP-ArchPreview Technical Report: Moving towards Latent Space Language Models through Next Concept Prediction
SAESCIENTIST-BENCH: CAN AI AGENTS CONDUCT AUTONOMOUS SAE INTERPRETABILITY RESEARCH?
SWE-Bench Pro Verified: A Reliable Benchmark for Software Engineering Agents
WearableQA: A Benchmark for Health Reasoning over Real-World Wearable Data
AgentGrad: Intervention-guided Prompt Optimization for Multi Agent Systems
Programmable World Model
Show-Harness: Just a VLM Agent Can Play Robots
Last Translation Benchmark
Vero: An Open RL Recipe for General Visual Reasoning
Data Science and Technology Towards AGI Part I: Tiered Data Management
APEX–Agents
TERMINAL-BENCH: BENCHMARKING AGENTS ON HARD, REALISTIC TASKS IN COMMAND LINE INTERFACES
Orca: Progressive Learning from Complex Explanation Traces of GPT-4
Omni Interaction Agent Technical Report
AuK Technical Report: An Open-Source Foundational Model for Speech Generation and Editing
Eliciting Weak-to-Strong Generalization with On-Policy Reverse Distillation
NeoHorse-1: Towards Recursive Self-Improvement via Agentic Post-Training with Routing Harness
OpenWAM: An Open, Modular Exploration Towards Systematic World–Action Model Pretraining
DriveZero: End-to-End Driving Beyond Human Demonstrations
ENEAS: Embedding-guided Neural Ensemble for Adaptive Segmentation.
FlowBalance: Verifier-Grounded Self-Improvement from On-Policy Reasoning Experience
Causal Foundation Models
EmbodiedSkills: A Unified Framework for Orchestrating, Training, and Deploying VLA Agents
Unlocking Lossless Speedups in LLMs via Discrete Diffusion
WorldSculpt: Generating Compositional Worlds from Grounded Videos
Iris: Climbing to the Search Frontier
MOTION-OMNI: END-TO-END JOINT SPEECH AND FULL-BODY MOTION FOR SPOKEN DIALOGUE