Systematic Evaluation of Large Language Models for Post-Discharge Clinical Action Extraction Paper • 2605.06191 • Published May 7
Beyond Next-Token Prediction: An RLVR Proof of Concept for Tool-Use Agents on Atlassian Workflows Paper • 2607.01465 • Published 29 days ago
World Feedback for Clinical Agents: Diagnosing RL in FHIR Environments Paper • 2607.01470 • Published 29 days ago
LegalWiz: A Multi-Agent Generation Framework for Contradiction Detection in Legal Documents Paper • 2510.03418 • Published Oct 10, 2025
ART: Action-based Reasoning Task Benchmarking for Medical AI Agents Paper • 2601.08988 • Published Jan 13
Running Agents 1 Sales & RevenueOps Agent RL Environment 🚀 1 RL environment for sales & revenue-ops agents
Running EHR Clinical-Task Agent RL Environment and Benchmark 🚀 RL environment & benchmark for clinical EHR agents
Running Agents 1 Sales & RevenueOps Agent RL Environment 🚀 1 RL environment for sales & revenue-ops agents
Running EHR Clinical-Task Agent RL Environment and Benchmark 🚀 RL environment & benchmark for clinical EHR agents