LUTSeg: A Longitudinal Multi-Expert Dataset for Ulcer Tissue Segmentation Paper • 2608.25866 • Published 15 days ago • 1
DiSCO: Defending text-to-image generation through distribution-guided contrastive prompt optimization Paper • 2608.17067 • Published 24 days ago • 22
QuanBench+: A Unified Multi-Framework Benchmark for LLM-Based Quantum Code Generation Paper • 2604.08570 • Published Mar 25 • 126
AraLingBench A Human-Annotated Benchmark for Evaluating Arabic Linguistic Capabilities of Large Language Models Paper • 2511.14295 • Published Nov 18, 2025 • 74