VaaWIT: Visual-Aware Adaptation of Large Language Models for Multilingual Web Image Trans…
Explorar
Noticias de IA
21031 elementos — filtrados, clasificados y sin duplicados
The Path Matters: Learning a Token-Commitment Policy for Diffusion Language Models
FactoryNet: A Large-Scale Dataset toward Industrial Time-Series Foundation Models
Spectral Retrieval: Multi-Scale Sinc Convolution over Token Embeddings for Localized Retr…
HumanEgo: Zero-Shot Robot Learning from Minutes of Human Egocentric Videos
From Theory to Decision Rule: Calibrating the Noisy-Label Crossover for Vision-Language M…
Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Lang…
Credit Assignment with Resets in Language Model Reasoning
Zero-Shot Parkinson's Disease Detection from Speech: Comparing Large Audio and Language M…
One Step to the Side: Why Defenses Against Malicious Finetuning Fail Under Adaptive Adver…
Reflect-Guard: Enhancing LLM Safeguards against Adversarial Prompts via Logical Self-Refl…
ATWL: A Formal Language for Representing, Comparing, and Reusing Visual Analytics Workflo…
When Reasoning Hurts: Source-Aware Evaluation of Frontier LLMs for Clinical SOAP Note Gen…
Factorize to Generalize: Retrieval-Guided Invariant-Dynamic Decomposition for Time Series…
Riemannian-Manifold Steering: Geometry-Aware Generative Autoencoders for Label-Free Steer…
APT-Agent: Automated Penetration Testing using Large Language Models
Persona-Model Collapse in Emergent Misalignment
L-Drive: Beyond a Single Mapping-Latent Context Drives Time Series Forecasting
MinerU-Popo: Universal Post-Processing Model for Structured Document Parsing
Interpretation, Learning, and Empathy as One Constraint: A Residual-Adequacy Architecture…
Finite-Particle Convergence Rates for Conservative and Non-Conservative Drifting Models
Scale When Needed: Adaptive Neuron-level Mixed Precision Quantization Aware Training
GL-LFGNN:A Global-Local Dual-branch Causal Graph Neural Network Based on Liang-Kleeman In…
Multi-Agent Specification-based Metamorphic Testing of FMU-Based Simulations
Intrinsically Interpretable Attention via Sparse Post-Training
Smart Timing for Mining: A Deep Learning Framework for Bitcoin Hardware ROI Prediction
Evidence-Linked Radiology Reporting: A Human-Supervised Reference Architecture for Struct…
PageLLM: A Multi-Grained Reward Framework for Whole-Page Optimization with Large Language…
Uni-DPO: A Unified Paradigm for Dynamic Preference Optimization of LLMs
FG-CLIP 2: A Bilingual Fine-grained Vision-Language Alignment Model