Sign in

AI Research Updates | arXiv cs.AI

@arxiv-cs-ai.bsky.social
323 followers 1 following 7.5K posts

Your daily dose of the latest in Artificial Intelligence! Discover new research from arXiv's cs.AI section, covering machine learning, NLP, robotics, and more. 🚀 #ArtificialIntelligence #AIResearch #MachineLearning #NLP #Robotics #DeepLearning #AITech

PostsRepliesMedia
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 1h
Don't Judge an LLM Only by Its Activations: Discovering Suppressed Safety Features via Counterfactual Activation Potential Read more: arxiv.org/html/2610.05541v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 3h
Efficient Neural Surrogates for Linear Radiation Transport on the Lattice and Hohlraum benchmarks Read more: arxiv.org/html/2610.04665v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 5h
Argo-Bench: Evaluating Data Agents on Enterprise-Scale Workflows Read more: arxiv.org/html/2610.02122v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 7h
Routing Probes Can Improve Without New Information: An Exact-Null Audit of Uncertainty Beyond Model Outputs Read more: arxiv.org/html/2609.38956v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 9h
Transformer-Based Time-Series Inference of Lindblad Dynamics in Open Quantum Systems Read more: arxiv.org/html/2610.05647v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 11h
Defense-in-Depth for LLMs: Evaluating Memory Gates Against Activation-Induced and Memory-Induced Sycophancy Read more: arxiv.org/html/2610.07403v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 13h
Confidence-Ordering Reversal under Contextual Priors in Neural Decoding Read more: arxiv.org/html/2610.08229v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 15h
Adaptive Operator Selection in Bilevel Large Neighborhood Search for Electric Autonomous Dial-a-Ride Problem under Uncertainty Read more: arxiv.org/html/2610.04219v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 17h
EgoLAP: Learning from Egocentric Human Data through Language-Action Reasoning Read more: arxiv.org/html/2610.08726v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 19h
MedCORE: Criteria-Grounded Clinical Reasoning for Interpretable Medical Image Diagnosis Read more: arxiv.org/html/2610.08528v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 21h
A doctrine-grounded visual question answering dataset for Tactical Combat Casualty Care Read more: arxiv.org/html/2610.07339v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 23h
Beyond Semantic Similarity: Performance and Costs of Agentic Retrieval for Complex Tasks Read more: arxiv.org/html/2610.05750v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 07/10/2026
GARDiff: Graph-Aligned Residual Diffusion for Probabilistic Multivariate Time-Series Forecasting Read more: arxiv.org/html/2609.37694v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 06/10/2026
Learning from Viable Failure Prefixes: Milestone Viability Potential Policy Optimization for Long-Horizon LLM Agents Read more: arxiv.org/html/2609.37111v2
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 06/10/2026
Spend Teacher Tokens Where They Matter: Success-Referenced On-Policy Distillation Read more: arxiv.org/html/2610.02678v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 06/10/2026
FedMIX-P: Mixing Local and Global Preconditioners for Federated Vision and Language Model Training Read more: arxiv.org/html/2610.01515v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 06/10/2026
Agentic Resource Allocation for Batch Multi-Objective Bayesian Optimization in Autonomous Materials Discovery Read more: arxiv.org/html/2610.04134v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 06/10/2026
Asking Earns Nothing: Scoring the Decision to Act in BFCL Multi-Turn Read more: arxiv.org/html/2610.04429v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 06/10/2026
From Retrieval to Typed Decisions: Calibrated System One Models from Biomedical Sentence Encoders Read more: arxiv.org/html/2610.02486v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 06/10/2026
DRelay: Global Draft Context for Prefix-Aware Parallel Speculative Decoding Repair Read more: arxiv.org/html/2610.01439v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 06/10/2026
Backdooring Sparse Autoencoders Read more: arxiv.org/html/2610.06049v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 06/10/2026
Topology-Informed Prompt-Conditioned Universal Segmentation of Uterine Structures from Ultrasound and MRI Read more: arxiv.org/html/2610.06494v1
010
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 06/10/2026
Risk-Controlled Selective LLM Answering by Pricing Label-Free Checks Read more: arxiv.org/html/2609.37493v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 06/10/2026
Towards Breaking the Learning System Wall Using Multimodal Tutoring Transcriptions Read more: arxiv.org/html/2609.36502v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 06/10/2026
MAADBench: The Refreshable Paradigm for Anomaly Detection in Multi-Agent Systems Read more: arxiv.org/html/2609.36556v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 05/10/2026
MobiAgent: Dual-Loop Recursive Policy Self-Improvement for Long-Horizon Mobile Manipulation Read more: arxiv.org/html/2610.03476v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 05/10/2026
PADMÉ: Preference Alignment Data Synthesis for Meta-Evaluation of LM Agent Evaluators Read more: arxiv.org/html/2609.36086v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 05/10/2026
MOMAT: Mixture of Multiple Atlases for Low-Power Jailbreak Defense of Quantized LLMs Read more: arxiv.org/html/2610.01058v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 05/10/2026
Janus: Evidence-Before-Effect Sagas and Offline-Verifiable Provenance for Agentic LLMs Read more: arxiv.org/html/2609.38266v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 05/10/2026
Single or Multiple Policies for Phase-Structured Reinforcement Learning? Read more: arxiv.org/html/2610.03475v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 05/10/2026
MoFlow: Multi-Objective Agentic Workflow Generation Read more: arxiv.org/html/2609.38294v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 05/10/2026
Cross-Benchmark Transfer from RL on Agentic Coding Tasks Read more: arxiv.org/html/2610.00890v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 05/10/2026
Trust and Task Completion in the World of Consumer AI Agents Read more: arxiv.org/html/2609.33017v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 05/10/2026
Characterizing a Configuration Where Inference-Time PRM-Pruned Fragment Grafting Is Inert: Evidence from Three Reasoning LMs Read more: arxiv.org/html/2610.00047v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 05/10/2026
PINNMorph: Evolving Online Adaptation Policies for Physics-Informed Neural Networks Read more: arxiv.org/html/2609.32685v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 05/10/2026
Contextual Flow Matching: Adaptive Step Selection in Flow Models for Efficient Visual Generation Read more: arxiv.org/html/2610.03202v1
010
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 05/10/2026
A Unifying Framework of Concept-based Explainable AI with Completeness Guarantees Read more: arxiv.org/html/2609.34750v1
010
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 04/10/2026
TreeRef-BFN: Equivariance-Free De Novo Molecule Generation based on 2D Topology and Internal 3D Geometry Read more: arxiv.org/html/2609.32502v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 04/10/2026
AI Harness: Certification under Proposal-Conditioned Information for Foundation-Model Agents Read more: arxiv.org/html/2609.32184v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 04/10/2026
Learning from a Thoughtful Teacher: Adaptive On-Policy Self-Distillation for Mathematical Reasoning Read more: arxiv.org/html/2609.32667v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 04/10/2026
ADPTNet: Adaptive with Prescriptive Timescales Non-Linear SSM for Sequence Modelling Read more: arxiv.org/html/2609.34034v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 04/10/2026
Flowing Faster to Coordinate: One-Step Online Multi-Agent Flow Policies Read more: arxiv.org/html/2610.01882v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 04/10/2026
When Do Causal World Models Help Modular LLM Agents Read more: arxiv.org/html/2610.00012v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 04/10/2026
Infrared Subtraction with Artificial Intelligence Read more: arxiv.org/html/2609.36007v2
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 04/10/2026
V-Engram: Trigger-Indexed External Memory for Modular Text-to-Image Personalization Read more: arxiv.org/html/2609.37198v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 04/10/2026
CoViST: Visual Token Compression via Composable States Read more: arxiv.org/html/2609.33397v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 04/10/2026
Who Said What, and Will It Be Remembered? Evaluating Persistent Speaker Attribution Across Meetings Read more: arxiv.org/html/2609.39344v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 04/10/2026
RLHarness: Co-evolving Procedural Skills with Reinforcement Learning for Long-horizon Multimodal Reasoning Read more: arxiv.org/html/2609.32326v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 04/10/2026
Thinking in Depth, Speaking Directly: Recurrent Latent Reasoning for Paralinguistically Grounded Spoken Dialogue Read more: arxiv.org/html/2609.37818v1
000
AI Research Updates | arXiv cs.AI @arxiv-cs-ai.bsky.social · 03/10/2026
ReGDiff: Guided Diffusion in Regulated Latent Space for Exploring Metamaterial Voxel Geometry Read more: arxiv.org/html/2609.34231v1
010