Developer Tools B
Showing 331–360 of 424
-
Instruction-Tuned Models Locally Reuse Human Syntax More Than Humans Do
-
Sharpness-Aware Minimization and Muon: Robustness under the Spectral Norm
-
Empirical Evaluation of Out-Of-Distribution Performance of Tabular Foundation Models
-
MemLens: A Value-Aware Memory Management System with Interactive Analytics for LLM-based Agents
-
Generator-Aligned Representation Interfaces for Diagnostic Soft Equivariance
-
Physics-Aware End-to-End Deep Reinforcement Learning for Quadcopter Control with Actuator Dynamics
-
Schrödinger's Cat: Probabilistic Representation and Prediction of Potential Scene Kinematics
-
Knowledge-Guided Multimodal Reasoning over Interacting Streams for Video-Level Ambivalence and Hesitancy Recognition
-
Detecting Knowledge Inconsistencies Across Text, Tables, and Knowledge Graphs
-
Large Language Model for Operations Research Formulation Selection in Multi-Warehouse Inventory Allocation
-
Polistemics: Evaluating LLMs as Information Mediators in Politics & Elections
-
Flexential acquires 110 acres outside Dallas, Texas, for 108MW data center campusFlexential buys 110 acres near Dallas for a 108MW data center campusFlexential has acquired 110 acres in Talty, outside Dallas, Texas, to build a 108MW data center campus. The site is planned as a three-building campus, expanding the operator's capacity amid strong demand.
-
Evaluating Multi-Turn Multimodal Diagnostic Reasoning on Challenging Real-World Clinical Cases
-
Can Deep Generative Models Reproduce Non-Stationary Gaussian Random Fields?
-
Face De-Identification: A Domain-Centric Survey from Capture to Processing
-
dtControl2+$\varepsilon$: Trading Optimality for Explainability in MDPs via Decision Trees
-
Toward Standardized Cross-Vendor Agent Tool Trust Management in Autonomous Networks
-
AnnoBench: A Benchmark for Visualization Annotation Generation
-
Interactive Reward Agent: GUI Task Evaluation via Environment-State Verification
-
HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone
-
Messier: A High-Resolution Corpus for Cross-Benchmark Agent Evaluation
-
Distributing Security Controls Through Harness Engineering
-
Depression Markers in Speech: An Approach based on Tract Variables Dynamics
-
Device Invariance using Domain Adaptation on Acoustic Scene Classification
-
RSIBench-Data: Benchmarking Data-Centric Research for Recursive Self-Improvement
-
AI's Capability in Assisting Scientific Research in Physics, Astrophysics, and Cosmology II: Project Planning and Proposal Evaluation
-
A2TTA: Anchored-and-Agile Test-Time Adaptation for Evolving Traffic Sensor Networks
-
How Do LLMs Read Bug Reports? An Empirical Study of Attention in LLMs for Automated Program Repair
-
OmniQEC: discovering practical quantum error-correcting codes by an AI scientist
-
HiSkill: Empowering LLM Agents with Hierarchical Skill Graphs