Training & Fine-tuning

A
Showing 31–60 of 85
  • arXiv cs.AI (Artificial Intelligence) · EN New Model Releases
    Beyond In-Distribution Metrics: A Systematic Out-of-Distribution Evaluation of Congenital Heart Disease Segmentation
    Neural Network Reinforcement Learning
    Read original (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.CL (Computation and Language) · EN Training & Fine-tuning
    Audio-Visual Turn-taking Prediction in Cocktail Party Scenarios
    Fine-tuning Reinforcement Learning Speech Processing
    Read original (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.LG (Machine Learning) · EN Training & Fine-tuning
    CLARE: Scalable Class-Incremental Continual Learning via a Sparsity-Based Framework
    Fine-tuning Retrieval-Augmented Generation (RAG)
    Read original (arXiv cs.LG (Machine Learning)) ↗
  • arXiv cs.LG (Machine Learning) · EN Training & Fine-tuning
    Beyond Measurement Metrics: A Human-Centered Framework for Semantic Validation of Network Traffic Classification
    Machine Learning
    Read original (arXiv cs.LG (Machine Learning)) ↗
  • arXiv cs.CL (Computation and Language) · EN Developer Tools
    Can LLMs Follow the Pulse of a Crisis? Evaluating Crisis Sentiment in Bangladesh's July Uprising
    Deep Learning Neural Network Reinforcement Learning
    Read original (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.LG (Machine Learning) · EN Inference & Efficiency
    MedPCFM-TED: One-Step Point Cloud Flow Matching for Implant Generation via Teacher-Guided Endpoint Distillation
    Inference Reinforcement Learning Reinforcement Learning from Human Feedback (RLHF)
    Read original (arXiv cs.LG (Machine Learning)) ↗
  • arXiv cs.CL (Computation and Language) · EN Training & Fine-tuning
    TAME: Token Attribution and Masking for Emergent misalignment
    Fine-tuning Llama
    Read original (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN New Model Releases
    LSREP: A Longitudinal State-Replay Protocol for Evaluating Conversational Memory, with ICE v2 as an Audited Local-First Architecture
    Deep Learning Neural Network Retrieval-Augmented Generation (RAG) Reinforcement Learning from Human Feedback (RLHF) Software Engineering
    Read original (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN Training & Fine-tuning
    Disentangling Representation Evolution in Transformers through Directional Decomposition
    Deep Learning Machine Learning Neural Network Retrieval-Augmented Generation (RAG) Transformer
    Read original (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN Safety & Evaluation
    Inoculation Midtraining with Learned Neologisms
    Fine-tuning Reinforcement Learning
    Read original (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN Training & Fine-tuning
    LLM-Based Schema-Aware Split Learning for Privacy-Preserving Mental Distress Prediction Across Heterogeneous Surveys
    Llama Retrieval-Augmented Generation (RAG) Reinforcement Learning
    Read original (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN Training & Fine-tuning
    LongAgent: History-Guided Agentic Search for Longitudinal Outcome Prediction
    Read original (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN Training & Fine-tuning
    K-Bench: a clinically calibrated benchmark for evaluating large language models in high-risk mental health conversations
    GPT Retrieval-Augmented Generation (RAG) Reinforcement Learning
    Read original (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN Training & Fine-tuning
    AlgoEvo: Self-Evolving Agentic Search for Automated Algorithm Discovery
    AI Agents Deep Learning Machine Learning
    Read original (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN Training & Fine-tuning
    Navigating Sparse Evidence: Agentic Visual RAG via Explicit Context Selection and Consolidation
    Retrieval-Augmented Generation (RAG) Reinforcement Learning Software Engineering
    Read original (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN Training & Fine-tuning
    When the World Lies: Backdoor Attacks on Latent World Models for Downstream Control
    Fine-tuning Neural Network Reinforcement Learning
    Read original (arXiv cs.AI (Artificial Intelligence)) ↗
  • Publickey · JA Agents & Tool Use
    AnthropicのMCP共同作者が来日、基調講演で語るこれからのMCP注力領域。AGNTCon+MCPCon Japan 2026
    Anthropic's MCP co-author sets next focus: agent messaging, skills, identity
    AI Agents Anthropic Machine Learning Model Context Protocol (MCP)
    At the Linux Foundation's AGNTCon+MCPCon Japan 2026 in Tokyo (Sept 10), MCP co-author David Soria Parra of Anthropic said MCP tool calls on Claude have passed roughly 1 billion cumulatively, SDK downloads exceed 500M per month, and the protocol went fully stateless this year. Over the next 12 months the project will focus on agentic messaging via MCP Tasks for long-running work, Skills over MCP, and agent authorization and identity.
    Read original (Publickey) ↗
  • Publickey · JA Agents & Tool Use
    OpenAIやAnthropicなどAIベンダごとのAPIの違いを吸収し統合する「Agent Router」、Linux Foundation傘下で業界標準へ
    Envoy AI Gateway joins AAIF as 'Agent Router', a unified LLM and MCP gateway
    AI Agents Anthropic Machine Learning Model Context Protocol (MCP) OpenAI
    The Linux Foundation's Agentic AI Foundation announced at AGNTCon+MCPCon Japan 2026 that the open-source Envoy AI Gateway has joined AAIF and been renamed Agent Router. It exposes OpenAI, Anthropic, Gemini, Bedrock, Azure OpenAI and many other providers through one OpenAI-compatible API, and adds an MCP gateway, fallback and token quotas, metrics-based routing and observability. Already at v1.1 with 11 public adopters, AAIF aims to make it the de facto industry standard.
    Read original (Publickey) ↗
  • arXiv cs.CL (Computation and Language) · EN Training & Fine-tuning
    Sequential Adapter Stacking for Cross-Lingual Low-Resource ASR
    Fine-tuning Speech Processing
    Read original (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN Inference & Efficiency
    Merging the Knowledge of LLMs for Automatic Speech Recognition
    Inference Retrieval-Augmented Generation (RAG) Reinforcement Learning Speech Processing
    Read original (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN New Model Releases
    A Language-Guided Multimodal Foundation Model for Zero-Shot and Multi-Task Brain Signal Analysis
    Fine-tuning Retrieval-Augmented Generation (RAG)
    Read original (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.CL (Computation and Language) · EN Training & Fine-tuning
    Empathy Is Steerable but Multi-Axial: Mechanism Geometry and Persona Effects in LLMs
    Deep Learning
    Read original (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.LG (Machine Learning) · EN Training & Fine-tuning
    Principal-timestep Restricted Init via Sparse Matrix-decomposition in Flow-matching
    Fine-tuning Neural Network
    Read original (arXiv cs.LG (Machine Learning)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN Training & Fine-tuning
    Beyond AI Literacy: A Structured Review and Exploratory Meta-Analysis of Measures for Competent Generative-AI Use
    AI Agents Machine Learning Meta Neural Network
    Read original (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.CL (Computation and Language) · EN Inference & Efficiency
    IROH: Insightful Ranking Of Humor using Multi-Stage Hybrid Retrieval with Rationale-Distilled LLM Judges for JOKER 2026 Track Task 1 English
    Reinforcement Learning
    Read original (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.LG (Machine Learning) · EN Training & Fine-tuning
    Multi-View Molecular Representation Learning with Hierarchical Graphs and Contextualized Fingerprints
    Embeddings Fine-tuning Retrieval-Augmented Generation (RAG)
    Read original (arXiv cs.LG (Machine Learning)) ↗
  • arXiv cs.CL (Computation and Language) · EN Inference & Efficiency
    Through the Eyes of the Beholder: Biometric and Demographic Conditioning for Multimodal Sexism Detection
    Inference Neural Network
    Read original (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.LG (Machine Learning) · EN New Model Releases
    Specifying Reward Functions for RL Without Environment Sampling
    AI Agents Deep Learning Reinforcement Learning Reinforcement Learning from Human Feedback (RLHF)
    Read original (arXiv cs.LG (Machine Learning)) ↗
  • arXiv cs.CL (Computation and Language) · EN Inference & Efficiency
    Option-Aware Retrieval and Task-Specific VLM Adaptation for Medical VQA
    Inference Neural Network Software Engineering
    Read original (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN New Model Releases
    To Each Language Its Tokenizer: Modular Tokenizers for Efficient Multilingual LLMs
    Embeddings Inference Meta
    Read original (arXiv cs.CL (Computation and Language)) ↗