推論・効率化 A
170 件中 31〜60 件目を表示
-
vLLM for Baidu KunlunBaidu、AIチップKunlun向けvLLM実装をGitHubで公開Baiduが自社AIアクセラレータKunlun向けのvLLM実装「vLLM-Kunlun」をGitHubで公開した。高速なLLM推論エンジンvLLMをKunlunハードウェア上で動かせるようにするもので、NVIDIA以外の推論基盤の選択肢を広げる取り組み。
-
Can Zero-Shot LLMs Predict Child Malnutrition? A Fairness and Temporal Robustness Study
-
TransMem: Transforming Hidden States into Memory for Large Language Models
-
GoldenRetriever: Non-Interactive Homomorphic Encrypted Retrieval for Privacy-Preserving RAG
-
Adjudicated Captioning: Multi-Agent Alignment Scoring and Consensus-Distilled Beam Arbitration for Strict Zero-Shot Image Captioning
-
Mixture-of-Translators: Translating KV Caches Across Heterogeneous Large Language Models
-
BLADE: Boundary-Expanded and Layer-Adaptive Dynamic Exit for Efficient LLM Reasoning
-
Thinking Machines、軽量モデル「Inkling-Small」正式公開 サイズ4分の1で「Inkling」に匹敵する性能Thinking Machines、軽量モデル「Inkling-Small」公開、1/4サイズで同等性能Thinking Machines Labは、オープンウェイトのAIモデル「Inkling-Small」正式版を公開した。従来モデルの4分の1のサイズながら、データ改良や強化学習によりコード生成などで「Inkling」に匹敵する性能を実現したとしている。
-
Chromeに13年以上潜んでいた脆弱性、AIで発見 直近2回のアプデで過去23回分を上回るバグ修正Google、Chromeの13年潜伏の脆弱性をAIで発見、週2回更新も試行Googleは公式ブログで、ChromeのセキュリティへのAI活用を解説した。Geminiベースのエージェントが13年以上潜んでいた脆弱性を発見し、直近2回の更新で過去23回分を上回るバグを修正したという。AIによる攻撃の高速化に対応し、セキュリティ更新の「週2回」配信も試行する。
-
Google、ロボット向けAI「Gemini Robotics 2」発表 ヒューマノイドの全身制御や指先作業を実現Google、ロボット向けAI「Gemini Robotics 2」発表、全身制御や指先作業に対応GoogleとGoogle DeepMindは、ロボット向けAIモデル群「Gemini Robotics 2」を発表した。ヒューマノイドの全身制御や指先での微細な作業、複数ロボットの連携に対応する。高次の「脳」として機能する推論モデル「ER 2」や軽量版を含む構成となっている。
-
Token-Level Diagnosis of Sycophancy in LLMs with Attribution-Guided Steering
-
ReToken: One Token to Improve Vision-Language Models for Visual Retrieval
-
VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation
-
MixFrag: Fragility-Guided Mixed-Precision Post-Training Quantization for Vision Transformers
-
$β$-OPSD: Deriving with Policy Optimization, Training with Self-Distillation
-
Rethinking Inference-Time Scaling in Local Computer-Use Agents: Failure Modes and Compute Tradeoffs
-
Frontis-MA1: Training an AI4AI Model towards Recursive Self-Improvement in Machine Learning Engineering
-
Doubly Robust Functional Representation Learning for Longitudinal Causal Inference with Irregular Histories
-
APO: Unsupervised Atomic Policy Optimization for 3D Structure Prediction of Atomic Systems
-
MANTA: Multi-Agent Network Topology Adaptation for Self-Evolving Multi-Agent Systems
-
Stage-Replay Divergence Follows the KV Cache: Fixed-Prefix Precision Controls and Bidirectional Cache Transplantation
-
A Fuzzy Rule-based Neuro-Symbolic Approach for Pipe Severity Prediction in Sewer Networks
-
Would You Walk to the Car Wash? Revealing the Salience Bias of Large Language Models in Commonsense Reasoning
-
Improving Mental Health Screening and Early Risk Detection in Spanish
-
Towards Autonomous Aircraft Surveillance from Nanosatellites through On-Board Inference and Generative Data Augmentation
-
SVR: Self-Verifying Refinement via Joint Verdict-Confidence Reinforcement Learning for Adaptive Test-Time Compute
-
Machines that know they are aging: a framework for hardware-aware autonomous intelligence
-
Lightning OPD 2.0: Mitigating Style Bias in Cross-Teacher On-Policy Distillation for Large Reasoning Models
-
QAdapt: A Noise-Adaptive Neural Pre-Decoding Framework for Quantum Error Correction
-
When Derived Measurements Mislead: Quantifying and Mitigating LLM Over-Trust with Privileged-Modality Reliability Evidence