推論・効率化 A
171 件中 151〜171 件目を表示
-
Where Steering Signals Come From: Activation Source Selection in Activation Steering
-
TabRank: Chain-of-Thought Distillation for Table Re-Rankers
-
Memory Efficient Audio Synthesis with Decoupled Temporal Depth Diffusion TransformersApple、端末内音声合成の省メモリ手法を発表、AMXでSiri音声を生成Appleが、端末内で完結する省メモリな音声合成アーキテクチャを論文で公開した。リアルタイムに表情豊かで設定可能な音声を生成する「Siri Expressive Voices」を支える技術で、on-device基盤モデル「AFM 3 Core Advanced」が出力する意味的オーディオトークンを、Apple Matrix Coprocessor(AMX)の限られた演算・メモリ内で高音質音声へ変換するdetokenizerを提案。残差ベクトル量子化(RVQ)表現とストリーミング構成を用いる。ストリーミング以降の3要素設計の詳細はexcerpt途中切れで確認不可。
-
How Affect Propagates among LLM Agents: Emergent Emotional Contagion in Crowd Simulation
-
Rethinking Classifier-Free Guidance in On-Policy Diffusion Distillation
-
Denial of Deadline: Network-Driven Accuracy Collapse in Distributed Inference Pipelines
-
Co-Learning for Missing Arbitrary Modalities in Multi-modal Classification
-
Explainable Reinforcement Learning via Physics-Aware Policy Distillation
-
PIVOT: Efficient Query-Group Indexing for Token-Level Sparse Attention
-
SIREN: Towards End-to-End Extreme-Weather Early Warning with Experience-Grounded LLM Agents
-
From Data to Device: ELMOD An Efficient German-First 2.7B Language Model for Mobile Inference
-
PYPM-GGD: Pitman-Yor Process Mixture with Generalized Gaussian Density using ADAM
-
CADER: Confidence-Aware Dynamic Evidence Reasoning for Long-Video Understanding
-
Evaluating Fuzz Testing for Reinforcement Learning Agents
-
Bit-Accurate FPGA Evaluation of Learned Feature Gating in a Fixed-Point Fourier-Feature Automatic Modulation Classifier
-
Hierarchical Group-Conditional Conformal Risk Control for Selective Prediction in Language Models
-
EgoPlay: Event-Triggered Video Editing for Egocentric Streams
-
LOCKS: Page-Local Compact Key Summaries for Efficient Long-Context Decoding
-
EchoBridge: Long-Tail-Aware ECG-Echocardiography Text Alignment for Echocardiography-Derived Cardiac Findings
-
From transcription to semantic corpus analysis: unsupervised learning of sentence representations for ancient languages
-
The K-SCAN Clustering Algorithm