NVIDIA が生物基盤モデル(BioNeMo 系)向けの LoRA ファインチューニング・レシピを公開した。発生元は NVIDIA 公式1件に arXiv 4件が続く強い学術構成――発表そのものより、研究の蓄積を実装ガイドとして束ねた動きだ。巨大な生物モデルを作り直さず、LoRA で軽く適応させて創薬やタンパク質解析の個別課題に当てる方向性で、本流は「大きく学習する」から「軽く適応させる」への移行にある。ライフサイエンス領域に特化した適応手法が実務者向けに整理された点が要点だ。まだ研究主導で、実際の研究現場での再現性や採用の広がりは、レシピ公開直後では見えていない。
NVIDIA、生物基盤モデル用LoRAレシピ公開
NVIDIA、生物基盤モデル用LoRAレシピ公開
Fine-Tuning Biological Foundation Models with LoRA Using NVIDIA BioNeMo Recipes
NVIDIA、BioNeMo Recipes で生物基盤モデルの LoRA fine-tuning 手法を解説
学術(arxiv ほか) 31本 ▾
Native Active Perception as Reasoning for Omni-Modal Understanding
動画理解を効率化、難易度に応じ能動的に知覚する推論手法を提案
VLA モデルは常識を保持しているか、知識保持度を測る研究
Trade-offs in Medical LLM Adaptation: An Empirical Study in French QA
医療 LLM のドメイン適応、仏語 QA で利点と代償を実証研究
Mechanism-Guided Selective Unlearning for RLVR-Induced Reasoning
MAST、RLVR 由来の推論を巻き添えを抑えて選択的に忘却
Beyond Safe Data: Pretraining-Stage Alignment with Regular Safety Reflection
事前学習段階で安全反映、安全データを超えるアライメントを探る
ProductConsistency、指示画像編集で商品の同一性保持を改善
ARIADNE: Agnostic Routing for Inference-time Adapter DyNamic sElection
ARIADNE、推論時にアダプタを動的選択する汎用ルーティング
Learning from the Self-future: On-policy Self-distillation for dLLMs
拡散LLM向けのオンポリシー自己蒸留OPSDを探究
Multi-Source Cybersecurity Logs: An ATT&CK-Labeled Dataset and SLM Evaluation
ATT&CK注釈付き多源セキュリティログ集と小型LM評価
S4oP: Operator-level Pruning of Structured State Space Models for Resource-Constrained Devices
S4oP、状態空間モデルを演算子単位で枝刈り軽量化
EAGG: Embodiment-Aligned Grasp Generation via Geometry-Aware Graph Conditioning
身体性に整合した把持生成手法EAGGを提案
Uncertainty Quantification for Flow-Based Vision-Language-Action Models
フローベースVLAモデルの不確実性定量化
Catastrophic Forgetting is Low-Rank: A Function-Space Theory for Continual Adaptation
破滅的忘却は低ランク、継続適応の関数空間理論
Fine-tuning LLMs for Passive Depression Severity Estimation from AI Mental Health Dialogue
AIメンタルヘルス対話からうつ重症度を受動推定するLLM微調整
Environment-Grounded Automated Prompt Optimization for LLM Game Agents
環境に接地した自動プロンプト最適化でLLMゲームエージェント
From Drift to Coherence: Stabilizing Beliefs in LLMs
ドリフトから整合へ、LLMの信念を安定化
SuCo: Sufficiency-guided Continuous Adaptive Reasoning
SuCo、十分性に導かれた連続適応的推論
The Value Axis: Language Models Encode Whether They're on the Right Track
LLM内部に戦略の成否を符号化する「価値軸」を発見
Hierarchical Advantage Weighting for Online RL Fine-Tuning of VLAs from Sparse Episode Outcomes
VLAのオンラインRL微調整に階層的優位重み付けHABCを提案
KVEraser: Learning to Steer KV Cache for Efficient Localized Context Erasing
KVキャッシュの局所消去を学習で効率化するKVEraserを提案
ExpRL: Exploratory RL for LLM Mid-Training
ExpRL、人手QAデータを「報酬足場」に使うLLM中間学習向けRLを提案
Exploring Extrinsic and Intrinsic Properties for Effective Reasoning with Code Interpreter
コードインタープリタ推論を支える内在・外在特性を分析した論文
ロボット操作方策の原子的技能と合成的汎化を測るATOM-Benchを提案
Adaptive and Explicit safe: Triggering Latent Safety Awareness in Large Reasoning Models
推論モデルの潜在的な安全認識を引き出し脱獄耐性を高める手法を提案
LLMのスプリット学習向けプライバシー保護手法MIXGUARDを提案
GPUカーネル最適化向けスキル共進化RL「daVinci-kernel」を提案