xAI がコーディング支援エージェント「Grok Build」を公開した。発生元は arXiv 4件に itmedia の報道1件が付く学術寄りの構成で、公式発表というより研究と報道が起点――技術的背景を伴う公開だ。コードの生成にとどまらず、計画・実装・修正を自律的に回すエージェント型の開発支援が主眼で、本流はモデルの生成品質そのものより、開発工程を任せられるエージェントの競争が各社に広がっている点にある。OpenAI や NVIDIA が先行するこの領域に xAI が参入した構図として読める。ただし公開直後で、実際のコード品質や既存エージェントとの優劣、開発現場での採用は、今後の確認点として残る。
xAI、コーディングエージェントGrok Build公開
xAI、コーディングエージェントGrok Build公開
xAIがコーディングエージェント「Grok Build」ベータ公開。サブエージェントを並列に実行可能など
xAI、コーディングエージェント「Grok Build」ベータ公開、サブ agent 並列実行
学術(arxiv ほか) 16本 ▾
MobileMoE: Scaling On-Device Mixture of Experts
MobileMoE、端末向け1B未満MoE言語モデルで密モデル比2-4倍の効率を実現すると主張
Causal Risk Minimization for High-Dimensional Treatments
高次元介入空間に対応する因果リスク最小化を学習問題として定式化
Learning When to Think While Listening in Large Audio-Language Models
Wait-Think-Answer、音声-言語モデル向けストリーミング思考制御を学習する手法
MobileGym: A Verifiable and Highly Parallel Simulation Platform for Mobile GUI Agent Research
MobileGym、検証可能な判定と並列実行に対応するブラウザ製モバイル GUI エージェント研究基盤を公開。
Beyond Summaries: Structure-Aware Labeling of Code Changes with Large Language Models
論文:LLM でコード変更にラベル付けする 2 段階手法、recall 84% を達成。
Automated Benchmark Auditing for AI Agents and Large Language Models
Auto Benchmark Audit、168のAIベンチマークから設計欠陥を体系検出
Activation Oracle信頼度推定、bootstrap mode frequencyが最高較正
Peak-Then-Collapse and the Four Interface Channels of Knowledge-Graph Tool Use
RLVRツール利用は「ピーク後崩壊」、4種の失敗モードを観察
CausaLab: A Scalable Environment for Interactive Causal Discovery Toward AI Scientists
CausaLab、LLMエージェントの対話的因果発見を仮想ラボで評価
STORM: Internalized Modeling for Spatial-Temporal Reasoning in Video-Language Models
STORMS、テキストCoTを介さず内部化した時空間推論で動画-言語モデルを高速化
MAGIC: Multimodal Alignment & Grounding-aware Instruction Coreset for Vision-Language Models
MAGIC、学習不要の前向きシグナルで多モーダル指示Coresetを構築
医療RAGのNLI報酬は分布次第、log-probはシグナル崩壊と指摘
Neural Scalable Symbolic Search Framework for Complex Logical Queries with Multiple Free Variables
NeSyS-k、k自由変数を持つ複雑論理クエリ応答を共同ランクで近似
LLMエージェント、意味的擾乱に表層擾乱より約20pt多く回答が変わる
Creative Quality Alignment: Expert Tacit Knowledge Transfer via Chain-of-Thought Fine-Tuning
Calibrated Surprise指標の実装検証、低資源/小モデル条件で実現可と報告
From Latent Space to Training Data: Explainable Specialization in Minimal MLPs
最小MLPの隠れニューロン特化が学習データのプロトタイプ復元を改善