Google が Gemini 3.5 の「Live Translate」で、リアルタイムの同時通訳を打ち出した。発生元は DeepMind 公式を中心に、simon_willison らコミュニティと arXiv が絡む構成――公式発表に技術者コミュニティの反応が付く形だ。会話の音声を遅延少なく訳して返す、対話をまたぐ通訳体験が主眼で、本流は翻訳精度の競争より、リアルタイム性という体験価値へ軸が移っている点にある。マルチモーダルモデルが「読む・書く」から「その場で聞いて訳す」応用へ広がる動きとして読める。ただし現段階は機能発表が中心で、実利用での遅延・精度や対応言語の広がり、既存通訳との差は、今後の検証を待つ必要がある。
Google × 開発者ツール
Google、Gemini 3.5 Live Translateで同時通訳
Google、Gemini 3.5 Live Translateで同時通訳
✎ ストーリー本文
▲ 公式・報道
公式
Fluid, natural voice translation with Gemini 3.5 Live Translate
Google、Gemini 3.5 Live Translateで自然な音声翻訳を提供
コミュニティ
Google、拡散型のオープンウェイトモデルDiffusionGemmaを公開
コミュニティ
Apple、WWDC 2026 で次世代 Siri を発表 — Gemini 派生モデルを PCC で運用
学術(arxiv ほか) 5本 ▾
学術
MSUE: Multi-Modal Soccer Understanding Expert
MSUE、多専門家アーキで2026 SoccerNet VQAに3位
学術
The Shibboleth Effect: Auditing the Cross-Lingual Distributional Skew of Large Language Models
言語で変わるLLMの振る舞い、地政学ウォーゲームで「シボレス効果」検証
学術
A History-Aware Visually Grounded Critic for Computer Use Agents
HiViG、計算機操作エージェント向けの履歴認識・視覚接地批評
学術
学術
Beyond APIs: Probing the Limits of MLLMs in Physical Tool Use
PhysTool-Bench公開、MLLMの物理ツール使用能力を初めて評価