OpenAI が医薬品合成の改善を狙う自律的な「AI化学者」を公表した。発生元は公式発表が起点で、itmedia の報道と lobste.rs・HN のコミュニティ反応が続く構成――学術論文より、発表とその受け止めが先行している。研究室の作業を自動化し、合成経路の探索や最適化をエージェントに任せる方向性で、創薬という応用ドメインにエージェントを持ち込んだ点が本流だ。ただし現時点は発表段階で、実際の実験系での再現性や成功率、既存ワークフローへの組み込みがどこまで進むかは未確認――派手さより地に足の着いた検証が今後の読みどころになる。
OpenAI、医薬合成を改善する自律AI化学者を公表
OpenAI、医薬合成を改善する自律AI化学者を公表
A near-autonomous AI chemist improves a challenging reaction in medicinal chemistry
OpenAIとMolecule.one、半自律AI化学者が創薬反応を改善
「AIを使う学生」vs.「使わない学生」、エッセイが創造的なのはどっち? 米大学が2025年に実証実験
AIを使う学生と使わない学生、創造的なのはどちら?
GPT‑NL: a sovereign language model for the Netherlands
オランダの主権的言語モデル「GPT-NL」
OpenAIの高度AIでソフトバンクの脆弱性を1万件発見 孫正義氏「大変な危機」 日本の重要インフラ企業へ診断サービス提供
ソフトバンク、OpenAIのAI活用の脆弱性診断「Patching as a Service」発表
CrankGPT — Local Human-powered AI
CrankGPT、GPU不要の「人力ローカルAI」を風刺的に提示
学術(arxiv ほか) 20本 ▾
Explaining Attention with Program Synthesis
プログラム合成で注意機構を説明し解釈可能性を追求
A Multi-Domain Benchmark for Detecting AI-Generated Text-Rich Images from GPT-Image-2
GPT-Image-2 生成の文字入り画像を見抜く多分野ベンチマーク
TxBench-PP: Analyzing AI Agent Performance on Small-Molecule Preclinical Pharmacology
TxBench-PP、小分子前臨床薬理での AI エージェント性能を評価
CAPRA: Scaling Feedback on Software Architecture Deliverables with a Multi-Agent LLM System
ソフト設計成果物の添削を自動化するマルチエージェントLLM「CAPRA」
ReproRepo: Scaling Reproducibility Audits with GitHub Repository Issues
ReproRepo、GitHub課題で再現性監査をスケール
RubricsTree、個人健康エージェントの開放型評価を拡張
Querying an astronomical database using large language models: the ALeRCE text-to-SQL system
LLMで天文DBを問い合わせるtext-to-SQLシステムを開発
Security and Privacy Prompts in the Wild: What Users Ask LLMs and How LLMs Respond
実世界でユーザがLLMに尋ねる安全・プライバシー質問を分析
AIの合成的な実体験表現、介護者ピア支援での緊張を検討
Toward Accessible Psychotherapy Training Using AI-Driven Interactive Patient Avatars
AI患者アバターで心理療法訓練をより手軽に
From Trainee to Trainer: LLM-Designed Training Environment for RL with Multi-Agent Reasoning
訓練生から訓練者へ、LLMがRL用の訓練環境を設計
Binary Tracking for Spatial QA and Navigation with Open Vision-Language Models
オープン VLM で動く空間質問応答・ナビ手法 Binary Tracking を提案
LLM 検索エージェントの推薦汚染耐性を測る枠組みを提案
LLM-based Visual Code Completion for Aerospace Geometric Design
航空宇宙設計向け LLM コード補助 copilot を提案する論文
Multimodal Evaluator Preference Collapse: Cross-Modal Contagion in Self-Evolving Agents
自己進化エージェントの評価選好崩壊と跨モーダル伝播を扱う論文
語義変化検出の新ベンチマーク BD-LSC データセットを公開