ChatGPT と Google 検索のどちらが学習効果に優れるかを比較した研究が話題になった。発生元は itmedia の報道に lobste.rs・HN のコミュニティ反応と arXiv の研究が絡む構成で、公式発表は無く、報道と現場の議論が起点――「発表」ではなく検証と受け止めが先行した動きだ。生成 AI を学習ツールとして使ったときの理解度や定着を、従来の検索と対照実験で測ろうという内容で、本流は AI の教育利用を印象論でなくエビデンスで評価しようとする点にある。ただし単一の研究であり、対象や条件による結果の振れ、一般化の可否は、今後の追試を待つ必要がある。
ChatGPT対Google、学習効果を比較した研究
ChatGPT対Google、学習効果を比較した研究
ChatGPT vs. Google検索──どっちで調べるのが学習効果が高い? 8日間の実験で検証した研究
ChatGPTとGoogle検索、学習効果が高いのは?8日間の実験で検証
GPT‑NL: a sovereign language model for the Netherlands
オランダの主権的言語モデル「GPT-NL」
OpenAIの高度AIでソフトバンクの脆弱性を1万件発見 孫正義氏「大変な危機」 日本の重要インフラ企業へ診断サービス提供
ソフトバンク、OpenAIのAI活用の脆弱性診断「Patching as a Service」発表
CrankGPT — Local Human-powered AI
CrankGPT、GPU不要の「人力ローカルAI」を風刺的に提示
学術(arxiv ほか) 16本 ▾
ReproRepo: Scaling Reproducibility Audits with GitHub Repository Issues
ReproRepo、GitHub課題で再現性監査をスケール
RubricsTree、個人健康エージェントの開放型評価を拡張
Querying an astronomical database using large language models: the ALeRCE text-to-SQL system
LLMで天文DBを問い合わせるtext-to-SQLシステムを開発
Security and Privacy Prompts in the Wild: What Users Ask LLMs and How LLMs Respond
実世界でユーザがLLMに尋ねる安全・プライバシー質問を分析
AIの合成的な実体験表現、介護者ピア支援での緊張を検討
Toward Accessible Psychotherapy Training Using AI-Driven Interactive Patient Avatars
AI患者アバターで心理療法訓練をより手軽に
From Trainee to Trainer: LLM-Designed Training Environment for RL with Multi-Agent Reasoning
訓練生から訓練者へ、LLMがRL用の訓練環境を設計
Binary Tracking for Spatial QA and Navigation with Open Vision-Language Models
オープン VLM で動く空間質問応答・ナビ手法 Binary Tracking を提案
LLM 検索エージェントの推薦汚染耐性を測る枠組みを提案
LLM-based Visual Code Completion for Aerospace Geometric Design
航空宇宙設計向け LLM コード補助 copilot を提案する論文
Multimodal Evaluator Preference Collapse: Cross-Modal Contagion in Self-Evolving Agents
自己進化エージェントの評価選好崩壊と跨モーダル伝播を扱う論文
語義変化検出の新ベンチマーク BD-LSC データセットを公開