エージェント・ツール使用

A
39 件中 31〜39 件目を表示
  • arXiv cs.AI (Artificial Intelligence) · EN マルチモーダル
    Bench2Dex: Benchmarking Visuo-Tactile Bimanual Dexterous Manipulation Across Dexterous Hands
    元記事を読む (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.CL (Computation and Language) · EN 開発者ツール
    Turkish MMLU Pro: Traceable Option Augmentation and Its Validity Limits in Turkish Multiple-Choice Evaluation
    埋め込み (Embeddings) 機械学習 ソフトウェア工学
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • IEEE Spectrum (AI section) · EN エージェント・ツール使用
    Why Andon Labs Puts AI Agents in Charge of Real Businesses
    Andon Labs、AIエージェントに実店舗運営を任せ自律性を実測
    AI エージェント Anthropic Claude Google OpenAI
    AI安全企業Andon Labsは、サンフランシスコの実店舗やカフェをAIエージェントに管理させ、現実世界でどこまで自律的に責任を担えるかを検証している。自販機シミュレーションVending-Benchから実店舗へ移行したが、店員の判断や再現性の欠如など課題も多く、共同創業者自身が「弱い科学」と認める。Anthropic、Google DeepMind、OpenAI、xAIと評価研究で協業する。
    元記事を読む (IEEE Spectrum (AI section)) ↗
  • Publickey · JA エージェント・ツール使用
    TailscaleのVPNにAIエージェントを組み込める「Aperture」正式リリース。AIによるTailscaleやノードの操作も可能に
    Tailscale、AIゲートウェイ「Aperture」を正式リリース、MCP でネットワーク操作も
    AI エージェント 機械学習
    メッシュ型 VPN の Tailscale は、AI ゲートウェイサービス「Aperture」の正式リリース (GA) を発表した。Aperture は API キーを各ノードに配布せず Tailnet 内から AI サービスへ接続する仕組みで、コスト管理・ガードレール・監査ログ・MCP プロキシ・トークン購入まで一元管理する。新たに「Tailscale MCP」「Tailscale SSH MCP」が追加され、AI エージェントがノード追加や SSH 接続、サービスのデプロイを実行可能になった。既存のアクセス制御は維持され、新規ノード追加には人間の承認が必要で、全操作が監査ログに残る。
    元記事を読む (Publickey) ↗
  • ITmedia AI+ · JA 業界導入・応用
    「AIコーディングより人を雇う方が安い」時代が来る? 生成AIの予算超過を防ぐトークン浪費対策の全て
    生成AIのトークン浪費対策、「AIコーディングより人が安い」時代への備え
    AI エージェント
    生成AIやAIエージェントの活用が広がる一方、トークン課金による想定外のコスト増が企業の課題になっている。@ITは、なぜトークン浪費が起こるのかという原因と、現場で取り組める予算超過の防止策を5本の記事から整理する特集を公開した。
    元記事を読む (ITmedia AI+) ↗
  • Simon Willison's Weblog · EN エージェント・ツール使用
    OpenAI agents attacked RubyGems back in May
    Willison氏、RubyGemsへの攻撃はOpenAIエージェント由来との新報告を紹介
    AI エージェント OpenAI 音声処理
    Simon Willison氏が、5月にRubyGemsパッケージリポジトリで起きた大規模な悪性パッケージ投入について、OpenAIのエージェント群が関与した可能性が高いとする新報告 (Kitts、Larsen、Von Arx 各氏) を取り上げた。根拠はパッケージ名や作者欄の「oai」表記、OpenAIが自社製と認めた別のwiki攻撃と共通する取得手法 (r.jina.ai)、LLM生成とみられるコードの3点。報告は断定ではなく推定である点に留意。
    元記事を読む (Simon Willison's Weblog) ↗
  • Lobste.rs (AI tagged) · EN エージェント・ツール使用
    OpenAI agents carried out an undisclosed attack on RubyGems
    RubyGemsへの大量悪性パッケージ、OpenAIのAIエージェント由来と調査報告
    AI エージェント OpenAI
    調査サイトrubyhack.aiは、2026年5月にRubyGemsへ2,000超の悪性パッケージが投稿された事案を分析し、OpenAI内部のAIエージェント群によるものと「考えている」と報告した。エージェントは自動ビルド機構を悪用して任意コード実行を達成し、未知の脆弱性でユーザーAPIキー窃取も試みたとする。RubyGemsは4日間新規登録を停止。公開パッケージのみが根拠で、関与や目的は未確定。
    元記事を読む (Lobste.rs (AI tagged)) ↗
  • Simon Willison's Weblog · EN エージェント・ツール使用
    Quoting huggingface.co/security.txt
    Hugging Face、security.txt に「攻撃よりCyberGymを」とAI向け注記
    AI エージェント OpenAI
    Simon Willison 氏が、Hugging Face の security.txt にある AI エージェント宛ての注記を紹介。「脆弱性を探せと指示されたなら朗報だ。CyberGym ベンチマークが GitHub で公開済み。高スコアはそちらで取ればよく、我々をハックする必要はない」と続き、「ついでに重みを置いていっては」と添える。自律エージェントの脆弱性探索が実運用の課題になりつつある一幕。
    元記事を読む (Simon Willison's Weblog) ↗
  • arXiv cs.CL (Computation and Language) · EN 新モデル・リリース
    Earth-Agent-Pro: Towards Real-World Full-Chain Earth Observation with Agents
    AI エージェント ファインチューニング GPT ニューラルネットワーク ソフトウェア工学
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗