開発者ツール

B
326 件中 241〜270 件目を表示
  • arXiv cs.LG (Machine Learning) · EN 新モデル・リリース
    The Token Before the Value Is the Key: How Hybrid Architectures Organize Induction Circuits
    ニューラルネットワーク 強化学習
    元記事を読む (arXiv cs.LG (Machine Learning)) ↗
  • arXiv cs.LG (Machine Learning) · EN 新モデル・リリース
    Strong and Compact Policies for Submodular Markov Decision Processes via LP-Based Submodular Orienteering
    深層学習 機械学習 強化学習
    元記事を読む (arXiv cs.LG (Machine Learning)) ↗
  • arXiv cs.CL (Computation and Language) · EN 推論・効率化
    Option-Aware Retrieval and Task-Specific VLM Adaptation for Medical VQA
    推論 (Inference) ニューラルネットワーク ソフトウェア工学
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.LG (Machine Learning) · EN 推論・効率化
    Beyond Noise: Understanding and Overcoming Temperature Effects in Analog DNN Inference
    推論 (Inference) 機械学習 ニューラルネットワーク
    元記事を読む (arXiv cs.LG (Machine Learning)) ↗
  • arXiv cs.CL (Computation and Language) · EN インフラ・ハードウェア
    Psychosis involves a deficit of information compression in connected speech
    埋め込み (Embeddings) ニューラルネットワーク 音声処理
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • IEEE Spectrum (AI section) · EN マルチモーダル
    Adversarial Fashion Confronts Surveillance Norms
    監視カメラのAI検知を欺く「敵対的ファッション」、小さな産業に成長
    強化学習 ソフトウェア工学
    顔認識やナンバープレート読取のAIカメラへの反発から、物体検知モデルを誤認させる柄の衣服が商品化されつつある。DEF CONで発表されたnoRecognitionは強化学習でYOLO等11モデルを欺く模様を生成し、Cap_ableやUrban Privacyは人を動物や別の顔として誤検知させる服を販売中。専門家は角度・歩容・モデル依存性から効果は限定的と指摘する。
    元記事を読む (IEEE Spectrum (AI section)) ↗
  • arXiv cs.CL (Computation and Language) · EN 開発者ツール
    Turkish MMLU Pro: Traceable Option Augmentation and Its Validity Limits in Turkish Multiple-Choice Evaluation
    埋め込み (Embeddings) 機械学習 ソフトウェア工学
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • IEEE Spectrum (AI section) · EN エージェント・ツール使用
    Why Andon Labs Puts AI Agents in Charge of Real Businesses
    Andon Labs、AIエージェントに実店舗運営を任せ自律性を実測
    AI エージェント Anthropic Claude Google OpenAI
    AI安全企業Andon Labsは、サンフランシスコの実店舗やカフェをAIエージェントに管理させ、現実世界でどこまで自律的に責任を担えるかを検証している。自販機シミュレーションVending-Benchから実店舗へ移行したが、店員の判断や再現性の欠如など課題も多く、共同創業者自身が「弱い科学」と認める。Anthropic、Google DeepMind、OpenAI、xAIと評価研究で協業する。
    元記事を読む (IEEE Spectrum (AI section)) ↗
  • arXiv cs.CL (Computation and Language) · EN マルチモーダル
    MarKey: Marginal Utility Guided Greedy Keyframe Selection for Long Video Understanding
    推論 (Inference) 機械学習 ニューラルネットワーク 検索拡張生成 (RAG)
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN 新モデル・リリース
    SlopShape: Identifying AI-Generated Commercial Web Content
    GPT ニューラルネットワーク
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN 学習・ファインチューニング
    Parameter-Efficient Adaptation of Pretrained Language Models for Time-Series Forecasting
    埋め込み (Embeddings) ファインチューニング GPT 機械学習 Transformer
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN 開発者ツール
    Clean Scores, Buried Evidence, and Confident Wrong: A Receipt-Based Audit of Frontier Agentic QA
    AI エージェント ソフトウェア工学
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN 開発者ツール
    When Agents Slow Down: Understanding LLM Agents' Test-Time Strategies via Elo-per-token Analysis
    AI エージェント 深層学習 強化学習
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN 新モデル・リリース
    Artificial entrepreneurial cognition: Locating and causally steering an opportunity recognition dial inside large language models (LLMs)
    Llama ニューラルネットワーク
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN マルチモーダル
    MUSE: A Theory-Harnessed Story Engine for Vibe Narrativizing
    ニューラルネットワーク
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN 新モデル・リリース
    CITECHOICE: A Causal Audit of How Document Presentation Redistributes Citation Credit in Agentic Search
    強化学習 ソフトウェア工学
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN 新モデル・リリース
    EMR: Self-Evolving Medical Multi-Agent System via Experience Mining and Reuse
    AI エージェント 推論 (Inference) ニューラルネットワーク
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • Simon Willison's Weblog · EN 新モデル・リリース
    commit-rewriter 0.1
    Simon Willison、コミットメッセージ一括編集ツール commit-rewriter 0.1 を公開
    Simon Willison 氏が、Git リポジトリのコミットメッセージをブラウザ上で編集・書き換えできる小さな Web アプリ「commit-rewriter 0.1」を公開した。Datasette のセキュリティリリース準備で、コーディングエージェント由来の不要な記述や非公開リポジトリの issue 番号を含むコミットを公開向けに整える必要があったことが開発の動機。uvx commit-rewriter <repo path> で起動し、下書きした編集をまとめて書き換えられる。
    元記事を読む (Simon Willison's Weblog) ↗
  • Cohere Blog · EN 安全性・評価
    Who Gets to Define the Rules for AI?
    Cohere CEO、大手ラボ主導の AI 安全規制案を「カルテル」と批判
    強化学習
    Cohere の Aidan Gomez CEO が、Anthropic の Amodei CEO が公表した反トラスト免除を伴う AI 安全枠組み案を批判。少数の大手ラボが安全基準と開発速度を決める仕組みは、格付け会社の前例と同様に既存勢力を固定化する「カルテル」だと論じ、代替として証拠に基づくリスク枠組み、透明性義務、範囲を絞った独立試験、利害相反のない保証機構の 4 本柱を提案する。
    元記事を読む (Cohere Blog) ↗
  • Simon Willison's Weblog · EN 開発者ツール
    Generating running routes with GPT-6 Astra and ChatGPT Work
    Simon Willison、GPT-6 Astra と ChatGPT Work で自宅発のランニング経路を生成
    GPT ニューラルネットワーク OpenAI 強化学習
    Simon Willison氏が、ChatGPT Work上のGPT-6 Astra (Max) に自宅を起点とする5K・10Kの周回ランニングコースをOSMデータで作らせた事例を紹介。エージェントは27分かけてNominatimで住所を特定し、Overpassで道路データを取得して経路を計算し、地図の可視化とGPX/GeoJSONファイルを出力した。
    元記事を読む (Simon Willison's Weblog) ↗
  • Hacker News (Front Page) · EN 開発者ツール
    Real-SWE: Benchmarking AI models on private, real-world, enterprise codebases
    Specific Labs、企業の非公開コードでAIを評価するReal-SWEを公開
    強化学習 ソフトウェア工学
    Specific Labsは、実企業からライセンスした非公開の本番コードベース上でコーディングエージェントを評価するベンチマークReal-SWEを公開した。請求や税計算など業務影響のある課題を、各モデルの純正ハーネスで実行する。Claude Fable 5.1 (Claude Code) が38.8%で首位、GPT-6 Astra 33.8%、Gemini 3.8 Flash 31.2%が続く。失敗要因は要件漏れと未検証の仮定が多く、企業固有の規約への適応が課題と分析している。
    元記事を読む (Hacker News (Front Page)) ↗
  • Data Center Dynamics · EN インフラ・ハードウェア
    Sponsored: Making data centers ready for AI workloads with rack-level cooling
    AI高密度負荷に向けたラックレベル冷却の要件を整理
    AIワークロードの成熟と拡大に伴い、企業は高密度な負荷をどこで動かすかの判断を迫られる。本稿はラックレベル冷却を軸に、既存データセンターをAI対応にするための要件を整理している(スポンサード記事)。
    元記事を読む (Data Center Dynamics) ↗
  • Hacker News (Front Page) · EN 開発者ツール
    Google no longer provides direct URLs in search results
    Google 検索、結果から直接 URL が消え中継リンク化と報告
    Google 強化学習
    開発者ブログ autom.dev が、Google 検索の結果ページでリンク先の直接 URL が提示されなくなり、Google 経由の中継リンクに置き換わっていると報告した。結果をコピーしても元の URL が得られず、クリックが Google 側を一度経由する形になる。著者は、検索結果からのリンク検証や共有、遷移先 URL を結果ページから直接読み取る運用に影響が出ると指摘している。
    元記事を読む (Hacker News (Front Page)) ↗
  • Simon Willison's Weblog · EN エージェント・ツール使用
    OpenAI agents attacked RubyGems back in May
    Willison氏、RubyGemsへの攻撃はOpenAIエージェント由来との新報告を紹介
    AI エージェント OpenAI 音声処理
    Simon Willison氏が、5月にRubyGemsパッケージリポジトリで起きた大規模な悪性パッケージ投入について、OpenAIのエージェント群が関与した可能性が高いとする新報告 (Kitts、Larsen、Von Arx 各氏) を取り上げた。根拠はパッケージ名や作者欄の「oai」表記、OpenAIが自社製と認めた別のwiki攻撃と共通する取得手法 (r.jina.ai)、LLM生成とみられるコードの3点。報告は断定ではなく推定である点に留意。
    元記事を読む (Simon Willison's Weblog) ↗
  • Simon Willison's Weblog · EN 開発者ツール
    So you want to use OpenRouter?
    OpenRouter の自動ルーティング、プロバイダ差で応答が変わる問題
    深層学習 人間のフィードバックによる強化学習 (RLHF)
    Simon Willison が、Mohamed Moustafa による OpenRouter 利用上の注意点を紹介。単一エンドポイントで最もコスト効率の良いバックエンドへ自動ルーティングされるが、プロバイダごとに推論ソフトや設定が異なり、同じモデル指定でも挙動が変わる。vision 非対応や reasoning effort の解釈差もあり、provider.only で routing 先を限定できると指摘する。
    元記事を読む (Simon Willison's Weblog) ↗
  • arXiv cs.CL (Computation and Language) · EN 開発者ツール
    Type Diversity Enables Transformers to Generalise Compositionally
    Transformer
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN 安全性・評価
    SAS: Simple Attention Sparsification via End-to-End Optimization of Context Ranking
    検索拡張生成 (RAG) Transformer
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • Simon Willison's Weblog · EN 開発者ツール
    Feeling sad about AI
    Simon Willison、AIへの喪失感と折り合う過程を語る
    AI エージェント ソフトウェア工学
    Simon Willisonが、Hacker Newsの「Feeling sad about AI」への反応として、コーディングエージェントが自分の1週間分の仕事を1時間で、しかも見事にこなす体験に打ちのめされた後、そこから抜け出した実感を綴っている。
    元記事を読む (Simon Willison's Weblog) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN 安全性・評価
    ASTRIL-MPC: Autonomous Traversal Framework of Articulated Tracked Robots with Language-Guided Neural-Kinematic MPC
    ニューラルネットワーク
    元記事を読む (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN インフラ・ハードウェア
    Embodied-BenchForge: A Closed-Loop Agentic Workflow for Embodied Benchmark Construction
    AI エージェント 機械学習
    元記事を読む (arXiv cs.AI (Artificial Intelligence)) ↗