学習・ファインチューニング

A
85 件中 61〜85 件目を表示
  • arXiv cs.CL (Computation and Language) · EN 安全性・評価
    Beyond Safe Answers: Segment-Aware Listwise Alignment for Reasoning Safety in Large Reasoning Models
    人間のフィードバックによる強化学習 (RLHF) ソフトウェア工学
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN 新モデル・リリース
    Authorship attribution and aesthetic evaluation of AI poetry: a case study with Haiku
    Gemini GPT Llama ニューラルネットワーク
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • OpenAI Blog · EN 学習・ファインチューニング
    How Fyxer built an AI executive assistant people trust
    OpenAI、Fyxer の AI 秘書事例を公開、下書き 53% がそのまま採用
    ファインチューニング OpenAI
    OpenAI が顧客事例として英 Fyxer の AI エグゼクティブアシスタントを紹介。50 万時間超の人間 EA 業務データで学習し、メール処理を 30〜50 の専用小型モデルに分割、ユーザーの編集差分を DPO で学習する自己改善ループを構築。AI 下書きの 53% が無修正で送信され、90 日後の継続率は 90% 超、2025 年に ARR は 100 万→3,200 万ドルに成長したという。
    元記事を読む (OpenAI Blog) ↗
  • arXiv cs.CL (Computation and Language) · EN 新モデル・リリース
    RSIAgent: Autonomous Exploration for Recursive Self-improvement in New Environments
    AI エージェント GPT 強化学習
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN 学習・ファインチューニング
    Parameter-Efficient Adaptation of Pretrained Language Models for Time-Series Forecasting
    埋め込み (Embeddings) ファインチューニング GPT 機械学習 Transformer
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN インフラ・ハードウェア
    Reducing the Output-Mode Gap in Speech Language Models via Joint-Output On-Policy Distillation
    深層学習 ファインチューニング 強化学習 ソフトウェア工学 音声処理
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • Hacker News (Front Page) · EN 学習・ファインチューニング
    EuroBirdPortal – Live bird movements across Europe
    EuroBirdPortal、欧州の鳥の移動を週次で可視化するライブ地図
    人間のフィードバックによる強化学習 (RLHF)
    EuroBirdPortalは、欧州各国の観察記録を集約し、種ごとの出現数や分布の週次変化を地図上でアニメーション表示するサイト。2種を並べて比較するダブルマップや過去52週のタイムライン再生機能を備え、渡りの季節変動を直感的に追える。Hacker Newsで注目を集めた市民科学データの可視化事例。
    元記事を読む (Hacker News (Front Page)) ↗
  • Publickey · JA エージェント・ツール使用
    TailscaleのVPNにAIエージェントを組み込める「Aperture」正式リリース。AIによるTailscaleやノードの操作も可能に
    Tailscale、AIゲートウェイ「Aperture」を正式リリース、MCP でネットワーク操作も
    AI エージェント 機械学習
    メッシュ型 VPN の Tailscale は、AI ゲートウェイサービス「Aperture」の正式リリース (GA) を発表した。Aperture は API キーを各ノードに配布せず Tailnet 内から AI サービスへ接続する仕組みで、コスト管理・ガードレール・監査ログ・MCP プロキシ・トークン購入まで一元管理する。新たに「Tailscale MCP」「Tailscale SSH MCP」が追加され、AI エージェントがノード追加や SSH 接続、サービスのデプロイを実行可能になった。既存のアクセス制御は維持され、新規ノード追加には人間の承認が必要で、全操作が監査ログに残る。
    元記事を読む (Publickey) ↗
  • Simon Willison's Weblog · EN 開発者ツール
    So you want to use OpenRouter?
    OpenRouter の自動ルーティング、プロバイダ差で応答が変わる問題
    深層学習 人間のフィードバックによる強化学習 (RLHF)
    Simon Willison が、Mohamed Moustafa による OpenRouter 利用上の注意点を紹介。単一エンドポイントで最もコスト効率の良いバックエンドへ自動ルーティングされるが、プロバイダごとに推論ソフトや設定が異なり、同じモデル指定でも挙動が変わる。vision 非対応や reasoning effort の解釈差もあり、provider.only で routing 先を限定できると指摘する。
    元記事を読む (Simon Willison's Weblog) ↗
  • arXiv cs.CL (Computation and Language) · EN 新モデル・リリース
    Expert-Space Exploration in MoE Reinforcement Learning
    Mixture of Experts (MoE) 強化学習
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN マルチモーダル
    Dynin-Robotics: Omnimodal Unified Diffusion Vision-Language-Action Model
    コンピュータビジョン ロボティクス
    元記事を読む (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN 新モデル・リリース
    Generative Retrieval for Unsupervised Text-Based Person Search
    ニューラルネットワーク 検索拡張生成 (RAG) ソフトウェア工学
    元記事を読む (arXiv cs.AI (Artificial Intelligence)) ↗
  • Sakana AI Blog (ja) · JA 新モデル・リリース
    英国王立協会特集号に見る、世界モデルの最前線とAIの未来
    英国王立協会が世界モデル特集号、Sakana AI の David Ha も寄稿
    強化学習 ロボティクス
    英国王立協会の『Philosophical Transactions A』が、世界モデルを主題とする特集号「World Models in Natural and Artificial Intelligence」を公開した。Sakana AI CEO の David Ha が巻頭記事の共著者として参加。大規模モデルの「できること」と「わかっていること」の差は計算資源だけでは埋まらない、自己の内部状態を予測する学習が内部表現を整理する、世界モデルの問いは人工生命へ通じる、の 3 点を軸に論じる。
    元記事を読む (Sakana AI Blog (ja)) ↗
  • arXiv cs.CL (Computation and Language) · EN 推論・効率化
    Parameter-Efficient Retrievers for Polish and European Languages
    埋め込み (Embeddings) ファインチューニング 検索拡張生成 (RAG)
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN 新モデル・リリース
    UniPart: Towards Zero-shot Language-Grounded 3D Part Segmentation for Embodied Interaction
    埋め込み (Embeddings) ファインチューニング 強化学習 Transformer
    元記事を読む (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN 新モデル・リリース
    Behavior Quotient Learning for Low-Rank Adaptation of LLM Agents
    AI エージェント 推論 (Inference) 検索拡張生成 (RAG) 強化学習
    元記事を読む (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN 開発者ツール
    Evaluating Context Segmentation in Locally Deployable SLMs for Cybersecurity CTF Tasks
    AI エージェント
    元記事を読む (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN 学習・ファインチューニング
    Scaling Clinical Judgment to Evaluate Medical AI
    深層学習 ファインチューニング ヘルスケア・バイオ ニューラルネットワーク
    元記事を読む (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN 新モデル・リリース
    RunningTensor: Generalizing Linear Attention to Higher-Order Recurrent States
    ニューラルネットワーク
    元記事を読む (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN 学習・ファインチューニング
    Cognition on Graph: Navigating Massive Knowledge Space via Cognitive Cycles and Bidirectional Graph-Text Synergy
    深層学習 検索拡張生成 (RAG)
    元記事を読む (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.AI (Artificial Intelligence) · EN 新モデル・リリース
    SCQ: Stabilizing Conservative Q-Learning with Sigmoid-Bounded Entropy
    強化学習 ロボティクス
    元記事を読む (arXiv cs.AI (Artificial Intelligence)) ↗
  • arXiv cs.CL (Computation and Language) · EN インフラ・ハードウェア
    Residual Vector-based Reconstruction as Long-Context Recall Regardless of Context Window Size
    深層学習 ファインチューニング ソフトウェア工学
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN 新モデル・リリース
    Doc2FRC: Length-Consistent Document-Level Machine Translation via Fixed-Range Chunking
    深層学習 ファインチューニング 推論 (Inference)
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • arXiv cs.CL (Computation and Language) · EN 新モデル・リリース
    Earth-Agent-Pro: Towards Real-World Full-Chain Earth Observation with Agents
    AI エージェント ファインチューニング GPT ニューラルネットワーク ソフトウェア工学
    元記事を読む (arXiv cs.CL (Computation and Language)) ↗
  • ITmedia AI+ · JA 学習・ファインチューニング
    フィジカルAI向け「データ収集工場」に"潜入" 実機写真で学習データ生成の流れを解説
    J-HRTI、千葉・習志野にフィジカルAI向けデータ収集工場が稼働
    ロボティクス
    業種の異なる民間5社のコンソーシアム「J-HRTI」が、フィジカルAI・ロボット向けの学習データを生成する「関東データファクトリー」を千葉県習志野市で稼働させた。集めたデータは参画企業が共同で利用する。ITmedia が実機写真を基に、収集の現場と学習データ生成の流れを解説している。
    元記事を読む (ITmedia AI+) ↗