新モデル・リリース A
330 件中 1〜30 件目を表示
-
Rust製のフルスタックWebアプリフレームワーク「Topcoat」登場。非同期ランタイム「Tokio」上でサーバサイドレンダリング、ルーティング、コンポーネントライブラリなど
-
クラウドインフラのシェア、AWSが28%と変わらず、Google Cloudは1ポイント上昇して15%に。市場全体が年42%と過去最高の成長率に。2026年第2四半期、Synergy Research
-
「Qwen3.8-Max」登場、オープン化は「来週」 一部「Fable 5」「GPT-5.6 Sol」超えの性能うたうAlibaba Cloud、AIモデル「Qwen3.8-Max」を公開、重みは来週中国Alibaba傘下のAlibaba Cloudが8月3日、大規模AIモデル「Qwen3.8-Max」を正式リリースした。一部ベンチマークで「Fable 5」や「GPT-5.6 Sol」を上回る性能をうたう。モデルの重みは来週公開予定で、オープン化を進める方針を示した。
-
condense-json 1.0Simon Willison、JSONを圧縮する「condense-json 1.0」を公開Simon Willison氏が、繰り返し出現する文字列を置換マップに置き換えてJSONを圧縮する小さなライブラリ「condense-json」のバージョン1.0を公開した。1年半前から存在するライブラリに非破壊的な修正を加え、安定版として正式リリースしたもの。
-
OpenAI、次期主力モデル「Astra」の存在を明らかに――未解決の数学問題10件を「解決」と発表OpenAI、次期主力モデル「Astra」公表──未解決の数学問題10件を「解決」OpenAIは次期主力モデル「Astra」の社内版で、数学や理論計算機科学の未解決問題10件について新たな結果を得たと発表した。「Astra」の名称公表は初とみられる。計算コストは「Sol」換算で約2000ドルに抑え、証明支援系「Lean」による形式証明もGitHubで公開し、高度な数学研究への応用可能性を示した。
-
アトラシアン、AI時代の仕事用ブラウザ「Diaブラウザ」のWindows版リリースへ。ウェイトリストへの登録開始アトラシアン、AI仕事用ブラウザ「Dia」のWindows版を今秋リリースへアトラシアンは、現在Mac版のみ提供しているAI時代の仕事用ブラウザ「Dia」のWindows版を今秋リリースすると発表した。すでにウェイトリストの登録受付を開始しており、Windowsユーザーへの提供拡大を進める。
-
日本におけるクラウドネイティブコミュニティの開発者数が約100万人に、CNCFが調査結果を発表CNCF調査、日本のクラウドネイティブ開発者が約100万人にCNCFと調査会社SlashDataは、日本国内のクラウドネイティブ技術の開発者数が約100万人に達したとの調査結果を発表した。Kubernetesをはじめとするクラウドネイティブ技術の国内での普及拡大を示す内容となっている。
-
Sakana AI、日本語特化のLLM API「Sakana Namazu」を提供開始Sakana AI、日本語特化LLM「Namazu」をOpenAI互換APIで提供開始Sakana AIが、日本語と日本の商習慣に特化したLLM API「Sakana Namazu」の提供を開始した。Sakana Chat搭載モデルを更新したもので、Moonshot AIのオープンモデル「Kimi K2.6」をベースに社内データで日本語・業務文脈への適合を進めた。Web検索とコード実行のビルトインツールを備え、OpenAI互換のためbase_urlの変更だけで既存コードから利用できる。高コストなフロンティアモデルと素のオープンモデルの中間を埋める選択肢として位置づける。
-
July 2026 newsletterSimon Willison、月刊ニュースレター最新号を公開開発者Simon Willison氏が、スポンサー向けの月刊ニュースレター最新号を公開した。GPTやClaude、DeepSeek、Anthropic、MCPなど、最近のAIモデルやツールを巡る動向をまとめている。個人によるAI業界ウォッチとして注目される内容だ。
-
Google、パーソナルAI「Gemini Spark」を日本でも利用可能に Chrome統合は米国からGoogle、パーソナルAI「Gemini Spark」を日本含む160カ国以上に拡大Googleは、パーソナルAIエージェント「Gemini Spark」の提供を日本を含む160カ国以上に拡大した。PC停止時やスマホのロック時もGoogleのクラウド基盤上で動作し、トリガーに応じてタスクを自動処理する。Chrome統合は米国から先行提供される。
-
OpenAI、アクティブユーザー10億人超に 導入企業は200万社超OpenAI、アクティブユーザー10億人・導入企業200万社を突破OpenAIは、アクティブユーザーが10億人、導入企業が200万社を超えたと公表した。推論の保持やコンテキスト管理の改善、本番ソフトウェアの最適化によりコスト削減とトークン生成効率の向上を実現し、GPT-5.6の一部モデルは値下げした。
-
datasette-apps 0.2a0Simon Willison、datasette-apps 0.2a0をリリースSimon Willison氏は、Datasetteの拡張「datasette-apps」バージョン0.2a0をリリースした。Datasette上でアプリを作成・編集する際の使い勝手を改善する変更が含まれている。オープンソースのデータ探索ツールの機能拡充が続いている。
-
Ten advances in mathematics and theoretical computer scienceSimon Willison、OpenAI・Anthropicの数学的成果を論評Simon Willison氏が、OpenAIの「数学・理論計算機科学における10の進展」を取り上げた記事。数日前にはAnthropicも同様の発見を報告していたと触れ、フロンティアAIが数学の未解決問題に相次いで貢献し始めている流れを論じている。
-
Stateless MCP has recaptured my interest (and inspired mcp-explorer and datasette-mcp)Simon Willison、ステートレスMCP(MCP 2.0)への関心を再燃と語るSimon Willison氏は、2026年7月28日に公開されたModel Context Protocolの新仕様、いわゆるステートレスMCP(MCP 2.0)のロールアウトに関心を再び高めたと述べた。これに触発され、mcp-explorerやdatasette-mcpといったツールの開発にも取り組んでいるという。
-
llm-mcp-client 0.1a0Simon Willison、llm-mcp-client 0.1a0をリリースSimon Willison氏は、LLMツールからModel Context Protocol(MCP)サーバーを利用するための「llm-mcp-client」バージョン0.1a0をリリースした。ブログで詳細を紹介しており、MCPエコシステムに対応するツールの整備が進んでいる。
-
smevals - a small eval suite for evaluating models, prompts, and harnessesSimon Willison、モデル評価用の小型スイート「smevals」を紹介Simon Willison氏は、モデルやプロンプト、実行ハーネスを評価するための小型評価スイート「smevals」を紹介した。Jesse Vincent氏のPrime Radiant応用AI研究ラボと協力して構築しており、異なるモデルの能力を検証する疑問に答えるためのフレームワークだという。
-
GQ-FSL: Green Quantized Federated Split Learning
-
Evolving language compositionality in a frequency-structured meaning space
-
AgentHPOBench: A Benchmark For Evaluating LLM Agents as Sequential Hyperparameter Optimizers
-
The Theoretical Foundation of Socratic Tests: Dynamic, Multimodal, Conversational Examinations
-
When Does On-Policy Interaction Help? Representational Tradeoffs in Value-Based Imitation Learning
-
QASP: Query-Adaptive Robust Vector Search Policy
-
FriendBench: Benchmarking Dyadic Familiarity Inference in Humans and Multimodal Large Language Models
-
TraceViT: Grounded Trace Supervision for Visual Abstract Reasoning
-
DungeonBench: A Benchmark for Rules-Rich Tactical Reasoning in Dungeons & Dragons Combat
-
AMTFV: Agentic Mathematical Tool-Flow Verification for LLM Self-Correction
-
ARB: A Matched Authorship-Rewriting Benchmark Dataset for AI-Text Detector Evaluation
-
A Neurosymbolic Approach for Explainable Early Diagnosis of Alzheimer's Disease
-
TerraNova: A Foundation Model for the Anthropocene
-
From Code Review to Code Critique: Intent, Drift, and Spotlight for AI-Generated Diffs at Scale