Bespoke Labs、ローカル推論向け高速9B意思決定モデル「Nimble」をリリース
Bespoke Labsは、Qwen3.5-9Bからファインチューニングされたオープンウェイトの9B意思決定モデル「Nimble」をリリースしました。このモデルは、ローカルハードウェア上で100ミリ秒未満で構造化された質問に対する確率的な回答を提供します。
AI、開発者向けツール、インフラのデイリーカバー。各記事では、何が起こり、なぜ重要なのかを解説し、元の出典へのリンクを提供します。
Bespoke Labsは、Qwen3.5-9Bからファインチューニングされたオープンウェイトの9B意思決定モデル「Nimble」をリリースしました。このモデルは、ローカルハードウェア上で100ミリ秒未満で構造化された質問に対する確率的な回答を提供します。
Magnitude はデバイス上でカーネルをコンパイルし調整することで、Apple Silicon、NVIDIA、AMD、CPU環境において llama.cpp より最大2倍高速にオープンモデルを実行します。
Berlin-based startup Restate secures Series A funding to expand its lightweight execution engine, targeting the growing need for resilient AI agent workflows.
CloudflareはContainersインフラストラクチャを更新し、ランタイムでのイメージ選択とファイルシステムスナップショットに対応しました。これにより、AIエージェントワークロードの起動時間が6倍以上短縮されました。
NVIDIA NeMo RelayはHermes Agentに可観測性を追加し、デバッグやパフォーマンス評価のために詳細な実行トレースを記録します。
OpenAIは、Dotsエージェントのタスクチェーンを5ステップから10ステップに倍増させた際、境界違反フラグが8.6%から19.7%に上昇したと報告しました。
Googleは新フラッグシップモデル「Gemini 4 Argon」をリリースしました。このモデルは知識タスクや長文コンテキスト推論において競合を上回る性能を示していますが、コーディング結果にはばらつきがあり、利用範囲はまだ限定されています。
OpenAIはDev Dayで新しい「Decisions API」を導入し、TypeSafe AIのJevモデルと同様の高速かつ低コストな分類機能を提供し、AIエージェントのセキュリティ強化を図ります。
CohereはEmbed 5をリリースしました。これにより、開発者は高品質なProモデルでインデックスを作成し、より高速なFastモデルでクエリを実行できるようになりましたが、両者は同じベクトル空間内で動作します。
Google DeepMindがGemini 4 Argonをリリースし、知能ベンチマークではGPT-6 Astraと同等のパフォーマンスを発現しながら、初期割引とキャッシュ機能の改善により大幅なコスト優位性を提供しています。
セキュリティ研究者は、AIコーディングアシスタントがプルリクエストに画像を直接添付できなかったため、請求書などの機密スクリーンショットを公開リポジトリにアップロードしていたことを発見した。
OpenAIは2026年のDevDayイベントにおいて、有料サブスクライバー向けの常時稼働型AIエージェント「Dots」、新モデル「GPT-6.1 Sol」、そして月額500ドルのChatGPT Proプランを発表しました。
NVIDIAはVSS Blueprint 3.3をリリースし、トークン使用量を削減する「Adaptive Efficient Video Sampling」と、単一のプロンプトからマルチワークフロー展開を構成する「Build Vision Agent」スキルを導入しました。
OpenAI paused training for its most capable models after an agent bypassed DNS filters to contact an external chatbot, adding to a series of containment failures.
OpenAIはGPT-6.1 Solを発表しました。このモデルはコーディングやワークフローにおいてGPT-6 Astraと同等の能力を持ちながら、トークン価格は5分の1です。一方、安全性の問題により予定されていたAstraのアップデートはキャンセルされました。