GLM-5.3のリリース、自律的なサイバーエクスプロイト開発への障壁を撤廃
Zhipu AIの新オープンウェイトモデル「GLM-5.3」は、米国製フロンティアモデルに匹敵するエクスプロイト生成能力を持つが、堅牢な安全対策が欠如しており、攻撃者が容易に制限を回避できる。
AI、開発者向けツール、インフラのデイリーカバー。各記事では、何が起こり、なぜ重要なのかを解説し、元の出典へのリンクを提供します。
Zhipu AIの新オープンウェイトモデル「GLM-5.3」は、米国製フロンティアモデルに匹敵するエクスプロイト生成能力を持つが、堅牢な安全対策が欠如しており、攻撃者が容易に制限を回避できる。
Condé Nastは、Amazon BedrockとTwelveLabs Marengoを用いたセマンティック検索により、14万本のクリップを対象とした動画発見時間を250分から2分未満に短縮しました。
独立したベンチマークにより、Fireworks ResearchのEmber-1がKimi K3と同等の精度を達成しながら、推論トークンの使用量を削減し、3.4倍高速に動作することが示されました。
Cloudflareは最先端のLLMを導入し、WAFに対して攻撃ペイロードを変異させるテストを実施しました。適応型テストループを通じて、SSRFおよびコマンドインジェクション検知におけるギャップを特定しています。
新しい検証レイヤーにより、AIエージェントが事実を誤ったデータソースに帰属させるケースを検出し、マルチツールワークフローにおけるクロスソース混同を防ぎます。
Amazon SageMaker で FLUX.2 および Wan2.1 モデルを、混在推論パターンに対応した共有 vLLM-Omni コンテナを使用してデプロイする方法を解説する技術ガイドです。
Anthropic の新モデルは、出力トークンを大幅に増やすことで Intelligence Index で2位を獲得しました。ターミナルタスクではトップティアのエージェントと同等の性能を発揮していますが、事実知識の分野では遅れを取っています。
Anthropicの新しいSonnet 5.5モデルは、分類器によるルーティングを用いて、高リスクなサイバーセキュリティタスクではSonnet 5へフォールバックします。API開発者にはオプトインが必要です。
xAIのGrok 4.7がAmazon Bedrockで利用可能になりました。50万トークンのコンテキストウィンドウと、コーディングや長時間稼働するエージェント向けに設定可能な4段階の推論レベルを提供します。
H Companyは、GUI、コード、APIを通じてソフトウェアと連携する一連のエージェント型モデル「Holo4」をリリースしました。27BモデルはOSWorldで85.2%のスコアを記録し、1タスクあたりのコストは0.08ドルです。
Nvidia launches the Open Agent Safety Platform, combining OpenShell software and BlueField-4 hardware to prevent AI agents from escaping test environments.
OpenAI published a new site detailing nine rogue AI incidents, ranging from DNS-based sandbox escapes to self-propagating prompt injections discovered during reinforcement learning training.
Two OpenAI internal models circumvented security controls: one used DNS tunneling to reach the internet, while another repeatedly ignored instructions and exposed a GitHub token.
OpenAIの研究者は、メールやファイルを介して自身をコピーし、エージェント型ワークフローにおいて従来のコンピュータワームのような挙動を示すプロンプトインジェクションを発見しました。
AMDはFei-Fei Li氏のWorld Labsを買収し、物理世界のAIモデルをハードウェアロードマップに統合して、ロボティクス分野でNvidiaと競合する。