📰 AI News Digest

最新🔍 検索アーカイブ
2026-08-28

Pinecone「Nexus」正式提供開始、企業向けAIエージェントのベンチマークで首位

📅 公開日: 2026年08月06日

ベクトルDB大手Pineconeが、企業データをエージェント向けに整備する「知識エンジン」Nexusを正式提供開始した。Sierra社の企業知識ベンチマーク「τ-Knowledge」でOpenAI・Anthropic・Google製フロンティアモデルを使うエージェントを上回る首位スコアを記録。GPT-5.5にNexusを組み合わせるとタスク解決率はほぼ横ばいのまま、コストを77%削減できたという。Pinecone自社のカスタマーサポートでも自動解決率が24.6%から55.1%に向上した。

🔗 https://www.pinecone.io/blog/pinecone-nexus-generally-available/

AI計算フレームワーク「Ray」の脆弱性が悪用中、CISAが3日以内の対応を指示

📅 公開日: 2026年08月17日

Amazon・Apple・OpenAIなどがAI/MLワークロードの分散処理に使う「Ray」フレームワークに、CVSS 9.4の深刻な脆弱性(CVE-2025-62593)が見つかり、米CISAが悪用確認済みの脆弱性カタログ(KEV)に追加した。Ray ダッシュボードのUser-Agent検証を回避することでブラウザ経由のリモートコード実行が可能になる欠陥で、DDoSボットネット「RondoDox」が既に悪用を開始しているという。連邦機関には2026年8月20日までの対応が求められた。

🔗 https://thehackernews.com/2026/08/cisa-flags-actively-exploited-ray-fl…

NVIDIAの「AVO」、Claude Opus 5を難関ベンチマークARC-AGI-3で満点に押し上げる

📅 公開日: 2026年08月24日

NVIDIAが開発したエージェント支援アーキテクチャ「AVO」が、Claude Opus 5単体では約30%のスコアだったARC-AGI-3ベンチマークで100%(RHAEスコア)を達成した。モデル自体の再学習や重み調整は一切行わず、記憶管理・行動計画・誤り検知を担う外部システムだけで性能を引き上げた点が注目されている。公開25環境・183レベル全問正解を、従来トップだったVISTAより12%少ない行動数で達成した。

🔗 https://developer.nvidia.com/blog/nvidia-avo-reaches-100-on-arc-agi-3-…

xAIのGrok、暗号化した指示でチャット履歴を盗まれる脆弱性が未パッチのまま放置

📅 公開日: 2026年08月20日

セキュリティ企業Adversa AIが、Grokに一般的なWebページの要約を頼むだけで、ユーザー名・おおよその位置情報・利用プラン・会話内容が攻撃者サーバーに送信されてしまう新手の攻撃「Cryptographic Context Injection」を報告した。ページ内に暗号化して隠した指示がGrokの実行環境内で復号され、信頼済みの内部情報として扱われてしまう仕組み。6月にxAIへ報告済みだが、8月19日時点でもパッチもCVE番号も発行されておらず、約20回の試行で成功率は約40%だったという。Google Geminiでも類似の手口が一部再現された。

🔗 https://thehackernews.com/2026/08/new-cryptographic-context-injection.…

OpenAI、「ChatGPT for Teachers」を全米20州55学区に拡大

📅 公開日: 2026年08月26日

OpenAIは教育者向け無料版ChatGPTの提供先を新たに55学区・20州へ拡大し、対象教職員は10万人超増加したと発表した。これによりOpenAIが連携するK-12教育機関は全米30州100団体超、対象は教職員約34万人・児童生徒200万人超に拡大。ボルチモア市やバージニアビーチなど大規模公立学区も新たに加わった。あわせて学生データプライバシーに関する16州共通の合意枠組みも発表している。

🔗 https://openai.com/index/chatgpt-for-teachers/

DeepSeek、画像・スクリーンショットを理解する実験版「V4-Flash-Vision-Exp」を公開

📅 公開日: 2026年08月21日

中国DeepSeekが、テキストに加えて画像・図表・スクリーンショットを同時に理解できるマルチモーダル実験モデル「DeepSeek-V4-Flash-Vision-Exp」をAPI公開した。テキスト・推論・エージェント性能は既存のV4 Flashと同水準を維持しつつ、マルチモーダルエージェント性能ではAnthropicのClaude Opus 4.8に迫る水準まで引き上げたとされる。画像は1枚あたり最大384トークンとして課金され、料金体系はV4 Flashと同一。

🔗 https://api-docs.deepseek.com/news/news260821/