Tech News Daily

2026-10-07 (Wed)
AI が毎朝届けるテックニュースダイジェスト
📰 22 articles 🏷 6 categories 📡 15 sources
1T/49B Mistral Large 4の総/活性化パラメータ数
70% FDE製AIエージェントが2028年までに放棄される予測
2,865万 2025年にGitHub公開リポジトリで見つかったAPIキー件数
🔥 Top Stories
⚡ Dev & Engineering
Microsoftは、Visual Studio Code 1.140で複数のAIモデルを組み合わせ低コストで高品質な回答を導く研究プレビュー「HydraFusion」を公開した。単一モデルで解く「Single」、効率モデルの提案を検証モデルが評価し必要なら高性能モデルへ引き上げる「Cascade」、一方が草稿を作り他方が独立レビューして元モデルが一度だけ修正する「Critique」の3パターンを、推論・コード生成・デバッグ・ツール利用の信号から自動選択する。
  • 「Single」「Cascade」「Critique」の3ワークフローを推論・コード生成・デバッグ・ツール利用の信号から自動選択
  • GitHub Copilot Auto(1リクエスト1モデル選択)と異なり、解決プロセス内で複数モデルを組み合わせる設計
Publickey ⏱ 3 min read 2026-10-06
Team Mirai代表の安野貴博氏は、中国Z.aiが8月に公開したオープンモデル「GLM-5.3」が、Anthropicの危険能力基準「Mythos」級に近いサイバー攻撃能力を持つと評価されたと指摘した。安野氏は4月の国会答弁で「Mythos級モデルが数カ月以内に拡散する」と予測しており、「実際に発言が実現してしまった形」と述べ、情報漏洩が相次ぐ中で対応の緊急性を訴えている。
  • 中国Z.aiが8月公開したオープンモデル「GLM-5.3」がAnthropicのMythos級に近いサイバー攻撃能力と評価
  • 安野氏は4月の国会答弁で「数カ月以内にMythos級モデルが拡散する」と予測、今回それが現実化したと指摘
ITmedia 🔖 133 ⏱ 3 min read 2026-10-06
あるチームはGitHub Actionsのキャッシュ容量を10GBから50GBに引き上げた数日後に約46GiBへ達し、低頻度アクセスの脆弱性DBキャッシュが「最終アクセスが古い順」の削除ポリシーで消される事態に陥った。原因は実行IDをキーにしたGradleビルドキャッシュ(1GiB級×30件、計約24GiB)と、クローズ済みPR・削除済みブランチのキャッシュ(約16GiB)の放置だった。対策として、テスト後に同ブランチの古いキャッシュを削除するジョブと、PRクローズ・ブランチ削除をトリガーに即時削除する別ワークフローを追加した。
  • 実行IDをキーにしたGradleビルドキャッシュ30件・計約24GiBと、クローズ済みPR/削除済みブランチのキャッシュ約16GiBが主因
  • テスト後に同ブランチの古いキャッシュを削除するジョブと、PRクローズ/ブランチ削除トリガーの即時削除ワークフローで11ブランチ分を統合
Zenn ⏱ 4 min read 2026-10-06
LayerXは複数プロダクトで1,000ページ超のWikiをLLMで運用する計画において、仕様が設計書・ヘルプ記事・コードの3箇所に分散し相互に矛盾する問題に直面した。対策として、ユーザーが尋ねそうな質問を基準に更新が必要な変更だけをLLMに処理させるフィルタリング、各ページが参照元のコンテンツハッシュを記録し元情報が変わると自動的に「要更新」フラグを立ててリンティングでpushをブロックする仕組み、エージェントの回答を一時ステージング領域に書かせてから日次レビューで反映する運用の3段構成を導入した。
  • 各Wikiページが参照元コンテンツのハッシュを記録し、元情報の変更を検知すると自動的に「要更新」フラグが立ちリンティングでpushをブロック
  • エージェントの回答は一時ステージング領域に書き込み、日次レビューで検証後に反映する運用で誤りや根拠の弱い記述を事前に排除
LayerX Tech Blog 🔖 17 ⏱ 4 min read 2026-10-06
検証者はClaude Code 2.1.289のWebFetchツールが取得文書を10万字で無言のまま切り捨てることを、自社の93万527字のCHANGELOGファイルを使って確認した。8.6万字(対照)・12.5万字・30.1万字の位置にある用語を3回ずつ独立環境で質問したところ、10万字を超える全6問に「記載なし」という誤答が返り、切り捨てを示す通知は一切なかった。後継の2.1.290では文字数と続きを読むためのoffset指定が表示されるようになり正答率は改善したが、長文を正しく読むコストは約6倍($0.051→$0.314)、処理時間は約4倍(7.7秒→29.2秒)に増えた。
  • 10万字を超える全6問に「記載なし」と誤答、切り捨てを示す通知は一切なし(2.1.289)
  • 修正版2.1.290は文字数表示とoffset指定で正答率改善、ただし長文読解のコストは約6倍($0.051→$0.314)・処理時間は約4倍に増加
Qiita ⏱ 4 min read 2026-10-06
🇯🇵 日本語テックコミュニティ
著者はAIエージェントの記憶を変化の速さで3層に分け、手順を記す「Skills(手続き記憶)」、ルールや構造を記す「AGENTS.md(意味記憶)」、現在の作業状態を記す「handoff.md(エピソード記憶)」に整理した。手続き型のSkillsは20回の試行全てで呼び出されたが、知識型のSkillsは呼び出されるかどうかが安定しなかった。handoffノートがない場合、ClaudeとIBM Bobはセッションを跨いで作業を正しく再開できなかったが、「次セッションでの対応範囲」欄を追加すると整合率が10回中0回から9回に改善した。
  • 手続き型Skillsは20/20回全てで呼び出されたが、知識型Skillsは呼び出しが不安定
  • handoffノートに「次セッションでの対応範囲」欄を追加すると、ClaudeとIBM Bobの作業継続の整合率が10回中0回→9回に改善
Zenn ⏱ 5 min read 2026-10-06
マイクロサービス間でユーザーの代理呼び出しを行う際、`x-user-id`ヘッダーだけでは改ざん可能な自己申告に過ぎない。この記事はCognitoが発行するIDトークン(本人確認書類)、STSが発行するJWT委任トークン(委任状)、フロントエンドの実行ロールによるSigV4署名(代理人の身分証)という3種の証明を組み合わせる設計を示す。`AssumeRoleWithWebIdentity`でSourceIdentityにユーザー名を埋め込み、ロールチェーンで権限を絞った後、`GetWebIdentityToken`でバックエンド向けスコープ付きJWTを取得してSigV4署名とともに呼び出す。
  • Cognito IDトークン・STS JWT委任トークン・SigV4署名の3種を組み合わせ、`x-user-id`の自己申告を排除
  • 3回のSTSラウンドトリップ(AssumeRoleWithWebIdentity約15ms・ロール引き受け約55ms・GetWebIdentityToken約42ms)で中央値約110msのレイテンシ増加
Zenn ⏱ 5 min read 2026-10-05
著者はOracle AI Database Private Agent Factory(PAF)バージョン26.7で作成した知識検索・問い合わせ対応エージェントを、Python製Slack Bot(Slack Bolt 1.30.0、Socket Mode)経由で呼び出せるようにした。PAFの新しいIntegration APIはBearerトークン認証を採用し、従来必要だったセッションクッキーの扱いを不要にした。ユーザーがbotにメンションするとbotがPAFへ問い合わせ、120秒のタイムアウトで応答を同じスレッドに投稿する。
  • PAFの新Integration APIはBearerトークン認証を採用、従来必要だったセッションクッキー管理が不要になった
  • Slack Bolt 1.30.0のSocket Modeで永続WebSocket接続を維持、PAF応答のタイムアウトは120秒
Qiita ⏱ 4 min read 2026-10-06
2026年9〜10月にタイムズカー(約660万件)やヤキニクキング(約1,079万件)など大規模漏洩が相次ぎ「漏洩ラッシュ」と言われたが、警察庁のランサムウェア報告は2026年上半期123件で過去最多ながら前年比わずか7件増、2022年以降94〜123件の範囲で推移しており頻度自体は安定していると著者は指摘する。個人情報保護委員会への報告件数も2024年19,056件→2025年17,139件(1件の大規模事案を除くと約5%増)で、報告件数と実際の事案数は一致しない。AIが原因とする報道を支持する根拠は見当たらないとしている。
  • 警察庁のランサムウェア報告は2026年上半期123件で過去最多も前年比7件増に留まり、2022年以降94〜123件台で安定
  • 上場企業の漏洩件数は2025年180件(前年189件からやや減)だが流出した個人数は約159万人→約306万人とほぼ倍増、100万件超の大規模事案は6件
Zenn 🔖 24 ⏱ 4 min read 2026-10-06
🛠 Code & Tools
「OpenTPU」は、ハードウェア設計・命令セットアーキテクチャ・シミュレータ・コンパイラ・プロファイラまでを単一リポジトリに収めた、AIエージェントが自ら設計した完全オープンソースのAIアクセラレータ。Kintex-7 FPGA PCIeカード上でQwen3・LFM2.5・Qwen3.5など実在のLLMを動作させ、LFM2.5-230Mは4bit量子化のデコードで85.8トークン/秒を記録し、シミュレータとの出力は全構成でビット単位で一致する。1命令1サイクルを発行するシーケンサがDMA・シストリック行列演算ユニット・ベクタ演算ユニット・量子化器を駆動する単純化設計で、プロファイラ「Lens」はルーフラインチャートや命令単位の実行効率を可視化する。
  • Kintex-7 FPGA上でLFM2.5-230Mが4bit量子化デコードで85.8トークン/秒、シミュレータとビット単位で一致する精度を確認
  • ハードウェア設計からコンパイラ・プロファイラまでAIエージェントが自律設計、Apache 2.0ライセンスで公開、GitHub 206スター
GitHub ▲ 210 ⏱ 3 min read 2026-10-06
Polars 2.0は、`collect()`のデフォルト実行をストリーミングエンジンに切り替え、メモリ使用率が約80%に達すると自動的にディスクへスピルするアウトオブコア処理を実現した。SQLを一級の機能として扱い、ジョイン順序の最適化やブルームフィルタを使った動的述語などオプティマイザを強化。TPC-H/TPC-DSベンチマークではDuckDB(1.5.6・2.0 alpha)やDataFusion 54.0.0と比較し16vCPU環境のほぼ全クエリで最速を記録、192vCPUまでスケールすると3.8倍の高速化を確認した。
  • `collect()`のストリーミングエンジンがデフォルト化、メモリ使用率約80%で自動的にディスクへスピル
  • TPC-H/TPC-DSベンチマークで16vCPUのほぼ全クエリが最速、192vCPUまでのスケールで3.8倍高速化
Polars ⏱ 3 min read 2026-10-06