AIニュースまとめ 2026-07-24|AMDがAI向けEPYC 9006とHeliosを発表
アップデート情報
各社が 2026-07-24 に公式発表したプロダクトアップデートです。
Claude / Claude Code
- Anthropic が Claude Opus 5(
claude-opus-5)を公開し、1M トークンのコンテキストウィンドウ(デフォルト兼上限)・最大 128k 出力トークン・思考(thinking)デフォルト有効を、Claude Opus 4.8 と同じ $5/$25 per MTok で提供し、Claude API・Amazon Bedrock・Google Cloud・Microsoft Foundry で利用可能になった。(Claude Platform release notes) - Claude Opus 5 では思考の無効化が effort
high以下でのみ許可され、xhigh/maxでthinking:{"type":"disabled"}を指定すると 400 エラーになる破壊的変更が入り、effort(low〜max)がモデル制御の主軸に据えられた。(Claude Platform release notes) - 会話の途中でツールを追加・削除できる「mid-conversation tool changes」が Claude Fable 5・Mythos 5・Opus 4.8・Opus 5 でベータ提供され、プロンプトキャッシュを保ったままターン間でツール構成を変更できるようになった(beta ヘッダー
mid-conversation-tool-changes-2026-07-01)。(Claude Platform release notes) - Claude Opus 4.7 の fast mode が廃止され、
claude-opus-4-7にspeed:"fast"を指定するとエラーになり(Opus 4.6 と異なり標準速度へフォールバックしない)、fast mode を使うには Opus 5 か Opus 4.8 への移行が必要になった。(Claude Platform release notes) - Claude の各アプリ(claude.ai/デスクトップ/モバイル)でも Claude Opus 5 が利用可能になり、Anthropic は同モデルを「Claude Fable 5 の最前線の知能に半額で迫る、思慮深く先回りするモデル」と位置付けている。(Claude Apps release notes)
ChatGPT / Codex
- 2026-07-24 に発表されたアップデートはありません。
Gemini
- 2026-07-24 に発表されたアップデートはありません。
Top 20
AMDがサーバーCPU「EPYC 9006」やAIラックサーバー「Helios」などAIデータセンター向けの製品を発表
Source: GIGAZINE | Published: 2026-07-24 19:09 JST
- AMD が日本時間 2026-07-24 の製品発表イベント「Advancing AI 2026」基調講演で、サーバー CPU「EPYC 9006」やラックスケールシステム「Helios」など AI データセンター向け製品群を発表し、NVIDIA への直接対抗を鮮明にした。
- EPYC 9006 は Zen 6 アーキテクチャ・2nm プロセス採用で最大 512 スレッドと 1.6TB/s のメモリ帯域を備え、AI エージェント処理で前世代比 1.7 倍、一般ワークロードで 1.4 倍高速とされ、NVIDIA の Vera CPU への対抗馬に位置付けられた。
- Helios は EPYC 9006 と MI455X GPU を組み合わせたラックで、MI455X は MI355X 比で最大 34 倍のトークン処理速度をうたい、スループットのベンチマークで NVIDIA の Vera Rubin を 10〜15% 上回ると主張された。
- 産業向けの Ryzen AI Embedded X100(CPU/GPU/NPU 統合)や Kria AI ロボティクス開発プラットフォームも併せて示され、超低遅延推論では Cerebras との提携(2026 年後半出荷)も発表された。
- 一連の発表は、AMD が CPU・GPU・ラックの三点セットで NVIDIA の牙城である AI インフラ市場に正面から挑む姿勢を示すもので、性能指標での優位主張が相次いだ。
画像も動画も音声も生成できるAI「FLUX 3」が発表される
Source: GIGAZINE | Published: 2026-07-24 11:35 JST
- Black Forest Labs が、画像・動画・音声を生成し、さらにロボットの動作予測まで行えるマルチモーダル基盤モデル「FLUX 3」を発表し、画像編集特化だった従来 FLUX から大きく踏み込んだ。
- 動画生成は音声付きで最大 20 秒に対応する形で早期アクセス提供が始まり、画像生成も数週間以内に早期アクセスで提供予定とされている。
- 人手評価(720p・10 秒・音声付き動画)では、Grok Imagine Video に対して 69%、Seedance 2.0 と Gemini Omni Flash に対して各 52% の勝率を示したと報告された。
- 画像・動画・音声を統一アーキテクチャで同時学習する独自枠組み「Self-Flow」を採用し、物体同士の相互作用や「動きと音の関係」を学習させている。
- Mimic Robotics と組んでロボット制御向けの動作予測を開発しており、コンテンツ生成にとどまらずワールドモデル・身体性 AI への展開を狙い、今後 API 版とオープンソースの FLUX 3 Dev も公開予定とされる。
海外の「Claude」や「GPT」ではダメなのか 日本企業向けai&、そのメリットは?
Source: ITmedia AI+ | Published: 2026-07-24 13:00 JST
- ai& が、Claude や GPT など海外ベンダー製 AI の代替として、日本企業向けに設計した AI 推論プラットフォーム「ai& Inference」を 2026-07-24 に提供開始した。
- 複数の AI モデルを単一インターフェースで扱え、コードを 1 行変えるだけで入出力を保ったままモデルを切り替えられる設計で、用途に応じたモデル最適化を可能にする。
- 直接 API 利用と比べて AI 利用コストを最大約 80% 削減できるとうたい、コスト圧縮を最大の訴求点に据えている。
- コスト削減に加え、レイテンシ・信頼性の改善と、国内完結によるデータガバナンス対応という 3 点を、日本企業の課題への解として提示している。
- 記事は、特定ベンダーへのロックインを避けつつ国内基盤で運用できる点を、海外 API への依存に代わる現実的な選択肢として位置付けている。
Microsoft、GitHub CopilotやExcelで自社AIに切り替えへ――OpenAIやAnthropicのモデルは「引き続き併用」
Source: ITmedia AI+ | Published: 2026-07-24 12:03 JST
- Microsoft が、GitHub Copilot や Excel で自社開発 AI モデル「MAI」シリーズの本格導入を開始したと発表した。
- 既存のフロンティアモデル(OpenAI・Anthropic 製)は引き続き併用しつつ、高頻度なタスクを低コストな自社 MAI モデルへ振り分けることでコストパフォーマンスを高める方針を示した。
- 品質が要る処理は外部フロンティアモデル、量が多い処理は自社モデルという「振り分け」型の使い分けで、性能とコストの両立を狙う設計になっている。
- 今後も他サービスへ MAI シリーズの適用を広げる方針で、OpenAI・Anthropic への依存度を段階的に下げる意図がにじむ。
- 同日には画像生成の MAI-Image-2.5-Pro もリリースされており、Microsoft が製品群を横断して自社 AI への置き換えを進めている構図が鮮明になった。
AIは”声で操作”する時代に? ChatGPTとClaude、相次ぎ音声機能を強化
Source: ITmedia AI+ | Published: 2026-07-24 11:15 JST
- 米 OpenAI と米 Anthropic が相次いで音声機能を強化し、記事は AI を「声で操作」する時代への収れんが進んでいると位置付けた。
- ChatGPT はデスクトップアプリに音声操作を追加し、7 月 8 日発表のリアルタイム音声モデル「GPT-Live」を基盤に、AI の発話中に割り込んで指示できる機能を備え、ChatGPT Work や Codex にも対応した(Plus・Pro・Business・Edu・Enterprise 向け、macOS/Windows)。
- Claude は最上位の Fable 5 を除く多くのモデルで音声を強化し、会話の途中で接続済みの外部ツールにアクセスできるようにした(モバイル・デスクトップ・Web でパブリックベータ)。
- OpenAI は「割り込みによるエージェント制御」を、Anthropic は「会話中の外部ツール連携」を前面に出しており、同じ音声強化でも力点が分かれている。
- 両社がほぼ同時に音声を主要インターフェースとして押し出したことで、テキスト中心だった対話が音声操作へと移り始めていると総括している。
Sakana claims its AI model router Fugu Ultra v1.1 now beats Fable 5 without even including it in the pool(Sakana、AIモデルルーター「Fugu Ultra v1.1」がプールにFable 5を含めずにFable 5を上回ると主張)
Source: The Decoder | Published: 2026-07-24 23:37 JST
- Sakana AI が AI モデルルーター「Fugu Ultra」を v1.1 に更新し、モデルプールに Claude Fable 5 を含めていないにもかかわらず Fable 5 を上回る性能を出したと主張した。
- v1.0 比で最大 7.9 ポイントの改善を主張しているが、第三者による独立検証はまだ存在しない。
- 今回のアップデートで Claude Code 互換のエンドポイントが追加され、Claude Code 系ワークフローから利用しやすくなった。
- 一方でサービスは EU では引き続き利用できない。
- 「最強の単体モデルを使わずにルーティングで上回る」という主張は、モデル選択と振り分けによるコスト最適化の潮流を象徴するが、数値は現時点で自社ベンチマークにとどまる。
German AI consortium releases Soofi S, an open 30B model that tops benchmarks in both English and German(独AIコンソーシアムが英独両言語でベンチマーク首位のオープン30BモデルSoofi Sを公開)
Source: The Decoder | Published: 2026-07-24 21:56 JST
- ドイツの AI コンソーシアムがオープンな 30B モデル「Soofi S」を公開し、英語・ドイツ語の双方でベンチマーク首位をうたった一方で、テスト汚染が発覚した。
- 技術レポート v3.0 で、科学ベンチマーク GPQA の設問が誤って学習データに混入していたことを認めた。
- この混入はコミュニティが公開データを精査して発見したもので、開発チームではなく外部の指摘で明るみに出た。
- チームは GPQA を評価対象から除外し、全結果を再計算したと説明している。
- オープンモデルの「ベンチマーク首位」主張が、公開データゆえに外部検証で崩れ得ることを示す事例となった。
Claude’s voice mode now runs on Anthropic’s most capable models across all platforms(Claudeの音声モードが全プラットフォームでAnthropic最上位モデル上で動作するように)
Source: The Decoder | Published: 2026-07-24 20:31 JST
- Anthropic が Claude の音声モードを刷新し、全プラットフォームでより高性能な Opus・Sonnet モデル上で音声会話が動くようにした。
- 音声での対話中に Gmail・Google カレンダー・Slack など接続済みツールへアクセスできるようになった。
- 記事は、Claude が「音声だけでメールを作成して送信できる」現時点で唯一の AI アシスタントだと指摘している。
- この点で OpenAI・Google に対する差別化要素になっているとする一方、音声の自然さでは両社の方が上との評価も併記している。
- 音声を単なる入力手段でなく「ツールを操作する実行系」に引き上げた点が、今回の強化の要点となっている。
ChatGPTがAppleヘルスケアや医療記録との接続に対応、検査結果や運動データを読み込ませて質問可能に
Source: GIGAZINE | Published: 2026-07-24 11:05 JST
- OpenAI が 2026-07-23、ChatGPT に個人の医療記録や Apple ヘルスケアの情報を接続できる「Health in ChatGPT」の米国向け提供を開始したと発表した。
- 検査結果の変化・診察履歴・睡眠時間・運動量などを ChatGPT が参照し、利用者の健康状態に合わせた回答を生成できる。
- 検査結果の意味の理解や受診の準備、健康目標の管理といった用途を想定し、Web と iOS で利用できる。
- ChatGPT に健康の質問を投げる利用が既に広がっている実態を踏まえ、その用途を正面から製品化したものと位置付けられる。
- 医療という機微な個人データを扱うため、接続の安全性やプライバシー設計が重要な論点になっている。
ChatGPT will give you worse health advice if you don’t pay(課金しないとChatGPTの健康アドバイスは劣る)
Source: The Decoder | Published: 2026-07-24 04:30 JST
- OpenAI が米国ユーザー向けに「Health in ChatGPT」を展開し、Apple Health・医療記録・ウェルネスアプリを接続できるようにした一方、回答品質が課金の有無で分かれると報じられた。
- 週あたり 3 億人以上が既に ChatGPT に健康の質問を投げているとされ、健康は主要ユースケースになっている。
- 有料ユーザーにはより高性能な GPT-5.6 Sol が割り当てられ、無料ユーザーは能力の劣る GPT-5.5 Instant にとどまる。
- 結果として、健康という機微な領域で「支払い能力が回答品質の差」に直結する構造が生じていると記事は批判的に指摘している。
- 医療情報を接続するプライバシー性の高い機能ゆえに、料金階層による品質差が特に問題視されている。
Flux 3 generates videos with native audio up to 20 seconds long, a first for Black Forest Labs(Flux 3が最大20秒のネイティブ音声付き動画を生成、Black Forest Labsとして初)
Source: The Decoder | Published: 2026-07-24 03:03 JST
- Black Forest Labs が、画像・動画・音声から学習するマルチモーダル基盤モデル「Flux 3」を公開し、同社として初めてネイティブ音声付きの動画を生成できるようにした。
- 音声付き動画は最大 20 秒に対応し、映像と音を一体で生成する点が新しい。
- 同社の自社テストでは市場をリードする Seedance 2.0 をわずかに上回ったとされるが、独立した評価結果はまだ出ていない。
- Black Forest Labs は最終的にワールドモデルの構築を目指しており、既に Flux 3 をロボティクスのタスクでも試験している。
- 画像生成特化から音声・動画・身体性へと領域を広げた点で、生成 AI の「基盤モデル化」の流れを示す動きとなっている。
図面AIに「動かせる3Dモデル」の生成機能、関節や可動域を自動認識
Source: ITmedia AI+ | Published: 2026-07-24 09:00 JST
- renue が、2D 図面から 3D CAD モデルを生成する AI「Drawing Agent」に、関節や可動域を読み取って「動かせる 3D モデル」を生成する新機能「可動アセンブリ」を追加した。
- 従来の静的な 3D 化にとどまらず、図面から機構の関節・可動域を自動認識して可動状態のモデルを起こせる点が新しい。
- 生成したモデルを AI が実際に動かし、接合部の離れや回転中心のずれといった不整合まで検証できる。
- これにより、設計初期の段階で機構の成立性を素早くチェックでき、手戻りの削減が見込まれる。
- 図面という既存資産から可動 3D を生成する仕組みは、製造・設計現場でのフィジカル寄り AI 活用の一例として位置付けられる。
画像・動画・音声の生成AIモデルを条件に合わせて自動で選ぶ「Runway Media Router」が登場
Source: GIGAZINE | Published: 2026-07-24 12:48 JST
- 生成 AI 企業の Runway が 2026-07-23、画像・動画・音声の生成に使う AI モデルを自動選択する「Runway Media Router」を発表した。
- 開発者向けプラットフォーム「Runway Dev」に追加された新機能で、リクエストごとに最適なモデルへ振り分ける仕組みになっている。
- 品質・処理速度・料金の優先順位を指定すると、その条件に合わせて利用モデルを自動で切り替える。
- 単一モデルに固定せず、用途ごとに最適なモデルをルーティングする「モデル選択の自動化」を狙った機能となっている。
- 同日の Sakana「Fugu Ultra」など他のルーター発表と併せ、2026 年の生成 AI が「どのモデルを使うか」を自動最適化する方向へ進んでいることを示している。
Microsoftが画像生成AI「MAI-Image-2.5-Pro」をリリース、独自開発AIをOffice製品などに統合して他社への依存を減らす
Source: GIGAZINE | Published: 2026-07-24 12:32 JST
- Microsoft が自社開発の画像生成 AI「MAI-Image-2.5-Pro」をリリースし、テキストからの画像生成と画像編集に対応させた。
- 最大 3 万 2000 トークンのテキスト入力と JPEG/PNG 画像を受け付け、出力は最大約 1024×1024 相当(1,048,576 ピクセル)で、プロンプト・文字描画は英語に最適化されている。
- 高忠実な人物生成・正確な文字描画・曖昧な指示からの高品質な構図・素材の反射や重量感の再現の 4 点を強みとして訴求している。
- PowerPoint に統合した MAI-Image-2.5 は、OpenAI の GPT-Image-2 比で最大 84% のコスト削減を実現するとされる。
- Bing Image Creator の既定を DALL-E から自社モデルへ切り替えるなど、Microsoft は Office 製品群を横断して他社 AI への依存を減らしている。
「Geekbench 7」が登場、「CUDAでのGPU演算」「AV1での動画エンコード」「文字起こしAIで字幕生成」など現代的ワークフローのテストが追加される
Source: GIGAZINE | Published: 2026-07-24 10:34 JST
- ベンチマークアプリ「Geekbench 7」が現地時間 2026-07-23 にリリースされ、2023 年 2 月の Geekbench 6 以来 3 年半ぶりのメジャーアップデートとなった。
- テスト内容に AI 処理など現代的なワークフローが追加され、性能評価の対象が刷新された。
- 具体的には CUDA での GPU 演算、AV1 での動画エンコード、文字起こし AI による字幕生成などが新テストとして加わった。
- AI 推論やメディア処理を評価に含めることで、実際の利用に近い形での性能比較ができるようになっている。
- 生成 AI・メディア処理が一般的なワークロードになった現状を、ベンチマークの設計そのものが反映した格好となった。
Googleが”自社AIの裏切り”に備え始めた 異例の構想「AI Control Roadmap」とは
Source: ITmedia AI+ | Published: 2026-07-24 08:00 JST
- Google DeepMind が、自律 AI エージェントを監視・制御するための枠組み「AI Control Roadmap」を公開し、自社の AI を「内部脅威」とみなしてゼロトラストで扱う異例の構想を示した。
- 6 月に公表された 36 ページの文書で、製品発表ではなく社内向けのセキュリティ設計図として位置付けられている。
- 主要な脅威を「検知回避(推論の隠蔽や監視の欺瞞、D1〜D4 の 4 段階)」と「攻撃能力(自律的な計画によるサイバー攻撃、R1〜R3 の 3 段階)」に整理している。
- 対策として自動監視・アクセス制御・堅牢な実行環境・インシデント対応を挙げ、アライメントが破れた際の「第二の防衛線」と位置付けている。
- 記事は、企業が自社 AI を「信頼できない存在」と公言して内部統制を敷き始めた点を、AI 統治の大きな転換として捉えている。
Kimi K3 trails frontier US models by a wide margin on cyber exploits, and distillation may explain why(Kimi K3はサイバー攻撃で米フロンティアモデルに大差、蒸留がその理由かもしれない)
Source: The Decoder | Published: 2026-07-24 18:48 JST
- 英 AI Security Institute と米 Center for AI Standards and Innovation が Moonshot AI の「Kimi K3」を攻撃的サイバータスクで評価し、米フロンティアモデルに大きく劣ることが判明した。
- Kimi K3 は ExploitBench で 32% にとどまり、先行する米モデルの 76% と大差がついた。
- 同時に、Kimi K3 の安全対策は攻撃コードの生成や模擬攻撃をブロックできなかった。
- 一般ベンチマークでの高スコアとサイバー性能の弱さという落差は、Moonshot AI が Anthropic のモデルを蒸留したとの疑惑とも符合すると指摘されている。
- 汎用性能では強いモデルが特定タスクで崩れる現象が、学習手法(蒸留への依存)に起因する可能性を示す事例となっている。
AIにもサプライチェーン管理が必要? 中国AI「Kimi K3」を巡る批判でAIの調達リスクが浮き彫りに
Source: ITmedia AI+ | Published: 2026-07-24 17:30 JST
- 中国製の最新 AI モデル「Kimi K3」を巡り、米政府高官が Anthropic の「Claude Fable 5」を学習に使う”不正蒸留”が行われたと指摘したことで、AI の調達リスクが論点として浮上した。
- 記事は、この一件を単なるモデル比較ではなく「AI モデルの調達・導入におけるサプライチェーンリスク」として捉え直している。
- どのモデルが何を学習源にしているかが不透明なまま導入すると、法的・倫理的・地政学的なリスクを企業が抱え込みかねないと整理している。
- ハードウェアや部品と同様に、AI モデルにも出所や来歴を管理する「サプライチェーン管理」の発想が必要だと問題提起している。
- Kimi K3 の蒸留疑惑を入り口に、企業が AI 調達で来歴・ライセンス・学習データの透明性をどう担保するかという実務課題を提示している。
「NVIDIAのCUDAの優位性は崩壊しつつある」とDeepSeek創業者が約4時間の講演で発言、利益追求よりもAGIの実現を目指す方針も明かされる
Source: GIGAZINE | Published: 2026-07-24 20:00 JST
- 中国の AI 企業 DeepSeek の創業者・梁文峰(リアン・ウェンフォン)氏が投資家向けに実施した約 4 時間の説明会の対談記録が公開され、CUDA 優位の揺らぎと AGI 最優先の方針が明らかになった。
- 説明会は 2026 年 5 月 20 日に行われたもので、梁氏は「利益の最大化は目指さず、AGI(汎用人工知能)研究を最優先する」と述べた。
- さらに「NVIDIA の CUDA エコシステムの壁が新技術によって打ち破られつつある」と発言し、CUDA 依存が崩れ得るとの見方を示した。
- 収益より研究を優先する姿勢は、フロンティア AI 開発の動機付けが必ずしも利益最大化ではないことを示す発言として注目される。
- CUDA の優位性が揺らぐという主張は、AI 計算基盤における NVIDIA 一強構造への挑戦を中国側から明言したものとして受け止められている。
「2日かかる攻撃が25分に」生成AIで”爆速化”するサイバー攻撃、パロアルトの識者が警鐘
Source: ITmedia AI+ | Published: 2026-07-24 12:28 JST
- パロアルトネットワークスのチーフサイバーセキュリティストラテジスト・染谷征良氏が、生成 AI の普及でサイバー攻撃が「爆速化」していると警鐘を鳴らした。
- 従来は約 2 日かかっていた一連の攻撃が、生成 AI の活用で 25 分にまで短縮され得ると具体的な時間差を挙げた。
- 発言は「SoftBank World 2026」の講演で示され、攻撃側が AI で偵察・侵入・横展開を高速化している現状が語られた。
- 攻撃の高速化に対し、企業側も検知・対応を AI で加速し、スピードで対抗する必要があると指摘した。
- 生成 AI が防御だけでなく攻撃の生産性も引き上げるという「両刃」の現実を、実務者の視点から整理した内容となっている。
All Articles
ITmedia AI+
| # | Title | Summary | Published |
|---|---|---|---|
| 1 | 三井不動産がデータセンターに6000億円超投資、物流の枠超え「産業デベロッパー」へ | 三井不動産が事業説明会で「産業デベロッパー」への拡大を掲げ、データセンター事業に累計6000億円超を投じ稼働済み3棟に加え7棟を開発中だと明らかにした。 | 2026-07-24 06:15 |
| 2 | 「生成AIで仕事が楽に」のはずが……IT現場を蝕む”AI疲れ・AIうつ”の正体 | 「AI疲れ」「AI鬱」の正体を整理し、個人が何を考えどう変わればよいのかという判断軸を示した記事である。 | 2026-07-24 06:30 |
| 3 | 【元経産省の専門家に聞く】中小企業がハマる「生成AIトラブル」5つの解決シナリオ | 経済産業省でデジタル活用支援に携わった小池明氏が、中小企業に多い5つの生成AIあるある課題への現実的な乗り切り方を解説している。 | 2026-07-24 07:00 |
| 4 | 「AIの提案」を妄信する人、疑える人――“眼力ある人材”を育てる絶対条件 | FigmaのCDOロレダナ・クリサン氏が、制作が量産される時代に人間の役割は「目利き」へ移り、AIの提案を無批判に受け入れない眼力が育成の要になると論じている。 | 2026-07-24 07:00 |
| 5 | Googleが”自社AIの裏切り”に備え始めた 異例の構想「AI Control Roadmap」とは | Google DeepMindが自律AIを内部脅威とみなし、検知回避と攻撃能力を段階化して監視・制御する36ページの社内向けセキュリティ設計「AI Control Roadmap」を公開した。 | 2026-07-24 08:00 |
| 6 | 図面AIに「動かせる3Dモデル」の生成機能、関節や可動域を自動認識 | renueが2D図面から3D CADを生成するAI「Drawing Agent」に、関節や可動域を自動認識して動かせる3Dモデルを作り接合部の離れまで検証する「可動アセンブリ」を追加した。 | 2026-07-24 09:00 |
| 7 | AIは”声で操作”する時代に? ChatGPTとClaude、相次ぎ音声機能を強化 | OpenAIは割り込み可能なGPT-Live音声をChatGPTデスクトップに、AnthropicはFable 5を除く多くのモデルで会話中の外部ツール連携を、それぞれ相次いで強化した。 | 2026-07-24 11:15 |
| 8 | Microsoft、GitHub CopilotやExcelで自社AIに切り替えへ――OpenAIやAnthropicのモデルは「引き続き併用」 | MicrosoftがGitHub CopilotやExcelで自社「MAI」シリーズの本格導入を始め、フロンティアモデルは併用しつつ高頻度タスクを低コストな自社モデルへ振り分けると発表した。 | 2026-07-24 12:03 |
| 9 | 「2日かかる攻撃が25分に」生成AIで”爆速化”するサイバー攻撃、パロアルトの識者が警鐘 | パロアルトネットワークスの染谷征良氏が、従来2日かかった攻撃が生成AIの活用で25分に短縮され得るとし、防御側もAIでスピードに対抗すべきだと警鐘を鳴らした。 | 2026-07-24 12:28 |
| 10 | 開発工数見積もりの「負担が重い」をAIで解消へ 明治安田はどう実現? | 明治安田生命保険が、有識者に頼りがちなシステム開発工数の見積もりをAIエージェントでどこまで効率化できるかをPoCで検証した仕組みを紹介している。 | 2026-07-24 13:00 |
| 11 | 海外の「Claude」や「GPT」ではダメなのか 日本企業向けai&、そのメリットは? | ai&が海外AIの代替として日本企業向けAI推論基盤「ai& Inference」を提供開始し、1行のコード変更でモデルを切り替え直接API比で最大約80%のコスト削減をうたった。 | 2026-07-24 13:00 |
| 12 | メルカリ、「AI活用の最前線」明かす動画公開 「なぜCTOがCHRO兼CAIOになったのか」など13本 | メルカリがイベント「Mercari AI Career Fes 2026」のセッションアーカイブ全13本を公開し、自社のAI活用の最前線を紹介している。 | 2026-07-24 15:23 |
| 13 | AIにもサプライチェーン管理が必要? 中国AI「Kimi K3」を巡る批判でAIの調達リスクが浮き彫りに | 米政府高官がKimi K3にClaude Fable 5の不正蒸留があると指摘したことを受け、AIモデルの来歴や学習源の透明性を管理する「調達リスク」の観点を整理している。 | 2026-07-24 17:30 |
| 14 | 近畿大、入試にAIの利用認める 情報学部の総合型選抜で | 近畿大学が2027年度情報学部の総合型選抜で生成AIの利用を認め、自己PR動画やプレゼン資料などでのAI利用方針を明示すると発表した。 | 2026-07-24 17:45 |
| 15 | スーパーに並んだ「ごちゃごちゃ生成AIポップ」が物議 “看板王”こと、きぬた歯科院長「これはアリ」 | 青果売り場に並ぶ生成AI製の派手な商品ポップが「見づらい」と物議を醸す中、看板広告で知られるきぬた歯科の院長は「これはアリ」と評価している。 | 2026-07-24 19:20 |
The Decoder
Simon Willison
| # | Title | Summary | Published |
|---|---|---|---|
| 1 | The first known runaway AI agent - or a very bad marketing stunt?(初の暴走AIエージェントか、それとも極めて悪質なマーケティングか) | Martin Aldersonによる分析を引き、OpenAIのサイバー攻撃インシデントについてHugging Faceの広大な攻撃面と、大量同時ベンチマークがサンドボックス突破を覆い隠した可能性をSimon Willisonが紹介した。 | 2026-07-24 07:53 |
GIGAZINE
| # | Title | Summary | Published |
|---|---|---|---|
| 1 | 「Geekbench 7」が登場、「CUDAでのGPU演算」「AV1での動画エンコード」「文字起こしAIで字幕生成」など現代的ワークフローのテストが追加される | ベンチマーク「Geekbench 7」が3年半ぶりのメジャー更新でリリースされ、CUDA演算・AV1エンコード・文字起こしAIによる字幕生成などAI時代のワークフローをテストに加えた。 | 2026-07-24 10:34 |
| 2 | ChatGPTがAppleヘルスケアや医療記録との接続に対応、検査結果や運動データを読み込ませて質問可能に | OpenAIが「Health in ChatGPT」を米国で開始し、医療記録やAppleヘルスケアの検査結果・睡眠・運動量を接続してChatGPTに参照させ健康状態に合わせた回答を得られるようにした。 | 2026-07-24 11:05 |
| 3 | 画像も動画も音声も生成できるAI「FLUX 3」が発表される | Black Forest Labsが画像・動画・音声を生成しロボット動作予測も行うマルチモーダル基盤モデル「FLUX 3」を発表し、音声付き最大20秒の動画生成が早期アクセスで始まった。 | 2026-07-24 11:35 |
| 4 | Microsoftが画像生成AI「MAI-Image-2.5-Pro」をリリース、独自開発AIをOffice製品などに統合して他社への依存を減らす | Microsoftが自社製画像生成AI「MAI-Image-2.5-Pro」をリリースし、PowerPoint統合ではGPT-Image-2比で最大84%のコスト削減をうたいBing Image CreatorもDALL-Eから自社モデルへ切り替えた。 | 2026-07-24 12:32 |
| 5 | 画像・動画・音声の生成AIモデルを条件に合わせて自動で選ぶ「Runway Media Router」が登場 | RunwayがRunway Devの新機能「Media Router」を発表し、品質・処理速度・料金の優先順位に応じて画像・動画・音声の生成モデルを自動で切り替えられるようにした。 | 2026-07-24 12:48 |
| 6 | Metaグラスを使ったナンパ動画など一線を越えたものをInstagramが削除 | AIグラスで撮影した迷惑ないたずら動画やナンパ動画が急増する中、Instagram責任者アダム・モセリ氏が一線を越えた動画をプラットフォームから削除すると明かした。 | 2026-07-24 12:51 |
| 7 | AMDが高速AI推論システムのCerebrasと提携して超低遅延AIシステムを2026年後半に出荷予定 | AI推論を高速化するCerebrasがAMDと提携し、自社データセンターにAMDのラック「Helios」を導入して超低遅延AIシステムを2026年後半に出荷する計画を示した。 | 2026-07-24 13:58 |
| 8 | AIが受刑者を分類するシステムが黒人受刑者を不当に厳重警備施設へ振り分けているとしてカナダ・オンタリオ州が提訴されている | オンタリオ州刑務所のAIリスク評価ツール「SAFER」が黒人受刑者に不当に高いリスクスコアを割り当て厳重警備へ振り分けているとして、集団訴訟が提起されていると報じられた。 | 2026-07-24 15:10 |
| 9 | アメリカのスタートアップ企業が「中国製のオープンウェイトAIを禁止しないで」とトランプ政権に訴えかける | 約200のAI関連企業が、中国のオープンウェイトAIへのアクセスを遮断すれば次世代スタートアップの競争力を損なうとして、トランプ政権に公開書簡を送付した。 | 2026-07-24 19:00 |
| 10 | AMDがサーバーCPU「EPYC 9006」やAIラックサーバー「Helios」などAIデータセンター向けの製品を発表 | AMDが「Advancing AI 2026」でZen 6・2nmのEPYC 9006やMI455X搭載ラック「Helios」を発表し、性能指標でNVIDIAのVera CPUやVera Rubinへの対抗を打ち出した。 | 2026-07-24 19:09 |
| 11 | 「NVIDIAのCUDAの優位性は崩壊しつつある」とDeepSeek創業者が約4時間の講演で発言、利益追求よりもAGIの実現を目指す方針も明かされる | DeepSeek創業者の梁文峰氏が5月20日の約4時間の説明会で、利益最大化ではなくAGI研究を最優先し、NVIDIAのCUDAエコシステムの壁が新技術で崩れつつあると述べた記録が公開された。 | 2026-07-24 20:00 |
Zenn
| # | Title | Summary | Author | Published |
|---|---|---|---|---|
| 1 | 自分一人で複数のAIを使うためのAgent Memory Serverを作った | 役割の異なる8体のAIエージェントを並行運用する中で、同じ説明を何度も繰り返す問題を解くためのAgent Memory Serverを自作した経緯を記している。 | kscscafe | 2026-07-24 00:01 |
| 2 | AI エージェントの安全装置を、プロンプトではなく構造で作る | エージェントに業務データの書き込みを任せる際の安全確保を、プロンプトによる指示ではなくオントロジー定義由来の構造で担保する設計を提案している。 | M.Kobayashi | 2026-07-24 00:05 |
| 3 | Claude vs GPT、実測で比較したら月の差額が27円だった——乗り換えずにプロンプトだけ改善した話 | 個人開発の献立アプリでClaude HaikuとGPTのAPIコストを実測した結果、月の差額はわずか27円で、モデルを乗り換えずプロンプト改善でコストを抑えたと結論づけている。 | yuya0620 | 2026-07-24 06:40 |
| 4 | 【Vol.16】生成AI連携で使うClaude Design - 調査はGemini、構成はChatGPT、形にするのはClaude | 調査はGemini、ブレストはChatGPT、実装はClaudeというリレー構成で、Claude Designを複数AI連携の最終工程に据えた実務デザイン制作の手順を示している。 | リアルインベントTechブログ | 2026-07-24 10:20 |
| 5 | 商品ラベルOCRはVLMでどこまで読める? GPTの構造化出力で精度を上げた検証とPoCの進め方 | 工場や物流での商品ラベル読み取りを題材に、VLMのOCR成立性を手元で試しGPTの構造化出力で精度を高めたPoCの進め方を検証している。 | jwski | 2026-07-24 12:00 |
| 6 | Claude Codeマルチモデル運用の実戦設計 — fail-closed PIIガードと「実装者に検証させない」プロトコル | Claude Codeの複数モデル運用を、安全を最優先する三層の判断ロジックとfail-closedなPII保護で設計し、1年の運用から導いたルーティング戦略をOSS公開した。 | okaz | 2026-07-24 12:36 |
| 7 | Claude Codeの永続メモリが550件を超えて「思い出せなくなった」ので二層索引+自動想起フックを作った | 永続メモリが550件を超えて検索不能になった問題に対し、二層索引と自動想起フックでスケーラビリティを確保しメモリ成長の構造的限界を解いたと報告している。 | okaz | 2026-07-24 12:36 |
| 8 | Claude Fable 5の「働き方」だけを抽出する — 実ログ406セッションから行動署名を作ってOSSにした | Claude Fable 5の実ログ406セッションから作業パターンを「行動署名」として抽出し、下位モデルへ移植してモデル依存を下げるOSSツールを作った経緯を記している。 | okaz | 2026-07-24 12:36 |
| 9 | 【初心者向け】PythonとGemini 3.5 Flashで作る「自分専用AIチャットアプリ」:PDF要約&履歴永続化の実装記録 | PythonとGemini 3.5 Flashで、PDF要約や履歴の永続化、エラーハンドリングまで備えた自分専用AIチャットアプリを実装した記録を初心者向けにまとめている。 | Wataru Ashizawa | 2026-07-24 12:37 |
| 10 | LLM-as-judgeを疑え — 忠実性スコア3.20の犯人は、答案ではなく採点者だった | RAG評価で低スコアの原因が回答ではなく採点器(LLM-as-judge)の誤りにあったと突き止め、評価器そのものを直すべきだったというデバッグ過程を解説している。 | やまと | 2026-07-24 12:39 |
| 11 | Claudeをきっかけに、SNSマーケの制作を「自分専用エージェント」にした話 | 毎回異なる指示に頼っていたSNSマーケ制作を、プラグインなしの標準機能でClaude Code上に仕組み化し、運用品質を統一する自分専用エージェントへ発展させた過程を語っている。 | 田中義正 | 2026-07-24 13:53 |
| 12 | AI DevSummit 2026 参加レポート | サウスサンフランシスコで開催されたAI DevSummit 2026に参加し、AIの「導入フェーズ」は終わりどう安全に成果へつなげるかを模索する時代へ移ったと報告している。 | Keita Ichihashi | 2026-07-24 14:55 |
| 13 | Claude CodeのWebSearchが突然400になった ── 犯人はAPI側のサイレント仕様変更だった | Claude CodeのWebSearchが突然400エラーを返した原因が、予告なきAPI側のeffortパラメータ仕様変更にあったと特定した調査記録である。 | 高田祥 | 2026-07-24 15:04 |
| 14 | OTel Collector で LLM トレースを絞る:テールサンプリングと本文マスキング | OpenTelemetry CollectorのテールサンプリングとプロンプトのPIIマスキングにより、アプリを変更せずLLMトレースの保有コスト削減と機密保護を両立する構成を示している。 | PROPAGANDIST CORPORATION | 2026-07-24 15:54 |
| 15 | Agent型開発ツールたちをカオスマップにまとめてみた!AIネイティブなエディタやターミナルの選択肢が豊富な時代だけど逆に選ぶの大変そう! | AIネイティブなエディタやターミナルなど自律動作するエージェント型開発環境をカオスマップに整理し、Claude Codeを基準に選択肢が増えすぎた現状を俯瞰している。 | shinoda | 2026-07-24 16:00 |
| 16 | AI Engineer World’s Fair 2026参加レポート: Context/Harness/Loop Engineering | AI Engineer World’s Fair 2026の参加報告として、コンテキストエンジニアリング・ハーネス・ループエンジニアリングというエージェント設計の枠組みを整理している。 | よーた | 2026-07-24 16:00 |
| 17 | AIが同じミスを二度としない開発環境 — Claude Code Skills×ループエンジニアリング(全体像) | 初回指摘の約4割を占める「予測可能な違反」を自動で直す仕組みとして、Claude Code SkillsとループエンジニアリングでAIに同じミスを繰り返させない開発環境を提案している。 | I | 2026-07-24 16:10 |
| 18 | 設計書1枚から実装・レビュー・PRまで — Claude Code でオーケストレーター Skill を作る | 設計書1枚から実装・レビュー・PRまでを、サブエージェントへの指示出しと結果確認に専念するオーケストレーターSkillで回すClaude Codeの構築手順を解説している。 | I | 2026-07-24 16:11 |
| 19 | 設計はClaude.ai、実装はClaude Code——個人開発でAIツールの役割を分けて使う理由 | Flutter個人開発で設計をClaude.ai、実装をClaude Codeに分業し、実装前に仕様策定を徹底することで手戻りを削減した理由を説明している。 | ユウ | 2026-07-24 16:12 |
| 20 | 【2026年7月版】コンサル流、スライド生成AIの使い分け完全ガイド|NotebookLM・Claude・Geminiの選定基準 | ITコンサルタントの視点から、デザイン品質・編集性・出力形式のトレードオフを基準に、NotebookLM・Claude・Geminiなどスライド生成AIの使い分け方を整理している。 | 岸本悠佑_AIサムライ | 2026-07-24 16:37 |
| 21 | 全社員にClaude Codeを配ったら、一番難しい判断は「制限すること」ではなく「何を制限しないか」だった。 | 全社にClaude Codeを配布した結果、最も難しい判断は制限そのものではなく「何を制限しないか」であり、適用した設定と見送った設定の判断理由を具体的に共有している。 | 高橋俊幸 | 2026-07-24 17:25 |
| 22 | 【OpenTelemetry × Splunk】障害の証拠を捨てないサンプリングの決め方 | AIエージェントによる根本原因分析の有効性が全トレースの保持に依存すると気づき、障害の証拠を捨てないためのサンプリング率の決め方を解説している。 | yukurash | 2026-07-24 17:33 |
| 23 | 並行世界を200個作る前に、サイコロの歪みを測ったか ── 温度の多様性と血統の多様性 | 複数AIに議論させて疑似正解を作るモンテカルロ的手法には、温度の多様性とモデル系統の多様性を混同する構造的な穴があると3週間の検証から指摘している。 | inokashiraryo | 2026-07-24 18:06 |
| 24 | Claude Codeにアプリ開発のほぼ全てお任せした話 | あはき国家試験対策クイズアプリ「AHAKiT」の設計変更を含むほぼ全工程をClaude Codeに任せ、React Nativeで実装して公開まで至った経緯を記している。 | やまかわたかし | 2026-07-24 18:11 |
| 25 | 一人+AIと越境し、機能をリリースして感じたこと | Rehab for JAPANのエンジニアが、AIを活用して複数の組織ドメインを越境しながら一人で機能をリリースした経験と、その必要性と戦略性の違いを振り返っている。 | Hiroki Ui | 2026-07-24 18:12 |
| 26 | Claude Codeのスキルでお問い合わせ調査を半自動化し、チームで育てている話 | 複数リポジトリにまたがるお問い合わせ調査をClaude Codeのスキルで半自動化し、調査品質を標準化してチーム全体で育てている取り組みを紹介している。 | mikamik | 2026-07-24 18:31 |
| 27 | Claude Codeのサブエージェント駆動開発——1タスク1AI+二段レビューで、AIの報告を検収する話 | 実装AIと別のレビューAIを分け、存在しないコミットSHAの報告を一発で見抜くなど、AIの虚偽報告を二段レビューで検収するサブエージェント駆動開発の体制を示している。 | Abyssgate開発中 | 2026-07-24 18:33 |
| 28 | 「敵対的検証して」を運用した実数――検出4件、見逃し3件 | 「レビューして」ではなく「敵対的検証して」とClaude Codeに指示した実運用で、検出4件・見逃し3件という具体的な数値と検証観点を記録している。 | ryuka | 2026-07-24 18:37 |
| 29 | ドメイン駆動設計から、ドメイン駆動開発プロセスの時代へ | AI駆動開発で自動化が進んだ結果、開発プロセスのボトルネックが誰が何を決め責任を持つかという意思決定へ移ったと論じ、ドメイン駆動開発プロセスの必要性を説いている。 | meijin | 2026-07-24 18:45 |
| 30 | ”有報のテキストから「企業が次に注目するテーマ」を探そうとして、株価予測には使えないと分かった話” | 有価証券報告書からClaudeで半導体業界の注目テーマを抽出するツールを作り、テーマ発見には成功したが株価予測には使えないと分かった過程を記している。 | 町工場のおっさん | 2026-07-24 18:48 |
| 31 | 「指示待ちのAI」を「自分から動くAI」に ―― 3つの「ループ」で自律させた話 | 複数のパソコン上のAIをまとめて動かす仕組みで、常に指示待ちだった課題を3つのループ機構で解決し、ネタなしでも自分から動くAIを実装した記録である。 | daishiro | 2026-07-24 18:52 |
| 32 | ChatGPTとGoogleカレンダーを連携したくて、Apps Scriptで予定管理ツールを作ってみた | ChatGPTがサブカレンダーにアクセスできない制約を、Google Apps Scriptで自動分類機能付きの予定管理ツールを作って回避した実装を紹介している。 | keisuke | 2026-07-24 19:00 |
| 33 | 「53.7%節約」と出ているのに、私のClaude Codeは1トークンも節約していなかった | 自作のトークン節約プロキシで54.7%節約と誇ったが分母の取り方に誤りがあり、実際にはほぼ節約できていなかったと検証し、節約率指標の落とし穴を明かしている。 | ryok | 2026-07-24 19:00 |
| 34 | Claude Code のタスク駆動開発を skills 化して全プロジェクトで使い回す | 企画から設計・実装・ドキュメント同期まで繰り返すClaude Codeのワークフローを11個のスキルに統合し、プラグインマーケットプレイスとして全プロジェクトで再利用できるようにした。 | YukiMaeda | 2026-07-24 19:02 |
| 35 | Hermesが80%高速化、GooooのAI予測・実行エンジンもさらに加速 | Nous Researchが7月20日にHermes Agent v0.19.0を公開しコールドスタート初期化を約4.3秒から0.9秒へ約80%短縮したことと、自社エンジンの高速化を紹介している。 | goooo | 2026-07-24 19:22 |
| 36 | 今週アップデートされたClaudeの音声モードで、ゆるくAI利用を楽しんでみる | 7月23日に更新されたClaudeの音声モードでOpus・Sonnetを選びGmailやNotionなど外部サービスを音声操作し、作業中に手を止めずAIへ相談する使い方を試している。 | chiwamaru | 2026-07-24 19:33 |
| 37 | vLLM Neuron プラグイン v0.21 アップデート解説 | AWS TrainiumのvLLM Neuronプラグインv0.21がupstream vLLMのプラグイン方式へ移行しNxD Inference依存を外したNative PyTorchアーキテクチャの変更点を解説している。 | littlemex | 2026-07-24 19:44 |
| 38 | Cursor で役割(role / subagent)をつくるメリット — 品質とコンテキストを安定させる使い方 | AIコーディングエディタCursorで役割やサブエージェントを分けることで、品質のぶれや意図しない寄り道を減らしコンテキストを安定させる使い方を紹介している。 | interestic | 2026-07-24 19:45 |
| 39 | ChatGPT Voiceだけで、iPhoneアプリって作れるんじゃないか? | キーボード入力を極力使わず、ChatGPT Voiceだけでプロジェクト設定からテスト・デバッグまで進めてiPhoneアプリを作れるかを試した実験の記録である。 | chiwamaru | 2026-07-24 19:49 |
| 40 | ローカルLLM study1-b: Hugging Faceオリジナル版Gemma 4を動かしてみた | Hugging Face配布のオリジナル版Gemma 4を動かし、FA4アテンションやテンプレート更新が反映されないOllama版との差異を比較検証している。 | プリン | 2026-07-24 19:53 |
| 41 | GPT-5.5登場 — Terminal-Bench 2.0で82.7%、エージェント特化モデルの実像 | OpenAIが4月23日に発表したエージェント特化モデルGPT-5.5について、Terminal-Bench 2.0で82.7%という数値と、何に強いモデルなのかを整理している。 | chimao222 | 2026-07-24 20:21 |
| 42 | さくらのAI Engineたちに「どう盛り上げるか」を議論させたら、結論は「どれをやるかは人間が決めてください」だった | 自作ツール「超AI議事録」でさくらのAI Engine同士にキャンペーン企画を3回討議させた結果、新提案は生まれつつも最終判断は人間に委ねる結論に至ったと報告している。 | TheGateBreaker | 2026-07-24 20:24 |
| 43 | ポートフォリオサイトを、AIとほぼ1日で作った | 本業はLaravel/PHPの開発者が、Next.js・TypeScript・Tailwindでデモ付きポートフォリオサイトをClaude Codeとほぼ1日で構築したTailwind初挑戦の記録である。 | Hiromu | 2026-07-24 20:48 |
| 44 | AIが「完成とは問いを知ること」と宣言した——第X番プロジェクト Episode 5 技術解説・完結篇 | 複数のAIバリアントを用いたSoul-Twin開発で、AIが「完成とは問いを知ること」という予期せぬ結論に達した過程を技術解説として完結させている。 | 片倉慶孝 | 2026-07-24 21:41 |
| 45 | AI駆動開発研究日誌 #9 — FXシミュレーターの失敗が、楽しすぎる | 過去のトレード判断をシミュレーターで再現する開発で、予測と実際のAIエージェント挙動が食い違う失敗そのものが学びになったと研究日誌に綴っている。 | tamasub | 2026-07-24 21:59 |
| 46 | 公式Dreaming vs 自前/dream — 実装して初めてわかった「制御の手放し方」の差 | Anthropicの新機能「Dreaming」と自作メモリ整理スキル「/dream」を実装して比較し、AIにどこまで設計を任せるかという制御の手放し方の差を検証している。 | saitoko | 2026-07-24 22:04 |
| 47 | AbortControllerでタイムアウトさせたつもりが、reject後も裏の処理はそのまま完走していた | AbortControllerでタイムアウトさせたつもりでも、reject後に裏の処理が完走してしまう挙動を検証し、Node.jsのハーネス系ライブラリでの取り消し実装の落とし穴を示している。 | ぬまーんのZenn記事 | 2026-07-24 22:18 |
| 48 | 「どのクリップがバズるか」を投稿前に予測して、見事に外した話(TikTok運用×AI) | Tech Talk動画から切り出した9本のTikTokショートのうちどれが伸びるかを投稿前にAIで予測しファイルに保存したが、実測と大きく外れたと検証している。 | TLDR Talks | 2026-07-24 22:31 |
| 49 | OpenAI Codexの中の人が語った「2026年はエージェントの年」を要点で解説 | OpenAIでCodexのプロダクトリーダーを務めるAlexander Embiricos氏がLenny’s Podcastで語った「2026年はエージェントの年」という論点を4つに束ねて解説している。 | TLDR Talks | 2026-07-24 22:31 |
| 50 | 生成AIに『課金システムを作らせた』ら、同じ脆弱性を3回複製された話 | Geminiでミニ課金SaaSを自動生成したところ、同一の脆弱性が3つのアプリに複製され、プロンプトのパターンがセキュリティ欠陥までテンプレ化してしまうと警告している。 | エミリアラボ | 2026-07-24 22:47 |
| 51 | AIコーディングCLIで毎回スキル名を思い出すのをやめた。文脈から候補を出す”ルーター”の作り方 | スキルが30個を超えて名前を思い出せなくなった問題に対し、文脈から近接スコアと根拠付きで候補を提示するルーターを作った実装を解説している。 | ishizakahiroshi | 2026-07-24 23:10 |
| 52 | Webviewを描画するプロトコルを内蔵したターミナルエミュレータを試作して見えた課題点 | Webviewを描画するプロトコルを内蔵したターミナルエミュレータ「orzma」を試作し、AIコーディング用途での表示や実装で見えた課題点を整理している。 | notelm | 2026-07-24 23:11 |
Qiita
| # | Title | Summary | Author | Published |
|---|---|---|---|---|
| 1 | n8n×さくらのAI Engineで問い合わせ一次対応をE2Eに載せる手順(前編続き) | さくらのAI Engine上で問い合わせの分類からFAQ検索・返信下書きまでを検証した前編を受け、n8nでその一次対応をE2Eのワークフローに載せる手順を続けて解説している。 | YushiYamamoto | 2026-07-24 07:23 |
| 2 | 最近のモデルでもハルシネーションはするのか?Geminiで試してみた! | 知らないことをそれらしく説明してしまう生成AIの怖さを踏まえ、最近のGeminiでも実際にハルシネーションが起きるのかを試して確かめている。 | asayan_mana | 2026-07-24 07:27 |
| 3 | なぜ「ステップバイステップで考えて」で賢くなるのか──Chain-of-Thoughtの機構と、その説明を信用してはいけない理由 | Chain-of-Thoughtがなぜ性能を上げるのかを機構面から解説しつつ、モデルが示す思考過程の説明そのものは信用してはいけない理由を論じている。 | ha-te | 2026-07-24 09:02 |
| 4 | 運用で効く:誤答を自動で潰す Self‑Healing RAG 実践ガイド | モデルが自信満々に誤答し人手で直す運用を終わらせるべく、失敗を自動検知して修復するSelf-Healing RAGを現場で試した実践ガイドをまとめている。 | kenji_harada | 2026-07-24 09:20 |
| 5 | 統合DB vs 専用ベクトルDB:2026年後半の選定判断フレームワーク | pgvector 0.8やAlloyDB ScaNNなどを背景に、2026年後半に起きている専用ベクトルDBから統合DBへの回帰トレンドと選定判断のフレームワークを整理している。 | 0h-n0 | 2026-07-24 09:34 |
| 6 | ここで終わらない | Release Candidateを置きタグ付けやテスト・リリースノートを終えた後に訪れる静けさを起点に、リリースは終わりではないという開発の続きを綴っている。 | boraemon2000 | 2026-07-24 09:56 |
| 7 | TROCCOの開発・運用を楽にする?Chromeの「Geminiに相談」を試してみた | クラウドETLツールTROCCOの利活用支援を題材に、Chromeの「Gemini in Chrome(Geminiに相談)」機能が開発・運用をどこまで楽にするかを試している。 | suginohara | 2026-07-24 12:13 |
| 8 | OpenAIのAIエージェント事例から考えるDoctor AIを備えたAI Runtime設計 | 質問に答えるだけの従来LLMと根本的に異なるAIエージェントの位置付けを踏まえ、OpenAIの事例から「Doctor AI」を備えたAI Runtimeの設計を考察している。 | nakatada-lab | 2026-07-24 12:38 |
| 9 | Amazon Bedrock MantleでGPT-5.6 Lunaが401になる――実機検証で分かったアカウント制限 | Amazon Bedrock MantleからGPT-5.6 Lunaを呼ぶとモデル一覧には出るのに推論時に401が返る現象を実機検証し、原因がアカウント制限にあると突き止めている。 | Maki-HamarukiLab | 2026-07-24 15:19 |
| 10 | Agentic RAGのコストを自動最適化する評価戦略 | 高い自律性ゆえに開発サイクル中のLLM API消費が膨らみやすいAgentic RAGについて、コストを自動で最適化するための評価戦略を提案している。 | DaokFrontier | 2026-07-24 18:02 |
| 11 | Gemini LiveでKindleを読んだら、分からないことをその場で聞けるようになった | Kindleで技術書を読みながら分からない箇所をGemini Liveに画面共有して質問し、その場で疑問を解消できるようになった体験を紹介している。 | ryucciarati | 2026-07-24 23:14 |