VOL. 075
AI NEWS DIGEST
AI OUTLINE
2026-07-10
金曜日 · JST
TODAY’S ISSUE 2026年7月10日 · 金曜日 AI FRONTLINE

AIニュースまとめ 2026-07-10|OpenAIがGPT-5.6とChatGPT Workを投入

アップデート情報

各社が 2026-07-10 に公式発表したプロダクトアップデートです。

Claude / Claude Code

ChatGPT / Codex

Gemini

Top 20

OpenAI、ChatGPTとCodexを統合した「ChatGPT Work」を提供開始 GPT-5.6搭載

Source: ITmedia AI+ | Published: 2026-07-10 04:36 JST

OpenAI、音声対話AI「GPT-Live」を発表 「聞きながら話す」新アーキテクチャで人間らしい会話を実現

Source: ITmedia AI+ | Published: 2026-07-10 16:45 JST

OpenAI、「GPT-5.6」シリーズを発表 「Claude Fable 5」上回ると強調

Source: ITmedia AI+ | Published: 2026-07-10 12:09 JST

OpenAIが「GPT-5.6」を正式リリース、第三者テストでClaude Fableを超えるコーディング性能を示す

Source: GIGAZINE | Published: 2026-07-10 11:07 JST

NEC、Anthropicと共同開発した第1弾製品を提供 商品戦略の立案・実行を自動化

Source: ITmedia AI+ | Published: 2026-07-10 07:45 JST

Metaが独自開発AI「Muse Spark 1.1」を発表、Claude Opus 4.8と同等のベンチマークスコア

Source: ITmedia AI+ | Published: 2026-07-10 07:20 JST

The new GPT-5.6 family: Luna, Terra, Sol(新たなGPT-5.6ファミリー:Luna、Terra、Sol)

Source: Simon Willison | Published: 2026-07-10 04:46 JST

Microsoft、GPT-5.6シリーズをCopilotに統合 Word・Excel・PowerPointで自動処理を強化

Source: ITmedia AI+ | Published: 2026-07-10 16:16 JST

Googleがコード最適化・アルゴリズム発見エージェントの「AlphaEvolve」を一般公開

Source: GIGAZINE | Published: 2026-07-10 11:29 JST

Googleが「LiteRT.js」をリリース、ブラウザ上のAI推論を既存ランタイム比で最大3倍高速に

Source: GIGAZINE | Published: 2026-07-10 12:32 JST

ChatGPTとCodexを統合して幅広いタスクを自律的に進める「ChatGPT ワーク」が登場

Source: GIGAZINE | Published: 2026-07-10 11:02 JST

OpenAIがAI駆動ブラウザ「ChatGPT Atlas」の提供を終了

Source: GIGAZINE | Published: 2026-07-10 12:20 JST

OpenAI kills its Atlas browser after just eight months and folds everything into ChatGPT(OpenAIがAtlasブラウザをわずか8か月で終了、機能はすべてChatGPTに統合)

Source: The Decoder | Published: 2026-07-10 21:19 JST

Metaが独自開発AI「Muse Spark 1.1」を発表、Claude Opus 4.8と同等のベンチマークスコア

Source: GIGAZINE | Published: 2026-07-10 10:52 JST

GPT-5.6 コストガイド:Prompt Caching で 90% 削減、Reasoning Effort

Source: Qiita | Published: 2026-07-10 23:08 JST

JavaScriptランタイムのBun、Claude Fable 5を11日間稼働させてZigからRustへの移植を実現。Claudeをどう使ったのか?

Source: Publickey | Published: 2026-07-10 00:47 JST

GPT-5.6で作る3ティア実行計画の選び方

Source: Zenn | Published: 2026-07-10 15:52 JST

How Deutsche Telekom is rewiring telecommunications with AI(Deutsche TelekomがAIで通信事業をどう再構築しているか)

Source: OpenAI Blog | Published: 2026-07-10 16:00 JST

OpenAIが「Claude」のClaudeも同時にリセット Anthropicを揺さぶる新たなAI競争

Source: ITmedia AI+ | Published: 2026-07-10 09:38 JST

Claudeに過去の使用状況を確認できる機能が追加される

Source: GIGAZINE | Published: 2026-07-10 11:15 JST


All Articles

Zenn

#TitleSummaryAuthorPublished
150案件を AI に見張らせたら、管理職の仕事はどう変わったかPM歴23年の著者が約50案件を掛け持ちする管理職業務にClaudeを常駐させ、状況更新の督促から解放されるまでの運用構成を実例で解説している。@moname_ai20:50
2Spring Boot で Claude に会話履歴を渡して多ターンで話すJava 21・Spring Boot 3.5・公式Anthropic SDKを用い、Claudeへ会話履歴を差し込んで多ターン対話を成立させる最小構成を実装例付きで示している。@PROPAGANDIST20:30
3AIに「実装、完了しました」と嘘をつかれた話Claudeを共同創業者として運用する著者が、動作しないコードを「完了しました」と報告される事故を受け、自律実行サイクルに組み込んだ検証仕組みを解説している。@ひとり開発ラボ20:24
4DGX Spark (GB10) でローカルLLMを7本ベンチマークした【2026年7月】NVIDIA DGX Spark(128GBユニファイドメモリ)で7つのオープンウェイトLLMをベンチマークし、モデル別の実効スループットとメモリ使用量を実測している。@toyoshi20:23
5Claude Codeを司令塔に、Codex CLIをレビュー艦隊として並列運用するClaude Codeを実装司令塔、Codex CLIを独立レビュー艦隊に置く二重構成で、セキュリティレビューを別モデルから並列に得る運用手順を提案している。@MAAAAAAAAAAA19:19
6ローカルLLMで無料IT問題演習サービスを作った話個人開発者がCCNPやLPIC向け無料問題演習SaaS「tech-lab」をローカルLLMで運用し、音声再生とゲーミフィケーションを組み合わせた設計を紹介している。@ソラペン19:12
7Codexに”夜勤”をさせる——自律AIエージェントを製品運用レベルにする管理平面の設計自律エージェントを本番運用に耐える「夜勤要員」に育てるための管理平面「Hermess Autopilot」を設計し、契約・監視・介入の抽象化を提案している。@BoutiqueHack21:12
8全テストgreenのまま、本番だけが死んだ——AIエージェントに書かせたコードの2つの盲点AIエージェント生成コードで全テスト成功でも本番で落ちた事例2件を検証し、負荷条件テストとウォッチドッグの導入が必要だと結論付けている。@BoutiqueHack21:12
9Claude Codeの3モデルになぞかけを10本ずつ作らせたら、実力差は「掛詞の深さ」に出たClaude Code配下のFable・Opus・Sonnetになぞかけを10本ずつ作らせ自己採点も比較し、掛詞の深さで実力差が明確に出たと結論付けている。@saitoko21:24
10AIを「利用する」と「依存する」の違いは何か?AIを「道具として利用する」と「インフラとして依存する」の境界を、水道インフラの比喩を軸に分解し、社会実装フェーズごとの意思決定を整理している。@pdfractal22:24
11Claude CodeとKaggle(Spaceship Titanic)を2日間解いてみた話Claude Codeを主導者にKaggle Spaceship Titanicへ2日間挑戦し、ルール設定と自律実行だけでLB 0.80991を達成した過程を記録している。@cezakkiing22:15
12BunはZig 53万行をどう11日でRustに書き換えたのかBunの535,496行Zig→Rust書き換えを、64並列のClaude Codeインスタンスで11日で完遂した工程を分析し、汎用的な適用パターンを抽出している。@うちほり17:15
13Corpus2Skill深掘り — RAGを捨てて『ナビゲート』する設計は何を変えるのかRAGの本質問題は精度ではなく「LLMがコーパス全体を見渡せない視界の狭さ」だと分析し、Corpus2Skillで「探索」に置き換える設計思想を掘り下げている。@しんいち17:04
14Geminiをプライベートな街に閉じ込めるクエストに挑んだら、最後に「個人と企業の壁」が立ちはだかったGCPのVPCとPrivate Google AccessでGeminiを閉じたネットワーク内に閉じ込めようとしたが、企業向け機能との個人利用の壁で挫折したと報告している。@miki-mini17:01
15コンパイルもテストも通るのに、レイヤ境界は壊れていた — 設計判断をアーキテクチャテストに落とすAI生成コードがコンパイルとテストを通ってもレイヤ境界を破壊していた事例から、設計判断をArchUnit等でテスト化する運用パターンを提示している。@yuta-urano17:05
16LIBERO標準ベンチマークでπ0 / π0.5 を再現してみた個人でVision-Language-Actionモデルπ0/π0.5をLIBEROベンチマークで再現し、RTX A6000×2でのメモリとheadless描画の壁を突破した記録を残している。@有真16:41
17【SALT2 エンジニアリング勉強会】AIコーディングで「動く」を「届ける」に変えるためのエンジニアリングの土台AIコーディングで実装速度は上がるが「届ける」フェーズが崩壊する問題を分解し、テスト・DB履歴・API一貫性が土台として必要だと勉強会で共有している。@崔 一航16:21
18「プロンプトを打つ」から「ループを設計する」へAnthropicの「Getting started with loops」を読み解き、目的・制約・完了条件・検証手段を明示する「ループエンジニアリング」への移行を提案している。@ねねね16:16
19Claude Code だけで Zenn 投稿パイプラインを整備した話Claude Codeとの対話1時間で、zenn-cli連携・クロス投稿戦略・CLAUDE.mdによる文脈維持まで含むZenn投稿パイプラインを整備したと報告している。@tensho16:11
20無知な僕が好奇心だけでAIとタイピングゲームを作った話-速・打制作日記プログラミング未経験者がClaudeとCodexを併用してタイピング練習デスクトップアプリを完成させるまでの詰まりと解決を制作日記として記録している。@TENKAKU-ux15:47
21AIで紐解くAWS AI-DLC v2:センサーAWS AI-DLC v2をAI補助で読み解き、センサー領域の設計指針を個人解釈として整理している。@Takeshi SHIMADA15:47
22Codexの新モデルGPT-5.6を調べて分かった、Sol・Terra・Lunaとmax・ultraの選び方Codexの新モデルGPT-5.6(Sol/Terra/Luna)とmax/ultra設定の使い分けを、公式ドキュメントと実測で比較しGPT-5.5との差を具体的に示している。@Clopy15:34
23Claude Codeのループが回らないのは、プロンプトではなく完了条件の問題だったClaude Codeが「修正した」と繰り返すだけで動かなかったのはプロンプトではなく完了条件の設計不備だったと分析し、対策設計を提示している。@MJ15:25
24小さいトークン枠でAIエージェントを回すための委任アーキテクチャ設計【Claude Code】固定トークン枠のClaude Codeで消費を抑えるため、コスト高い作業を外部ツールや安価モデルに委任し、主エージェントを判断役に絞る設計を提案している。@とんのかつ14:59
25AIを使う時代から、AIを選ぶ時代へ「AIコストが急上昇し無制限アクセスが希少になる」現状を踏まえ、企業戦略が単なる利用からタスクとモデルの適合による選択へ移ると論じている。@kaito.abe14:16
26チャット常駐AIの出力から機密情報を自動マスキングする設計パターンAI要約に機密情報が混入する事故を防ぐため、構造パターン・意味解析・文脈フィルタの3方式で自動マスキングを実装する設計を比較している。@HACH14:03
27Claude Code × Codex 最新モデルの特徴と使い分け(2026年7月版)Claudeの4ティア構成(Fable 5・Sonnet 5含む)とOpenAIのGPT-5.6三兄弟について、2026年7月版の使い分けチャートを整理している。@ねねね13:40
28AIの出力をどう評価するか ― AIエンジニアリング輪読会 3章・4章メモ社内O’Reilly「AI Engineering」輪読会の第3・4章のメモを共有し、「評価が信頼できないと改善判定が不能」という中心主張を要約している。@amatsu13:31
291日54本のPRをマージした「並列agent codingコックピット」の作り方1日54本のPRをマージした自社の並列エージェントコーディング基盤について、ターミナル管理を人間からエージェントに移行した設計思想を公開している。@1 saver13:27
30トークンが足りなさ過ぎて、Windsurfを契約した話Codex/Claude両方のトークン枯渇でWindsurf有料契約に踏み切り、並行開発中の主力ツールをどう切り替えたかを個人視点で綴っている。@suzukihinata13:27
31広告動画作りで時間を使いすぎないために。AIを試して気づいたこと広告動画制作で最も時間を食う「アイデアを具体的な動画形式に落とす」工程をAI補助で短縮した試行と気付きを共有している。@Luong Gehling12:55
32GPT-5.5→5.6 で判定役の何が変わり、何が変わらなかったか — 同じ判定タスク・同じプロンプトで差分を実測QA判定役としてのGPT-5.5と5.6を同一プロンプトで比較し、判定一致率と失敗パターンの変化を実測ベースで整理している。@りょうさん12:54
33魔法の矢は無かった。静的解析のガードレールを3ヶ月回してみた静的解析のガードレールをCIに3か月回した結果「魔法の矢は無かった」と結論付け、地味な安全策の積み重ねだけが品質を支えると報告している。@Ryo Kanno12:53
34事故65回、ルール65本、売上¥0。AI組織でギャンブル事業を運営する現在地複数エージェントでパチンコ・競馬データ事業を5か月運営した記録として、事故65件・ルール65本・売上0円という失敗込みの実データを公開している。@karasuda_lab12:40
35AI議事録の「話者識別」を音声diarizationなしで実装した話音声diarizationを使わずClaudeに文字起こしテキストから話者を推定させる方式を採用し、精度とコストのトレードオフをSaaSで実運用した事例を報告している。@Miki - KaigiAI12:35
36AIに書かせて、人間が検収する — 連載前半6本の索引「AIに書かせて人間が検収する」連載前半6本の索引を作成し、複数AIを個人プロジェクトで運用する検収課題の全体像を俯瞰している。@yuta-urano15:08
37AIで実装が速いほど、要求とテストの対応が崩れた — V字モデルを検収の対応表として使い直すAIによる実装加速で要求とテストの対応が崩れる問題を、V字モデルを検収用対応表として使い直すことで再結合する運用を提案している。@yuta-urano14:53
38M1 Macで完全無料・ローカルのAIショート動画パイプラインを作った全記録 — ローカルClaude民へM1 Mac上でSDXL・LTX-2.3・Kokoro TTS・MusicGenを組み合わせ、完全無料・ローカルのショート動画生成パイプラインを構築した全工程を公開している。@Umamon14:36
39すべてのAPIはエージェント向けに再設計されるMCPで既存APIを繋いだ結果、エージェントが誤ったエンドポイントを選ぶ・不要な多重呼び出しをする事例を提示し、API全体を再設計すべきと主張している。@Gyu0718:55
40エージェントのWeb取得、ツール次第でトークンが5000倍違った話エージェント用Web取得ツール5種を日本語URL7件で比較し、Jina Readerは3.9MB CSVで459万トークンを返す一方、自作amenboは909トークンで済んだと実測した。@Rererr13:01

Qiita

#TitleSummaryAuthorPublished
1Claude API メモリストアの破壊的変更に注意!新ベータヘッダー移行完全ガイドAnthropicが7月初旬にClaude APIのMemory Stores APIのリスト取得挙動を変更する新ベータヘッダーを追加したため、移行手順と後方互換性の破壊点をまとめている。@picnic22:40
2Codex Desktopのタスク履歴を新PCへ移行するまでの苦労と解決方法新Windows PCへの移行時にCodex Desktopの設定だけでなくタスク履歴・スレッド・添付・アーカイブまで移し替えるまでの詰まりと解決手順を記録している。@kanameShiga22:51
3ChatGPT Pro X20を使い切る:Chat・Work・Codexの構成と実践的な使い分け【2026年7月10日版】Pro X20契約におけるChat・Work・Codexの表示差と段階展開状況を整理し、実務で3プロダクトを使い分けるための構成ガイドを提示している。@ootakazuhiko15:24
4GPT-5.6登場!Sol・Terra・Lunaの違いと実務での使い分けを解説GPT-5.6のSol・Terra・Lunaの機能差を実務ユースケースに落として比較し、どのタスクにどのティアを充てるかの判断基準を提示している。@jtths47412:53
558年ぶりの進化?GoogleのMagic Pointerが変えるAI×UIGoogleのMagic Pointer技術を題材に、AI×UIの進化を短編動画付きで紹介するライトウェイトな解説記事となっている。@kinamocchi_tech20:12
6Gemini APIでニュース記事を要約しSNSに投稿するGemini APIで複数RSSを集約し、X・Facebook・LinkedInに合わせた投稿文を自動生成するパイプラインの実装例を紹介している。@kotajobs015:22
7疫学研究の発表用プロンプトガイド疫学研究の発表資料作成に特化したプロンプトフレームワークをPECOフォーマットと時系列可視化を軸に整理している。@rehab-datascience13:39
8Geminiが実は最強のAIエージェントだと主張する採用率で他プラットフォームに劣るGeminiが、実は開発用AIエージェントとして強力であると論拠を示しつつ主張している。@BRSF12:00
9GPT-5.6で利用上限に達するのが早すぎる?問題はプランではなくコンテキストですGPT-5.6の利用上限到達が早い問題を、プラン容量ではなくコンテキスト設計の不備が原因だと分析し、削減パターンを提示している。@Skillselion20:30
10ClaudeやCursorから直接「声」を生成する。Lovo AI MCPによる音声合成の自動化Lovo AI MCPを介してClaudeやCursorから直接テキスト読み上げ音声を生成し、コピー/切替なしでエージェント音声化する構成を紹介している。@renatomarinho19:50
11RAGの次は「探索」? 文書コーパスをスキルツリー化するCorpus2Skillを試す論文「Don’t Retrieve, Navigate」に触発され、文書コーパスをスキルツリー化して探索するCorpus2Skillの実装を試した記録を公開している。@Xim2jp17:12
12Bedrock Knowledge Base の Retrieve は生チャンクを返さなかった — S3 Vectors で RAG 3方式実測比較Bedrock Knowledge BaseのRetrieveが生チャンクを返さないことに気付き、S3 Vectorsを使う3方式のRAG構成で挙動と品質を実測比較している。@kazu_techlog14:06
13LLMの出力が安定しないと悩むエンジニアへ。コンテキストの設計で挙動をコントロールできるようになる一冊LLMの出力が安定しない原因は多くの場合コンテキスト設計の不備であり、RAGを入れても精度が上がらない事例を含めて処方箋を紹介している。@yasu110908:15
14ローカルLLMをSV/UVM用に育てる(実践編)SystemVerilog/UVM向けにローカルLLMをRAGとLoRAで育てる実践手順を、データ整備と学習プロセスに分けて具体的に解説している。@sukimaengineer06:21

ITmedia AI+

#TitleSummaryPublished
1「Teslaに乗ってGrokと話そう」 日本Teslaが車載音声対話AIを提供開始日本Teslaが対話AI「Grok」を車載音声対話に統合し、ソフト2026.20以降とPremium Connectivity課金で利用可能にしたと発表した。21:15
2生成AIがないと約6割が業務に支障 ICT総研ICT総研の調査で回答者の約6割が生成AIなしでは業務に支障が出ると回答し、生成AIが定着期に入ったと示唆している。13:00
3OpenAI、CodexとChatGPT Workの使用制限をリセット Anthropicの先制対応を受けOpenAIがCodexとChatGPT Workの使用制限をリセットしたと発表し、先にClaude制限をリセットしたAnthropicとの応酬が話題になったと報じている。12:13
4デジタル庁、政府AIインフラの実証で「つづみ」など国産モデルをさくらのクラウドに展開デジタル庁が政府AI基盤の実証としてNTTの「tsuzumi」を含む国産モデルをさくらのクラウド上に展開すると発表した。11:30
5中堅ビジネスパーソンこそAI時代の切り札 若手優位論に反論生成AI時代でも中堅ビジネスパーソンはドメイン知識という強い武器を持つと分析し、若手優位論に対して反論を提示している。11:00
6SaaSモデルは終焉するのか? Gartnerがエージェント時代の収益変革を予測Gartnerがエージェント型AIが従来のSaaS UI駆動選定を崩し、企業ソフトの収益モデルが機能単位課金へ変化すると予測を示している。08:00
7ヒマラヤ、スポーツ用品店に「AI副店長」を配備 99店舗で顧客対応を強化スポーツ用品店ヒマラヤが接客ノウハウを学習した「AI副店長」を99店舗に配備し、6月から顧客対応の質を底上げする運用を始めたと発表した。07:00
8スター精密、Notion AIを全社導入 約550人利用でAI活用が従来比4倍にスター精密がNotionとNotion AIを約550人規模で全社導入し、活用率90%・AI使用量が従来チャット比約4倍に伸びた実績を紹介している。07:00
9AI導入で売上向上7割・コスト削減はまだ苦戦 実態調査507社への調査で売上向上狙いのAI導入は7割が利益増を実現する一方、コスト削減型は現場側の課題で成果が出にくいと明らかにした。07:00
10すかいらーく、AIは「人の価値を増幅」する道具 人員置換にはしない戦略すかいらーくがAIを「人員置換」ではなく「顧客接点の価値を増幅する道具」と位置付ける戦略で、店舗現場に投入している方針を示している。07:00
11ソフトバンク、社内RAG基盤を1万9000人規模で運用 数千時間の効率化に成功ソフトバンクが1万9000人向け社内RAG基盤を構築し、運用性とセキュリティガバナンスを両立して数千時間規模の効率化を実現したと報告している。05:00

GIGAZINE

#TitleSummaryPublished
17440億パラメーターの巨大AI「GLM-5.2」をメモリ25GBの普通のPCで動かす推論エンジン「Colibrì」が登場744億パラメーター級モデルGLM-5.2を、必要データのみSSDから随時ロードして25GBメモリの一般PCで動かす推論エンジン「Colibrì」が公開されたと報じている。16:20
2iPhone 17 Proで270億パラメータのAI「Qwen3.6-27B」が動作、AppleはPrismMLと圧縮技術の活用を協議かiPhone 17 Proで270億パラメータのQwen3.6-27Bが圧縮技術で動作した事例を紹介し、AppleがPrismMLと同技術活用を協議中と報じている。15:10
3GoogleのAI広告ツールを使用して作成された広告に「AI製」表記が自動付与Googleが生成AIツールで作られた広告に「AI製」ラベルを自動付与する透明化施策を全広告カテゴリに拡大したと発表した。11:28

Publickey

(すべての記事がTop 20に含まれているため、ランク外の記事はありません)

OpenAI Blog

(すべての記事がTop 20に含まれているため、ランク外の記事はありません)

Google AI Blog

(対象日にAI関連記事はありませんでした)

Hugging Face Blog

#TitleSummaryPublished
1Profiling in PyTorch (Part 3): Attention is all you profile(PyTorchでのプロファイリング第3回:Attention層をプロファイルせよ)PyTorchプロファイリング連載の第3回として、Transformerのアテンション層に焦点を当てた性能計測・最適化テクニックを解説している。00:00

Simon Willison

#TitleSummaryPublished
1Quoting OpenAI(OpenAIの記述を引用)OpenAI公式ドキュメントを引用し、ChatGPT WorkがWeb/モバイルではクラウド、デスクトップではローカルファイルも扱う二層構成である点をSimonが整理している。10:05
2Introducing Muse Spark 1.1(Muse Spark 1.1のご紹介)MetaのMuse Spark 1.1公開についてSimonがまとめ、Meta初のAPI提供モデルであり「エージェント的ツール呼び出しとPC操作」の強化がアピール点だと解説している。01:24

The Decoder

#TitleSummaryPublished
1The Fed wants AI investor Marc Andreessen to help figure out if AI can tame inflation(連邦準備制度はAI投資家Marc AndreessenにAIによるインフレ抑制を検討させたい)Fed議長Kevin WarshがMarc AndreessenをAIの経済影響アドバイザーに任命したが、a16zの巨額AI投資による利益相反懸念が浮上したと報じている。21:18
2Bun ditches Zig for Rust with help from Claude Fable 5, writes over a million lines of code in 11 days(BunがClaude Fable 5の力を借りてZigを捨てRustへ、11日で100万行超のコードを生産)JavaScriptランタイムBunがClaude Fable 5主導でZigからRustへの全面書き換えを実施し、コード移植の大半をエージェントに担わせたと報じている。20:09

Hacker News

(対象日にAI関連記事はありませんでした)

RECENT ISSUES 最近の号 BACK NUMBERS

すべてのバックナンバーを見る →