VOL. 102
AI NEWS DIGEST
AI OUTLINE
2026-08-06
木曜日 · JST
TODAY’S ISSUE 2026年8月6日 · 木曜日 AI FRONTLINE

AIニュースまとめ 2026-08-06|ジェフ・ディーン氏がGoogle退社しDiscovery Loop設立

アップデート情報

各社が 2026-08-06 に公式発表したプロダクトアップデートです。

Claude / Claude Code

ChatGPT / Codex

Gemini

Top 20

Googleのジェフ・ディーン氏、独立してAI実験を大規模自動化する新会社Discovery Loop設立

Source: ITmedia AI+ | Published: 2026-08-06 19:20 JST

Improving GPT‑5.6 Sol in ChatGPT—and expanding access to GPT-5.6 Luna for free users(ChatGPTのGPT-5.6 Solを改良し、無料ユーザーへのGPT-5.6 Lunaの提供を拡大)

Source: OpenAI Blog | Published: 2026-08-06 19:00 JST

Meta、コーディングエージェント「Muse Code」リリース 「Claude Code」や「Codex」に対抗

Source: ITmedia AI+ | Published: 2026-08-06 10:31 JST

NVIDIA、自動運転向けオープンモデルを商用利用可に 新モデルは「卓越した性能」うたう

Source: ITmedia AI+ | Published: 2026-08-06 13:56 JST

アプリが遅い原因をAIがトレースログから分析してくれる「Windows Performance Analyzer MCP」 Microsoftがプレビュー公開

Source: ITmedia AI+ | Published: 2026-08-06 19:54 JST

The company that made open weights mainstream now competes on discounts(オープンウェイトを主流にした企業が、いまは値引きで競っている)

Source: The Decoder | Published: 2026-08-06 21:31 JST

リクルート、新卒エンジニア向け研修資料を無料公開 “AI時代の生き残り方”など紹介する13本

Source: ITmedia AI+ | Published: 2026-08-06 13:28 JST

MythosとGPT-5.6 Solが性能テスト中に暴走 OSSメンテナーに圧力、有害コード実行図る 英政府機関

Source: ITmedia AI+ | Published: 2026-08-06 11:06 JST

オープンソースのAI機能付きオフィス登場 docx・xlsx・pptx・pdfに対応 Genspark

Source: ITmedia AI+ | Published: 2026-08-06 08:00 JST

Introducing Muse Code and Muse Spark 1.2(Muse CodeとMuse Spark 1.2の紹介)

Source: Simon Willison | Published: 2026-08-06 08:58 JST

ミッチェル・ハシモト氏が新会社「Superlogical」を設立、あらゆる仕事に使えるマルチプレクサの開発へ

Source: Publickey | Published: 2026-08-06 15:26 JST

Working with the American Psychological Association on youth mental health and AI(若者のメンタルヘルスとAIについて米国心理学会と協働する)

Source: OpenAI Blog | Published: 2026-08-06 15:00 JST

From asking to doing: How the world is putting ChatGPT to work(尋ねるから任せるへ:世界はChatGPTをどう仕事に使っているか)

Source: OpenAI Blog | Published: 2026-08-06 09:00 JST

Google DeepMindのデミス・ハサビスCEOが退任して会長に チーフサイエンティストのジェフ・ディーン氏は独立へ

Source: ITmedia AI+ | Published: 2026-08-06 07:08 JST

書店に「3000冊の発注」、AI企業が古書を買いあさる? Anthropicも数百万冊をスキャン・破棄 実態明らかに

Source: ITmedia AI+ | Published: 2026-08-06 17:30 JST

Google DeepMindが描く「AGIの次」 超知能に至る4つの経路と6つのボトルネック

Source: ITmedia AI+ | Published: 2026-08-06 05:00 JST

「1人1AI」のアプローチは破綻する――チームでAI共有時のセキュリティ問題を解決するベストプラクティス

Source: ITmedia AI+ | Published: 2026-08-06 16:00 JST

ソフトバンクG、投資利益1.8兆円を支えた「OpenAIではない”あの半導体メーカー”」の正体

Source: ITmedia AI+ | Published: 2026-08-06 19:30 JST

Google will shut down Google Assistant starting September 2026 as Gemini takes over on Android and Wear OS(GoogleがAndroidとWear OSでGeminiへ移行し、2026年9月からGoogleアシスタントを終了)

Source: The Decoder | Published: 2026-08-06 02:59 JST

OpenAI reportedly slows research after its own models secretly coordinated hacks for weeks undetected(OpenAIが自社モデルによる数週間にわたる秘密裏の連携攻撃を見逃していたと報じられ、研究を減速)

Source: The Decoder | Published: 2026-08-06 20:49 JST


All Articles

Zenn

#TitleSummaryAuthorPublished
1「AIで生産性10倍」の裏で、英語圏は「2倍」の話を始めているHacker Newsで上位に入った「2x, not 10x: coding with LLMs in 2026」というエッセイを手がかりに、日本語圏で語られる10倍という数字と英語圏の実測感覚のずれを整理している。@守破離AI22:33
2金融機関が直面するAIエージェントの課題とGemini DropGoogleがGemini関連の新機能を月次でまとめる「Gemini Drop」を紹介し、金融機関のAI活用が実証実験で止まりがちな要因をアクセンチュアの導入現場から整理している。@青柳雅之22:20
3Claude Codeをアカウント別に使い分ける環境構築(macOS)用途ごとに認証情報・会話履歴・設定が混ざる問題に対し、macOSでプロファイルを分けてClaude Codeを複数アカウント運用する手順を解説している。@アトリヱ未來20:47
4Anthropic公式プラグイン「pr-review-toolkit」でPRレビューを観点別エージェントに分担する自動でPRへ投稿するcode-reviewとは対照的に、6つの専門エージェントへ観点を分け、必要な視点だけをローカルで選んで走らせる分業型プラグインとして解説している。@しろちゃん20:46
5Kiro Crew のアーキテクチャから学ぶ、永続型 AI エージェント基盤の設計セッションをまたいで文脈を記憶しスケジュールやイベントで作業を継続するKiro Crewの構造を読み解き、Kiro CLIにWeb UIを付けただけではない設計上の勘所を示している。@konippi20:41
6自宅RTX 5090にvLLM+Open WebUI のローカルLLMサーバーを立てて Tailnet 経由でスマホから使う自宅のRTX 5090マシンにvLLMとOpen WebUIでローカルLLMサーバーを構築し、Tailnet経由でスマートフォンから外出先でも呼べるようにした構築記録を残している。@kaerururu20:31
7AIコーディングCLIが「何を送ったか」を承認してから走らせる — 開示マニフェストの実装Claude Codeなどへ作業を渡すとき何が送信されるか見えない問題に対し、送信前にファイルと内容を提示して承認を取る開示マニフェストをデスクトップアプリとして実装している。@Umamon20:20
8Claude Opus 5 が張り切りすぎるので、hook で黙らせてみた話Opus 5に上げてから応答が長くなり頼んでいない作業まで始めるようになったため、新機能を活かす方向ではなくhookで従来の応答スタイルへ戻す設定を組んだと報告している。@みっち(リンク)20:11
9「エラーが出ない」は動いている証拠にならない——Claude Codeのhookが黙ったまま止まっていた話自作の自動チェックがエラーもログも出さないまま2日間まったく動いていなかった事例を挙げ、無音を正常と読み替えてしまう危うさを具体的に示している。@ぴろゆき19:58
10唯一無二のRAGツール、作者ですら立ち上げるのが面倒になって軽量版lkrag-liteを作った話作者自身が起動を面倒に感じたlkrag-mcpを、SQLiteだけで完結しブラウザで動くlkrag-liteとして作り直し、対応形式と検索性能をどこまで割り切ったかを記録している。@patakuti19:58
11PDF翻訳でレイアウトが崩れる問題と、座標情報を維持するマルチモデルAIの仕組み自作のPDF翻訳ツールPDFTranslatorを題材に、翻訳後にレイアウトが崩れる原因をPDFの構造解析から説明し、座標情報を保ったまま訳文を差し込む仕組みを解説している。@yotoyang19:54
12面白くない自作パズルをAIに8,000回プレイさせたら原因がわかった!unity1weekに出したパズルゲームをAIに8,000回プレイさせ、手動プレイでは見えなかったゲームバランス上の問題を特定したと報告している。@canecco19:27
13AI時代、本当に求められるのは「実装できるコンサルタント」なのか日経新聞の「AIでコンサルもう不要?」という記事を起点に、調査型コンサルが不要になり実装までできる人材が要るという主張を実務の視点から検討している。@風呂井 仁19:22
14AI Collaboration Platformとは何か――Garmin OSSで実証したAI協働を再利用可能にするGarmin Running Data Normalizerの開発を振り返り、AIの数を増やしただけでは品質が上がらなかった経験から役割分担を再利用可能な形へ抽象化している。@tsubotti6319:12
15【並列開発】isolation: worktreeやめました 〜決定論と認知を分けてAIと仕事する〜AIの判断を必要としない決定論的なセットアップ作業をシェルスクリプトへ切り出した結果、Claude Codeのworktree分離そのものが不要になったと結論づけている。@marimo18:18
16無課金Codex画像生成の運用ハマりどころと「効く挿絵」の条件ChatGPTのサブスク枠でCodexから画像を生成する際のつまずきを挙げ、生成画像が記事の質を上げるか下げるかを分ける編集上の判断基準を整理している。@ほし18:14
17Anthropic公式プラグイン「code-review」でPRレビューを自動化するコマンド1つで5つのSonnetエージェントが並列にPRを分析し、信頼スコアで絞り込んだ指摘だけをPRコメントとして投稿する全自動型プラグインの使い方を解説している。@しろちゃん18:02
18未経験からNotionの社内マニュアルを検索できるRAGチャットボットを作ってみたNotion上のダミー社内マニュアルを対象に、経費精算などの質問へ参照元付きで答えるRAGチャットボットを未経験の状態から構築した過程を記録している。@凡人17:58
19イベント2日間のために、週末だけ1ヶ月・実働20時間未満でAI4コマ漫画アプリを作ってみた経済産業省こどもデー向けに、人が1コマ目と3コマ目を描きAIが2コマ目と4コマ目を描く4コマ漫画生成アプリを実働20時間未満で作ったと報告している。@Naosuke17:54
20Claude Code は CLAUDE.md をどう読み込むのか — メモリ階層と読み込み順の整理CLAUDE.md・CLAUDE.local.md・~/.claude/CLAUDE.md・管理ポリシーの違いと読み込み順を整理し、設定が効かない場面がなぜ起きるのかを階層構造から説明している。@shohei-ai-lab17:36
21一生使える自分専用のAIベンチマークを作った — 差が出たのは「賢さ」ではなかった落ちものパズルで4段階の課題を自作したところレベル1〜3は3モデルとも満点となり、公開ベンチマークでは見えない差がどこに現れるかを検証している。@miki-mini17:00
22AI Readyなデータ基盤とは何か — 6つの条件で整理する各社で定義が揃わない「AI Readyなデータ基盤」を、SnowflakeがGitHubで公開するAI-Ready Data Frameworkの6ファクター62要件に沿って整理している。@Ruuuhs16:45
23AIエージェントにスキーマ変更を委ねるための設計原則ORMスキーマ・SQLマイグレーション・dbtへ変更が波及する場面を例に、AIエージェントへスキーマ変更を任せるための境界設計をdev.to記事の日本語版として示している。@遠藤 崇史(ROUTE06)16:39
24MiniMax H3をWaveSpeed APIで呼ぶ:3入力とPollingの実装Text/Image/Reference-to-Videoのいずれもpredictionを作って結果URLをpollingする共通手順だと示し、480p・5秒でText/Imageが0.20ドル、Referenceが0.25ドルという実費も提示している。@ハク(Haku)16:15
25hookスクリプトが黙って死ぬ ― macOSで踏んだ3つの罠zshで書いたClaude Codeのhookスクリプトがエラーもログも残さず失敗する3種類の原因を特定し、なぜデバッグしづらいのかを切り分けている。@Lily16:04
26AIにプロジェクト全体のコードを書かせる「RACG」入門 — サーベイ論文を読み解く単一の関数は書けてもプロジェクト全体は苦手というLLMの弱点を出発点に、リポジトリレベルのコード生成を扱うRACGのサーベイ論文を初学者向けに読み解いている。@HASHIMOTO Hiroki16:00
27DHHのRails Doctrineを、大AIエージェント時代に読み直したら今こそぶっ刺さる思想だったぞ2016年のRails Doctrineを現在のAIエージェント前提の開発と突き合わせ、当時の設計哲学がいま効く理由をクラシル社のサーバーサイド開発の視点から論じている。@たろう眼鏡15:58
28【Day 20】ローカルAI vs クラウドAI。猫の写真1枚を10種類の動画AIで動かしてみたDGX Spark上のLTX-2.3・Wan 2.2とfal.ai経由のクラウド8種を含む10種類の動画生成AIに同じ猫の写真を渡し、ローカルとクラウドの差を比較している。@SAETAG15:51
29AIガバナンスを現場で回すための書籍4選——「方針だけ決めて終わり」を脱却する精度検証もガイドライン整備も済ませたのに要約の誤りが顧客向け報告書へ転記されたインシデントを起点に、運用まで踏み込むためのAIガバナンス書籍4冊を選んでいる。@Koukyo15:25
30Foundry Hosted Agent のデプロイ方式(code / container)を整理するMicrosoft FoundryのHosted Agentについて、azd ai agent initからazd upまでの流れと--deploy-modeで選ぶcodeとcontainerの違いを検証結果として整理している。@zukako15:18
31ブラックボックスじゃないAIを作ろうとしたら、LLMの「ブレ」の正体が想定と違っていた話同じ質問を複数回投げてブレを測ると100%が1回目だけずれる現象が起き、1回目を除いて計算し直すだけで126語中121語が基準を満たしたと報告している。@soy@source15:16
32How HuMo AI Changed the Way I Write Video Scripts(HuMo AIが動画スクリプトの書き方をどう変えたか)映像の作り込みよりも脚本が動画の質を決めると気づいた経緯を語り、プロンプトやカメラワークの試行錯誤から制作の重心をスクリプトへ移したと振り返っている。@emilyjones121715:14
33AIエージェントに「エンジニアの心構え」を大量に教え込んだら、仕事の質はどう変わったかシステムプロンプトへ「何をするか」ではなく「どういうエンジニアであるべきか」を大量に書き込み、Claude CodeとCodexの挙動が約1か月でどう変わったかを記録している。@とむ15:10
34AWSのContext Ontology Acceleratorを実際にデプロイして、意地悪なデータを食わせてみたAWSのOSSであるContext Ontology Acceleratorを自分のアカウントへデプロイし、手順解説ではなく実際に踏んだハマりどころと外部キー推論の挙動を記録している。@mskbhd14:44
35最近の自分のAI開発(Part.2)コードを先に書く進め方から仕様駆動へ移った理由を説明し、人間のレビューがボトルネックになる以上は仕様ベースの計画が持続可能な速度を決めると論じている。@sfjwr14:33
36MiniMax-H3をM3 Ultra 512GBで実測:音つき5秒動画を35分で生成Apple M3 Ultra/512GBのMac Studioで1344×768・124フレーム・30ステップの音声付き動画を生成し、所要2089秒・実測ピーク53.686GBという数値を示している。@のりちゃん14:31
37AIハーネスは「強くする」より「アシュビー的に多様にする」べきでは制御系の多様性が制御対象を上回る必要があるというアシュビーの必要多様性の法則をAIハーネス設計に当てはめ、強化より多様化を優先すべきだと提案している。@mskbhd14:30
38AIに任せた仕事は、任せ方を昇格させないかぎり減らないHuman-in-the-Loopの議論は線を引く話ばかりで線を動かす話がないと指摘し、半年前の判断基準を据え置いたままでは負荷が減らないと論じている。@おしお14:29
39AIに任せて壊れないシステムを作るバックテストで好成績だった自動売買システムがデータリークで本番崩壊した経験から、宣言ゲート・ガードテスト・セーフガード設計という復旧手順を体系化している。@auto_quont14:23
40AIに大きな仕様書を渡して一気に作らせるのは、宝くじを買うようなものです大きな仕様書を丸ごと渡すとレビュー不能な量の出力が返ってくるため、後から直すのではなくその状態に至らせない進め方が現実解だと結論づけている。@Isamu14:16
41AIで開発が速くなった? それってあなたの感想ですよね?コミット数2倍・マージ済みPR7割増・サイクルタイム3割減といった数字を挙げつつ、それをそのまま開発生産性の向上と呼んでよいのかを問い直している。@oniku_daisuki14:06
42AIの答えをAIに採点させる——安いモデルで高いモデルを見張れるかマルチエージェント構成で番犬役に安価なモデルを当てて他エージェントの出力を検収できるかを実測し、LLM-as-a-Judgeを低コストで回す条件を検証している。@daishir013:58
43AIに仕様書ではなくテストだけ渡したら、隠しテストまで全部通った。なのにテストでは固定できなかった既定値は5回とも40にならなかったclaude -pにテストだけを渡すと生成側に見せていない隠しテストまで通った一方、テストで固定していない既定値は5回とも意図した40にならなかったと報告している。@ぬまーん13:37
44Riveのデータバインディングを自前パーサで読めるようにしたら、読み違いが1つ見つかったrive-mcpにデータバインディングを読む機能を足す過程で既存パーサの読み違いが見つかり、修正の影響のほうが大きかったとv0.5.0の変更点とあわせて記録している。@UDOS13:18
454bitは妥協なのか——同じLLMを量子化ビット数を変えて実測同一のローカルLLMを量子化ビット数だけ変えて品質低下を実測し、fp16は無駄だったという結論に達したと報告している。@daishir013:13
46Qwen3.8-Max Is Alibaba’s Biggest Open-Weight Bet Yet. Here’s What You(Qwen3.8-MaxはAlibabaにとって過去最大のオープンウェイト投資だ)Alibabaが公開した2.4兆パラメータのMoEモデルQwen3.8-Maxについて、公式ベンチマーク表の読み方とオープンウェイト化の意味、Claude Codeでの動かし方を解説している。@NeoTechPark12:57
47MiniMax H3とは?ブラウザで画像から動画を生成する基本手順新しい動画生成モデルMiniMax H3の特徴を整理し、API設定やローカル環境の構築なしにブラウザ上のツールから画像とプロンプトだけで動画にする流れを示している。@jacksam12:47
48AIが私の経歴を捏造した。2回。——それで作った「ペルソナ正史」という仕組みAIに記事を書かせたところ複数記事で経歴が食い違い業界統計が実体験として書かれた事故を受け、事実を一元管理する「ペルソナ正史」という仕組みを提案している。@アニクマ12:44
49MCPサーバーを社内に置く前に決めた3つのこと —— 認証・ロール・検査の順番サンプルが動いた後に詰まる置き場所の問題を自分のPC・社内サーバー・インターネットの3択として整理し、認証・ロール・検査を決める順番を示している。@kazuhiro2188-lgtm12:33
50大規模toCサービスを止めないために。新卒バックエンドエンジニアがClaude Codeで気を付ける「クエリと実行計画」Claude CodeがN+1クエリやインデックスを使わないコードを書いてもテストは通ってしまうため、実行計画を確認する習慣が要ると新卒バックエンドの視点で示している。@t_tommy12:30
51SKILLを増やしたら、ClaudeのブラウザQAが下手になったブラウザQA向けに積み上げたSKILLから個別の操作手順を削除し、失敗原因を知識ノートへまとめ直したところ同じ失敗が減ったと報告している。@cazma12:07
52Sonnet 5 は GPT-5.6 Sol よりも「高い」のか(#高額請求 #トークン節約)Claude Sonnet 5とGPT-5.6 Solの比較は見かけのAPI単価では決まらないとして、トークン効率と実スループットを含めた実効コストで捉え直している。@noriyuki okamoto12:00
53AIでテスト観点を100個出せる時代。65個「削れるか」がテスト設計力だテスト観点は出すより削るほうが難しいとして、AIで大量に出した後にどう絞り込むかがテスト設計力になると論じている。@日下部 聡久11:30
54LLM Wikiパターンの標準化 OKF(Open Knowledge Format)登場したばかりのOpen Knowledge Formatを、RAGやLLM wikiという周辺技術の理解を前提に設計された概念として体系的に解説している。@NemoS11:00
55Nano Banana Pro/2をAPIで叩く:Geminiの画像生成を制御する4K出力・最大14枚の参照画像による一貫性維持・リアルタイム検索グラウンディングを備えたNano BananaシリーズをPythonからAPI経由で制御する基本を整理している。@リベルクラフト11:00
56PerplexityライクなQ&Aエージェントを個人開発アプリに組み込んだ——スケール時に実行モデルをどう変えるかウェブ検索と独自記事を組み合わせた出典付きQ&Aエージェントについて、利用者が増えたときに実行モデルをどう切り替えるかを実装から検討している。@yook10:58
57PerplexityライクなQ&Aエージェントを個人開発アプリに組み込んだ——6つの工程に分けた設計の工夫海外テックニュース収集アプリVectorへ組み込んだQ&Aエージェントを6段階に分割し、各工程での設計上の工夫と残った課題をソースコード付きで公開している。@yook10:58
58Claude Codeのようなエージェントをゼロから作るGitHubで7万スターを超えるlearn-claude-codeの全20章を読み込み、各章が1つずつ足していく仕組みと解決している問題を順に追跡している。@グエン・タイ・ゴック10:17
59AIの嘘がセキュリティリスクになる?OWASP LLM09 Misinformationを初心者向けに解説OWASP Top 10 for LLM Applications 2025がハルシネーションをLLM09:2025 Misinformationとしてセキュリティリスクに位置付けた理由を初心者向けに説明している。@mapellion10:00
60AI導入で変わったのは実装速度ではなく、開発プロセスだった規模の大きいシステム刷新でAIエージェントを2か月使った結果、コード生成の速さは期待以上だった一方で本当に変わったのは開発プロセスのほうだったと総括している。@horippy10:00
61「このコードを直して」の一行が、NDAを破るとき — 受託開発×AIの構造的ジレンマエージェントが文脈理解のためにリポジトリの機密情報をクラウドへ自動送信しうる点を挙げ、受託開発とAI利用が構造的に衝突する場面を整理している。@プロマネ武蔵09:17
62ThinkStationPGX(DGX Spark OEM)のGPUクロックが702MHzに張り付き、LLM推論速度が半減した話ThinkStationPGXでGPUクロックが702MHzに固定され推論速度が半減した症状に対し、シャットダウン後に給電ケーブルを抜いて放置すると回復したと記録している。@ねこのてエンジニア09:12
633か月、4媒体の反応を測り続けた。指標を変えたら、順位が完全に逆転したQiita・Zenn・dev.to・noteの反応を集計スクリプトで3か月追い続けたところ、評価指標を変えるだけで媒体の順位が完全に入れ替わったと報告している。@Rapls09:06
64Unity MCPでゲーム実装をほぼ100% AIに任せて分かった、UnityとPhaserの選び方Unity MCPでタワーディフェンス制作をほぼAIに任せた結果、人間の仕事が仕様詰めとUXテストへ移り、AIから見た可観測性と編集容易性がエンジン選定の基準になったと結論づけている。@norinori109:01
65Claude Code のメモリーにベクトルは 1 本もない — memory RAG の前に ADR をClaude Codeのメモリー実装を調べるとembeddingもベクトルDBもchunk分割もなく89ファイルのプレーンMarkdownと索引だけだったとして、memory RAGより先にADRを整えるべきだと論じている。@shimo422808:39
66Claude Code v2.1.218〜221まとめ、fast modeは枠外課金で何を試すべきかClaude Codeの4回分のアップデートを整理し、Opus 5が既定モデルになった点やコードレビューの実行場所・サブエージェント構造の変更点を分析している。@AIニュース07:02
67問い合わせから契約まで AI で一気通貫にする設計問い合わせから契約完了までを1本のパイプラインに束ね、転記やテンプレート探しといった反復作業を取り除く設計を提案している。@平野翔斗07:00
68AI エージェントが 2 ヶ月見抜けなかったバグと、記憶・門番・診断 3 層の現在形自作の長期記憶基盤brainと入口のtriage、診断プロトコルinvestigateという3層が現在どう噛み合っているかを、2か月見抜けなかったバグを題材に整理している。@こかげ06:56
69個人サイトを改修する時、僕はどんな流れで進めているかAstro+Cloudflareで作ったポートフォリオサイトを、Claude CodeとGemini CLIを併用しながら地味な改修として回し続けている運用の流れを記録している。@MotimotiNotch06:37
70制約8個の遵守確認、生成ターンと検証ターンを分けても文字数だけは直らない生成と自己チェックを別ターンに分けると内容系の制約はほぼ解消する一方、150字以内という文字数制約だけはChatGPT・Claude・Geminiのいずれでも改善しなかったと報告している。@毎日AIレシピ06:07
71ループの次はグラフだった —— AIを含む開発実行系を監督制御の対象として扱う統計と計測の言葉で書いた前3稿と同じ結論を離散事象系の監督制御の言葉で書き直し、規範を預ける先は生成器ではなく構造だと論じている。@cognitiveosmdl06:00
72「パーソナルはモデルではない」——では、どこに置くのかエージェント向け手順書SKILL.mdが実運用と10日間ずれていた事案を起点に、個人化の層をどこへ置くべきかという配置の設計論を展開している。@ryok05:38
73MVPを小さくしすぎた。台帳CLIを「MANY-AI Incident」へ設計し直したnpmのサプライチェーン侵害を調べた際に導入履歴が分からなかった経験から作ろうとした台帳CLIの仕様を、公開した当日に大きく書き直したと記録している。@ishizakahiroshi02:26

Qiita

#TitleSummaryAuthorPublished
1Mii的な模式顔からのi2iで架空人物の顔多様性を上げたい架空の科学者をプロンプトだけで描き分ける前回の試みを踏まえ、顔幅や顎、目の比率をPILで加工した模式顔をi2iの入力に使って顔の多様性を上げようとしている。@shimajiroxyz23:34
2【個人開発】Gemini API × GitHub ActionsでPRのQAレビューを自動化する「QA-Sensei」を作ってみたGemini APIとGitHub Actionsを組み合わせてプルリクエストのQAレビューを自動化するQA-Senseiを、初めてのAI連携として個人開発した過程を記録している。@nao_dev23:33
3Claude Codeとプロンプト・エンジニアリングChatGPTに比べClaude Codeではプロンプト調整が表に出にくい理由を、CLAUDE.mdやメモリ、作業ディレクトリのファイルが担うコンテキストから説明している。@m_yukio22:38
460秒の曲は20秒、5秒の効果音は4分 — RTX 4070ローカル音声生成の実測RTX 4070でBGMと効果音の生成モデルをローカル実行し、60秒の曲は20秒で作れるのに5秒の効果音には4分かかるという逆転した実測値を示している。@kenimo4922:30
5Claude Code v2.1.223のセキュリティ修正とコンテキスト管理変更まとめv2.1.223で入った4件のセキュリティ修正を取り上げ、権限チェックやサンドボックス境界を回避できた脆弱性がCLIツールとして重大だと位置付けている。@picnic22:21
6Codex app-serverで ChatGPTのConnected appsを無効化する方法Codex app-serverを使うときにSlackやNotion、GitHubといったChatGPTのConnected appsへアクセスさせたくない場合の無効化手順を解説している。@nakamasato21:42
7Google公式の Cloud Run MCP で、Claude Code にデプロイさせてみたGoogle Cloud Next ‘26で発表されたCloud Runのフルマネージドなリモート MCP サーバーを使い、Claude Codeにデプロイまで実行させた手順を記録している。@TaichiYamasaki21:41
8MCP史上最大の仕様変更 - 2026-07-28リビジョンで何が変わったか2026年7月のリビジョンでMCPがステートレスになった点を中心に変更を整理し、AIエージェント基盤におけるHTTPのような標準プロトコルとして位置付けている。@Thanush20:50
9Gemini APIで検索結果をJSON化する3実装を比較、公式併用は400で不可だったGemini APIの検索結果をJSONにする3つの実装を比較し、Google Search groundingとresponse schemaを併用するとHTTP 400で失敗したと報告している。@kai_kou20:13
10大人用です。(x+5)/(x+1)が整数「高校入試チャレンジ問題 整数xをすべて求めよ」様を、計算はsympyで作図は手抜きのつもりでした。高校入試の整数問題をsympyで解いて作図までつなげた記録で、作図は手を抜くつもりが結局は手直しが必要になったと振り返っている。@mrrclb48z20:01
11Tableau Cloud MCPを試してみよう!バージョン2026.2で登場したTableauのHosted MCPを試し、2025年6月のGitHub公開時に比べ初期セットアップの手間が大きく減ったと報告している。@unbosoms19:43
12Bedrock AgentCoreで業務システム連携AIエージェント構築Bedrock AgentCoreで自然言語の受付から分析・提案・人による承認・タスク自動実行までを業務システムと連携させるエージェントを構築している。@Mikeinu17:24
13OpenAI Astra And How It Solved 10 Unsolved Math Problems(OpenAIのAstraが未解決の数学問題10件をどう解いたか)OpenAIの研究システムAstraを取り上げ、数学と理論計算機科学の未解決問題に対して報告された成果の中身を紹介している。@orsonamiri16:11
14LLMの出力を「なんとなく良い」で終わらせない — 評価セットとLLM-as-judge主観的な良し悪しで判断せず、評価セットとLLM-as-judgeを使って本番プロンプトを改善する進め方を解説している。@5_years_apart14:01

ITmedia AI+

#TitleSummaryPublished
1AIデータセンターは「圧倒的に供給不足」――ソフトバンクG後藤CFO、“バブル疑惑”を否定ソフトバンクグループの後藤芳光CFOが2027年3月期第1四半期の決算説明会でAI向けデータセンターは圧倒的に供給不足だと述べ、バブルだという見方を否定している。19:49
2ワークマン、実は画像生成AIを導入していた 間に合わない商品撮影を代替 アプリ通知開封も1.5倍商品撮影が間に合わない課題を画像生成AIで補ったワークマンの取り組みを担当者に聞いた記事で、アプリ通知の開封率が1.5倍になったと伝えている。10:16
3フィジカルAIに注力するインテル、組み込み市場での約40年の実績を生かせるかインテル・ロボティクス・ワークショップ2026の前編レポートとして、インテルのロボティクス/フィジカルAI戦略の基調講演とモベンシスのモーションコントローラー事例を紹介している。08:00
4KDDIも40年前はスタートアップだった 高橋会長の”昔話”から考える、日本企業の成長戦略KDDIの高橋誠会長が創業期を振り返った談話を手がかりに、スタートアップ精神で伸びた企業の成長戦略を日本企業一般の課題として考えている。07:00
5資金調達の「二極化」進む 勝ち抜く企業の条件は? 早大教授に聞く早稲田大学ビジネススクールの長谷川博和教授が、AIによる審査の高度化と資金調達の多様化は同じ話ではないと指摘し、二極化のなかで勝ち残る条件を語っている。07:00

GIGAZINE

#TitleSummaryPublished
1100分の1の価格のオープンモデルでGPT-5.6 Solの検索性能を凌駕したという報告NeonがCastformと共同で40億パラメータのオープンソースモデルを追加学習し、100分の1の価格でGPT-5.6 Solの検索性能を上回ったと報告している。22:00
2機能を絞ったAIコーディングツール「Pi」が高性能な理由とは?4つの基本機能でAIコストを抑える仕組みコーディングハーネスPiが標準機能をあえて絞ることで処理費用と作業効率を改善する仕組みを、Databricksの性能検証やShopifyで作られた拡張機能とあわせて解説している。21:30
3AI検索はGoogle検索を置き換えるのではなく新たな顧客を呼び込んでいるとShopifyが報告チャットAIの普及でGoogle検索からの流入が減るという懸念に対し、ShopifyはAI検索が既存の流入を置き換えるのではなく新規顧客を連れてきていると報告している。20:00
4AtlassianのAI「Rovo」に文書を読ませるだけで社内データが外部送信される脆弱性が発見される悪意ある命令を埋め込んだ文書をAtlassian Rovoに読ませるだけでJiraやConfluenceの社内データを外部へ送信できる脆弱性を、セキュリティ企業が報告している。15:45
5Googleからジェフ・ディーンら4人が独立してAIで技術革新をめざす「Discovery Loop」創業Geminiの開発に携わったチーフサイエンティストのジェフ・ディーン氏が、Google DeepMindの退職と公益法人Discovery Loopの立ち上げを発表したと伝えている。15:10
6TIME誌が人間とAIクローラーに異なるページを配信、AI向け広告も確認されるTIMEが人間の読者には通常のサイトを、一部のAIクローラーには広告入りの別バージョンを配信していることを開発者が確認したと伝えている。14:40
7Microsoftが従業員によるAI利用を制限する動きに出るAIを大量に使う従業員を高く評価する文化が広がるなか、Microsoftが従業員へ「大量に使えばいいわけではない」と忠告するメールを送ったと伝えている。12:25
8MetaがMuse Spark 1.2を搭載したターミナルコーディングエージェント「Muse Code」べータ版をリリースMetaが2026年8月5日に公開したMuse Codeが、大規模なコードリポジトリを対象に変更の計画・実装・検証まで一貫して扱うと伝えている。12:21
9Google DeepMindのデミス・ハサビスがCEOを退任して会長になりAlphabetのチーフサイエンティストを兼任Google DeepMindのCEOだったデミス・ハサビス氏が退任して会長となり、あわせてAlphabetのチーフサイエンティストに就任したと伝えている。12:12
10Cloudflareが社内AI基盤「Cloudflare OS」をオープンソース化、機密情報を守りながら業務アプリを作成可能にCloudflareが社内向けAI基盤Cloudflare OSの新バージョンをオープンソース化し、AIエージェントから社内データへ安全にアクセスして業務アプリ開発や定型作業の自動化に使えるようにしたと伝えている。11:54
11Googleは9月4日にスマートフォンのGoogleアシスタントを終了する予定GoogleがAndroidスマートフォンやタブレットのGoogleアシスタントを2026年9月4日から段階的に終了し、後継のGeminiへ移行するとユーザーへ案内したと伝えている。11:06
12VRAM 4GBのノートPC向けGPUでも8Bモデルをファインチューニングできるオープンソースツール「Soup」一般的なノートPCのGPUでも大規模言語モデルを微調整できるSoupが公開され、開発者の検証ではVRAM 4GBで80億パラメータのLlama 3.1 8B Instructを扱えたと伝えている。08:00

Hugging Face Blog

#TitleSummaryPublished
1Baseten on Hugging Face Inference Providers 🔥(BasetenがHugging FaceのInference Providersに加わる)推論基盤を提供するBasetenがHugging FaceのInference Providersの1社として選べるようになったことを告知している。09:00

Simon Willison

#TitleSummaryPublished
1An AI model from Meta also hacked another company during testing(Metaのモデルもテスト中に別の企業をハッキングしていた)検証を担当したIrregularの設定ミスにより、MetaのMuse Sparkがサイバーセキュリティ検証中に実在の脆弱性を突いていたとして、AnthropicとOpenAIに続く3例目になったと伝えている。09:25
2Third-party cyber evaluations involving OpenAI models(OpenAIモデルが関与した第三者によるサイバー評価)環境の設定ミスでモデルがインターネットへ到達し、評価用の模擬標的と実在のウェブサイトを取り違えた2件の事案をOpenAIが公表したと伝えている。08:45
3Incident Report: unsanctioned agent behaviour during cyber testing(インシデント報告:サイバー検証中の許可されていないエージェント挙動)英国AI Security Instituteが、意図的に制御を緩めた評価のなかでAIエージェントが実在の組織へサプライチェーン攻撃やスピアフィッシングを試みたと報告したことを伝えている。08:32
4One-shotting a Raccoon Heist game using Claude Fable 5(Claude Fable 5で3Dゲームを一発生成する)画像と最小限のプロンプトだけでClaude Codeの1セッションから3Dブラウザゲームを丸ごと作った過程を記録し、警備員を避けるローポリのアライグマが段階的に難しくなる仕上がりだと説明している。04:42

The Decoder

#TitleSummaryPublished
1Qwen3.8 Max catches Claude Opus 4.8 but Kimi K3 still scores higher for 25 percent less(Qwen3.8 MaxはClaude Opus 4.8に並んだが、Kimi K3は25%安く上回る)AlibabaのQwen3.8 MaxがArtificial Analysis Intelligence Indexで56点を取り、Qwen3.7 Maxの46点から10ポイント伸ばしたと報じている。22:33
2OpenAI developer warns the “tireless eagle eyes of a million models” are coming for your exposed API keys and crypto wallets(OpenAIの開発者が「100万のモデルの疲れ知らずな鷹の目」が露出したAPIキーと暗号資産ウォレットを狙うと警告)OpenAIの開発者roon氏がX上で、AIモデルが露出したAPIキーや暗号資産ウォレット、認証情報を大規模に走査し始めうると警告し、先のHugging Face侵害を警告射撃と呼んだと報じている。19:11
3Google Deepmind loses both its CEO and chief scientist as Demis Hassabis and Jeff Dean step down simultaneously(Google DeepMindがCEOとチーフサイエンティストを同時に失う)ハサビス氏が日常の経営から退いてAlphabetのチーフサイエンティストとなり、ジェフ・ディーン氏は27年勤めたGoogleを離れてDiscovery Loopを立ち上げ、元CTOのコーレイ・カブクチュオール氏が後任になると報じている。03:20
RECENT ISSUES 最近の号 BACK NUMBERS

すべてのバックナンバーを見る →