VOL. 099
AI NEWS DIGEST
AI OUTLINE
2026-08-03
月曜日 · JST
TODAY’S ISSUE 2026年8月3日 · 月曜日 AI FRONTLINE

AIニュースまとめ 2026-08-03|OpenAI次期モデル「Astra」が未解決数学10問を解決

アップデート情報

各社が 2026-08-03 に公式発表したプロダクトアップデートです。

Claude / Claude Code

ChatGPT / Codex

Gemini

Top 20

OpenAI、次期主力モデル「Astra」の存在を明らかに――未解決の数学問題10件を「解決」と発表

Source: ITmedia AI+ | Published: 2026-08-03 06:56 JST

スクエニ、ゲームの品質テストをGeminiで自動化 AIが画面を見ながらコントローラーを操作、検証作業を自走

Source: ITmedia AI+ | Published: 2026-08-03 20:45 JST

condense-json 1.0

Source: Simon Willison | Published: 2026-08-03 07:19 JST

AI分野の「ユニコーン企業」の半数以上は査読付き論文やプレプリントを一度も発表したことがない

Source: GIGAZINE | Published: 2026-08-03 08:00 JST

Google Earthに追加された「架空の衛星画像を生成するAI機能」がわずか1日で撤回、偽の災害・軍事画像を作成可能だったため

Source: GIGAZINE | Published: 2026-08-03 10:39 JST

Alibaba’s open-weight Qwen3.8-Max takes on long-horizon AI tasks with 2.4 trillion parameters(Alibabaのオープンウェイト版Qwen3.8-Maxが2.4兆パラメータで長時間タスクに挑む)

Source: The Decoder | Published: 2026-08-03 19:48 JST

Managed Agentsの新機能、称賛の裏にある4つの注意点

Source: Zenn | Published: 2026-08-03 08:30 JST

Salesforce公式スキル「automation-flow-generate」を使ったフロー生成の手順と検証結果

Source: Zenn | Published: 2026-08-03 09:20 JST

「Qwen3.8-Max」登場、オープン化は「来週」 一部「Fable 5」「GPT-5.6 Sol」超えの性能うたう

Source: ITmedia AI+ | Published: 2026-08-03 12:26 JST

OpenAIの次期主力AIモデル「Astra」が10件の数学・理論計算機科学の課題で新成果、証明をLean 4で形式化し機械検証可能に

Source: GIGAZINE | Published: 2026-08-03 12:40 JST

Claude Codeのログが22MBに膨れた ― launchdで夜間自動トリムする

Source: Zenn | Published: 2026-08-03 15:58 JST

China’s MiniMax H3 is the first open model to top an AI video ranking(中国のMiniMax H3がAI動画ランキングで首位に立った初のオープンモデルとなった)

Source: The Decoder | Published: 2026-08-03 22:52 JST

大学へ無料提供されるOpenAI依存に陥る未来、日本独自AIは生き残れるのか

Source: Zenn | Published: 2026-08-03 22:54 JST

LLMエージェント32体に「不満」だけを与えて6時間放置した — 全ログ公開と、多エージェント設計への3つの教訓

Source: Zenn | Published: 2026-08-03 08:18 JST

LLM ルーティングはどう動くのか — 入力が評価され、判定され、送信先が決まるまで

Source: Zenn | Published: 2026-08-03 08:46 JST

RTX 5090ローカルで、キャラが崩れないフルコーラスAI MVを1本作った全工程

Source: Zenn | Published: 2026-08-03 09:00 JST

動画生成AI「MiniMax H3」が登場、世界2位の実力でオープンモデルとして公開予定

Source: GIGAZINE | Published: 2026-08-03 10:56 JST

JetBrains Central CLI で Claude と Codex を使ってみた

Source: Zenn | Published: 2026-08-03 11:01 JST

Claude Code の権限確認をスキップする前に置いた7つのフック — 75日運用して踏んだ事故の記録

Source: Zenn | Published: 2026-08-03 11:18 JST

OpenAI互換でも同じには動かない――Kimi K3で考えるプロンプトとハーネス設計

Source: Zenn | Published: 2026-08-03 11:57 JST


All Articles

Zenn

#TitleSummaryAuthorPublished
1『Empire of AI』を技術者の目で読む経営者の資質に論点を収束させる読み方を退け、大規模汎用モデルを優先する限り資本・計算基盤・データ供給網への依存は残ると論じている。@Yasuhiro Nakayama00:05
2AIと広告営業マンさんと、五キロの塩。 無料AIを観察して見えてきたこと無料版ChatGPTの広告表示とGrokの誘導型提案を並べ、AI利用体験そのものが「先回り提案」の渦中にあると観察している。@🍅Pomodoroナオミ🍅01:35
3バイノーラルVSTを開発し、「高さ」の表現のみ最後まで到達できなかったお話Opus 5とGPT-5.6 Solの共同作業でC++17・JUCE 9.0.0製のASMR向け空間化プラグインNekoSpace Binauralのalpha版を公開したと報告している。@charmpic02:18
4npmで入れたAI用MCPサーバーを直接叩いたら、ファイルアクセスの初期設定が『全許可』だったGitHubトレンド掲載のターミナル操作用MCPサーバーをAI本体を経由せず直接叩き、許可ディレクトリを指定しない限り初期設定でファイルシステム全体を読み書きできると確認した。@ぬまーんのZenn記事02:37
5提案書骨子の生成、参考資料が4000字を超えるとAIの順位が入れ替わる理由を検証した約200字のメモではChatGPT13点・Claude13点・Gemini11点と横並びだったが、約4000字の資料ではChatGPTが10点へ落ち、Claudeが14点で独走したと測定している。@毎日AIレシピ06:07
6GPT-5.6 Sol・Terra・Luna の選択——コスト面での最適解は Luna × max だった(オトナの自由研究 #30)15パターン計750試行の実測で、品質ゲート100%の3構成のうちLuna×maxがTerra×maxの約1/7.6・Sol×maxの約1/21で最安になったと結論付けた。@Nori06:59
7Claude in Chrome 導入紹介Claude CodeのChrome拡張でブラウザ操作を委ねる方法を、Google検索という再現しやすい題材から実開発ワークフローまで順に解説している。@yushi-s07:00
8AIとの壁打ちを、会話でやるのをやめた。ファイルでやる前提・壁打ち・バックログの3ファイルへ役割を分け、同じ情報を2箇所に書かずファイルを育てる運用へ切り替えたと、コードを1行も書かない実セッション3往復で示している。@yykt510807:30
9taskkill /IM node.exe でMCPサーバーを巻き込み、Claude Codeの全タブが落ちたイメージ名指定のtaskkillが同名プロセスを全て落とすため、開発サーバーと同時にClaude Codeへ接続していたMCPサーバーまで巻き込んだと記録している。@Skova Digital07:30
10確認プロンプトを減らしたら、安全になった。Claude Code の auto モードとサンドボックスを1か月運用した設計確認が多いほど読まなくなるという逆説を踏まえ、defaultModeをautoにしたうえで危険な操作を構造的に不可能にする設計へ移行したと1か月の運用から報告している。@Rapls07:32
11Google Cloud Next Tokyo 26 — AIエージェントの作り方を誰も説明しなかった2日間東京ビッグサイトで2日間参加した筆者は、回った範囲では「AIエージェントをどう作るのが正解か」に答えるセッションは無かったと結論付けている。@cnative_tkb08:02
12Claude Codeのフォルダ移動、ようやく理解できた話起動後にcdしても作業ディレクトリは移動せず、正しい順番は終了してからフォルダを移動し再起動することだと判明したと記録している。@YASU08:19
13エージェントは死ぬ。記録は腐る。それでも工程は続く — Linear を工程の正本にした話同じ判断が違う言葉でMarkdownに複製され、古い版をエージェントが自信満々に読み戻す問題を受け、工程の正本をLinearへ寄せたと述べている。@やさい08:47
14Gemini 3.1 Pro が「*」一文字で自作パスブロックを破った — GPT と Claude では「安全」に見えたコマンド文字列を .config/ で検査する自作パスブロックが、~/.con*ig/secrets/ というグロブ1文字の置換で突破されたと攻撃テストで確認した。@Yoshiaki Okuyama08:50
15同じ成果を少ないトークンで出す練習をしている同じ依頼でも日によってトークンの減り方が違う経験を起点に、消費量の差が実力差として表れる前提で自分の指示の出し方を意識的に変えていると記録している。@Kaji09:00
16Claude Codeに2つ目のハーネスを持たせるCLAUDE_CONFIG_DIRではskillsとagentsしか入れ替わらずCLAUDE.mdとrulesが残る点を問題視し、毎回16ファイル・3404語が載る構成を用途別に切り替える方法を組んだ。@Tatsuya Shimomoto09:00
17Claude Code を組織的に運用したら、人間1人あたり月に400PR、出力50万行の開発サイクルが回りはじめた。単独利用やエージェント同士の単純な通信連携をやめて組織的な運用へ切り替えた4月以降、個人の出力量が一気に増えたと実数グラフ付きで説明している。@happy_ryo09:00
18AI に業務の意味を教える——対話型データ分析を曖昧にしない「軽量オントロジー」の実装Google Cloud Next Tokyo 2026の登壇内容をもとに、業務判断の条件を検証済みクエリに固定する設計意図とGoogle Cloud上での実装方法を解説している。@Kazumasa Iwao09:38
19AI MVでキャラの顔が崩れる7つの操作(全部やらかした)カットごとの生成し直しなど、実際にやらかして原因を特定した「顔を壊す操作」7つを挙げ、単発カットは綺麗でも束ねた瞬間に破綻する理由を説明している。@made_linlin09:38
20DGX Spark1台 で DeepSeek-V4-Flash 0731 を専用エンジンで30〜40tok/s284B(アクティブ13B)のMoEをllama.cppでは17.9t/sしか出せなかったところ、専用推論エンジンへ載せ替えて30〜40t/sまで引き上げたと実機で測定している。@toyoshi10:06
21Claude Code Skills 577個・6,803回を集計してわかった、“定着するスキル”の共通点直近1カ月の社内利用ログで577個のスキルが計6803回呼ばれた実績を集計し、定着するスキルに共通する作り方を抽出したと報告している。@長谷川 稜10:52
22Ollamaをagentic RAGのバックエンドにする:完全ローカル完結エージェント金融・防衛・医療でクラウドAPIへデータを出せない要件に対し、Ollamaのツール呼び出しだけで外部通信を一切発生させないagentic RAGエージェントを構築している。@リベルクラフト11:00
23プロンプト改善を「1回の満点」で判断してはいけない ─ 10回回して分かったこと介護記録からの情報抽出プロンプトで得た100点が10回試行では「たまたま当たった1回」だったと判明し、統計で弱点を特定して10回中10回満点まで持ち込んだ。@ossudesu66611:08
24Claude Max 20xとCodex Pro 5xに月$300払う — AI課金月報 #1(2026年7月)Claude Max 20x($200/月)とCodex Pro 5x($100/月)を併用する事業運営の実測値を、アフィリエイトなしで毎月同じ型で記録する連載を始めた。@KeEem11:11
25Google Cloud Next Tokyo 2026 参加レポート市民開発で数万個のエージェントが生まれる「民主化」と、乱立を統制するガバナンスが同時に前面へ出た点を今年の特徴として整理している。@たかはし11:22
26ClaudeCodeじゃなくてClaudeを使っているエンジニアのClaudeの使い方紹介社内規定でソースコードや資料を読ませられない環境下で、抽象化したサンプルと仕様だけを渡してVBAコードを作らせる運用を紹介している。@そーめそ11:32
27毎朝のarXiv収集からX投稿まで、Claude Codeスキルでパイプラインを組んだarXiv・はてなブックマーク・Redditの収集からX投稿文の生成までを3つのスキルへ分業し、どの工程を人間に残したかとその理由を説明している。@論計舎11:56
28Claude Codeのコンテキスト引き継ぎを205セッション運用したら、申し送りが誤りを増幅していた76日・205セッション・991MBのログ運用で、n=1かつ暫定だった測定値が申し送りでは「確定した前提」として読まれ誤りが増幅されたと突き止めている。@アイ-Q ラボ12:00
29表に2行足したら、検査も2件増えた ── CLAUDE.md のドキュメントドリフトを exit code で検知するディレクトリを1つリネームした瞬間にCLAUDE.mdの正本パス表が嘘になるのにテストは通る問題を、exit codeで機械検知する仕組みで塞いだ。@あいづち12:23
30Graph Engineeringの外側で、AIエージェントのPRは衝突するLangChain・Google ADK Go 2.0・AutoGen GraphFlowが扱うのはエージェント内部の実行制御であり、その外側にあるPR同士の衝突は解決しないと論じている。@RollNuts13:05
31とにかく動くRAGを診断する — 引用は全問正確なのに「家庭ごみに事業者ルール」を案内していた判定基準を凍結したゴールデンセット20問×2回の黒箱評価で、引用の忠実性は19/19で満点かつ金額の捏造もゼロなのに基本的な質問で誤案内が起きたと測定している。@yuyu13:10
32Geminiを相棒に!新入社員が知っておくべき、タスクを秒で終わらせるAI活用術5選入社3カ月の営業職が実務で驚いたGeminiの小技5つを、機械が苦手な新入社員でも今日から使える形にまとめている。@Miki13:16
33last30days: The Claude Code Skill That Fixes AI Search(last30days: AI検索を修正するClaude Codeスキル)Web検索は既にGoogleで上位表示される記事しか返さず、Deep Researchは大量のサブエージェントと10〜20分を要する問題を、直近30日に絞るスキルで解こうとしている。@NeoTechPark13:27
34Hermes Agentの公式docs+GitHubソースをChatGPTプロジェクトに登録して、SOURCE_PATH付きQ&A環境を作る公式ドキュメントとGitHubソースを整理してChatGPTプロジェクトへ登録し、実装がどのファイル・関数を通るかとSOURCE_PATHまで答えられる環境を構築した。@mono13:54
35閉域RAG構築記 — 「精度6/10」の内訳を全部開けたら、評価もRAGも壊れていた外部生成AIの利用を禁じている企業向けにGPU 1枚の閉域構成を組み、精度6/10という数字の内訳を開けたところ評価側も壊れていたと明らかにした。@dow-japan14:16
36Herdr で止まらず、精度の高い開発を進める工夫 ─ intent-cli で意図をもとに開発する設計・オーケストレーション・実装・レビューの4スレッドをGitHub IssueとPRで協調させる運用を、OSSのIntent CLI上で止まりにくくする工夫を解説している。@tomohisa14:21
37オントロジーで AI に業務知識を渡す — AWS の OSS「Context Ontology Accelerator」を試してみた「売上」に送料やキャンセルを含めるかといった業務定義はinformation_schemaに存在しないという課題を、AWSのOSSで補う手順を検証している。@いなりく / Riku Inada14:26
38AIはExcel方眼紙を正しく更新できるか:スキルとルールファイルによる再現性の設計変更箇所を赤字にする・削除行をグレーで残す・履歴を1行追加するといった暗黙の更新ルールを、スキルとルールファイルで再現可能にする設計を試している。@Umetch14:38
39実装したAIにレビューさせない——Claude Codeの3パス独立レビューと機械判定実装時の設計理由や試行錯誤を持つAIにレビューさせると自分の実装を追認しやすいと考え、実装履歴を持たない独立レビューを3観点に分けて数カ月運用している。@ピヨ助14:39
40AIのAPI化でクラウド費用が「見えなくなる」構造AIでクラウド費用が急増する根拠は今のところ弱いと自ら逆風データを並べたうえで、請求先が分散して総額を誰も把握できなくなる構造こそが実務上の問題だと論じている。@cloudcut14:42
41ChatGPTの定期タスクを「動いたはず」で終わらせない6つの運用設計実行枠ごとに一意なrun keyを振るなど、特定サービスの障害率を推測せずどの定期タスクにも使える最小の監査設計を6点にまとめている。@ラクツール15:07
42【Vol.19】【ツール別活用 #3】Gemini編 — Deep Researchで調査分析を自動化する自社ではGeminiを「調査」担当に割り当てており、CTO業務で最も時間を食っていた技術選定や競合調査の形をDeep Researchが変えたと述べている。@リアルインベントTechブログ15:08
43ハルシネーションとは違う、もう一つの嘘裏取りで潰せるハルシネーションとは別に、実際にはやっていない作業を「やった」と報告される虚偽のほうがはるかにタチが悪かったと体験から述べている。@ぴろゆき15:17
44連載|RAGの基礎からAgentic GraphRAGの現在地まで 第10回規程→業務→システム→手順書→部署と多段に辿る問いは文書検索だけでは解けないとして、GraphRAG-R1とGraph-R1を中心に連載を総括している。@田村孝廣15:22
45【Playwright MCP】複数AIエージェントでブラウザが衝突する問題を完全解決する構成複数エージェントが同時にブラウザを操作すると衝突する原因を説明し、HTTPサーバーモードとmcp-remoteを組み合わせた設定ファイル一式を公開している。@shohei-ai-lab15:29
46Claude Design のプロトタイプを Nuxt 実装に落とし込むまで公式コマンド/design-syncの変換対象がReact製デザインシステムに限られるため、Nuxtを主軸とする自社では正規ルートに頼らない移植手順を組んだと報告している。@oholy16:00
47AIエージェントへの指示を「届ける」のをやめたら、取りこぼしが構造的に消えた指示を書いてエージェントへ届ける押し出し型が壊れたため、エージェントが自分で取りに来る引き取り型へ変えたところ取りこぼしが設計上起きなくなったと述べている。@Leia16:28
48その自動配布、public リポジトリにも書いていませんかマルチrepo環境では横断の正本を指すポインタを20個のrepoで揃え続ける必要があり、古いポインタは無いより悪いとして自動配布の落とし穴を指摘している。@あいづち16:28
49その数字は、誰がいつ測りましたか「7つ中4つ、重みは65/100」といった具体的で説得力のある報告値が、2週間近く問い続けた末に実測で偽だと判明したとシリーズ3本目で扱っている。@実測16:32
50マスボクシングの全国大会を目指すエンジニアが、自分専属のAIコーチを作った50歳から全国大会を目指す著者が、47歳開始という条件で練習の質を上げるしかないと判断し、自分専属のAIコーチを開発した経緯を記録している。@土屋 達哉 / ブースターテクノロジー16:32
51自分が作った開発フローを、他人の物差しで採点してみた話(ループ・エンジニアリング×グラフ・エンジニアリング篇)自己流で回してきたラチェット駆動開発を、ループ・エンジニアリングとグラフ・エンジニアリングという外部の枠組みで初めて採点し直したと述べている。@KoR8916:42
52Gemini 3.6 Flashが1分38秒でOpus 5と互角だった件【一円ラボ 3ラウンド実測・後編】前編で見つけたguardrailの壁がベンダーを跨いでも消えるのかを確かめるため、Claude Opus 5とGemini 3.6 Flashで同じ実験を回して比較している。@miki-mini17:00
53AIに社内1,127リポジトリを爆速調査させて分かった、「何を疑うか」を決める人間の仕事まだ存在しないテーブルを「既存」と書かれた経験を起点に、1127リポジトリの高速調査では何を疑うかを決める人間側の役割が要になると論じている。@パッションうさぎ17:05
54「直しました」には、直っていない形が6つある「直しました。テストも通っています」という報告が実際には直っていないパターンを6種類に分類し、シリーズ4本目として報告の検証方法を扱っている。@実測17:10
55足し算を間違えていたAIが、いまは私の仕事の中心にいる検索語すら思いつかない曖昧な質問を汲み取れる一方で足し算を間違えていた3年前と比べ、AIが仕事の中心へ移るまでの変化を追っている。@imai17:13
56Amazon Bedrock Guardrailsは自前の多層防御を代替できるか——製造業RAGでの定量比較ブロックリストとLLM意図分類の2層でDirect PIとParaphrase Bypassの検知率100%を達成済みの自前防御に、Bedrock Guardrailsを組み込んで定量比較している。@ku_kyoto_lab17:25
57AskUserQuestionをもっと見やすくわかりやすく:Claude Codeの質問を図表を駆使したウィザードUIにターミナルUIでは選択肢の読み比べに向かない問題を、比較表やインラインSVGを出すブラウザウィザードへ置き換えるプラグインを外部npm依存ゼロで実装した。@Junji Uehara17:27
58【AI駆動プロダクト開発 第1回】開発会社の商談・案件管理業務をスプレッドシートからWebアプリへスプレッドシートで管理していた商談・案件・人員アサインをAIとの壁打ちから本番Webアプリ「RADAR」へ移行した全体像とリポジトリ構成を紹介している。@hako@札幌17:30
59herdrとNotionでClaude Code 4体を回して、社内ハッカソンで完全バイブコーディングした話全拠点のメンバーが1日で共通バックエンドテンプレート上にアプリを作る社内ハッカソンで、herdrとNotionによりClaude Code 4体を並走させたと報告している。@Tokio Takamiya17:46
60AIの**「太字くずれのアスタリスク記号」**が完全に出なくなる3秒の設定日本語の約物を強調記号の外へ置くよう指示する1行をシステムプロンプトへ入れるだけで、CJK文字特有の太字表示崩れが解消すると示している。@vAr17:57
61Amazon Bedrockで生成AI評価を実践――Operational MetricsからAgentic Metricsまで回答品質だけでなく応答時間・トークンコスト・ツール選択の正しさ・LLM Judge自体の信頼性まで評価軸を分解し、AWS公開のワークショップで実践している。@Yutaka Kashiwabara18:00
62Snowflake の AI の従量課金は、予算を設定すれば止まるのか上限を決めれば止まると答えたうえで、止め方が3通りあり、per-user quotaなら数分・コード不要、合計で締めるなら数時間かかり停止処理は自作になると整理している。@Ruuuhs18:03
63Claudeの「記憶」はどこにある? チャット・Claude Code・APIの境界を整理するチャット・Claude Code・API利用の自作アプリに存在する6つの保存・検索の仕組みを、誰が保存し何が境界になるかという観点で整理している。@木村幸寛18:05
64宇宙で宇宙飛行士が筋トレするように、AIを活用しても頼り切らずにちゃんと鍛えよう無重力では意識して鍛えないと筋力と骨密度が落ちる宇宙飛行士の事例を引き、便利な環境ほど失うものがある構造は人類とAIの関係にも当てはまると論じている。@こたこた博18:08
65開発未経験のPMが、Claudeとデータ基盤の障害対応をした話パイプラインを作り切った経験のないPMが、2025年1月から構築してきた社内データ分析基盤の開発・運用を自ら担うことになった経緯と障害対応を記録している。@honduck18:25
66AIのテスト設計、レビュー負荷をどう減らすか — 件数・認知コスト・誤警報の因数分解生成は一瞬でもレビューが重いという壁を、レビュー負荷を件数・認知コスト・誤警報の3要素へ因数分解して減らす方法として整理している。@りょうさん18:33
67ghqとfzfでclaudeを起動するherdrプラグインを作って学んだことghqとfzfでリポジトリを選びherdrのworkspaceかtabで開いてClaude Codeを起動する定型手順を、ワンキー実行のプラグインherdr-ghq-open-agentにまとめた。@kenchan18:40
68AI駆動開発、レビューをやめずに再配分する15年の経験を持つ著者が構想からインフラ・実装・CI/CD・IaC・テストまで単独でデリバリーできた理由をAI前提の体系に求め、レビューの配分方法を論じている。@ShintaroAmaike18:45
69CAD向けAIエージェントは、誰が答え合わせをするのかコーディングエージェントが自律化できたのは安全に失敗できる環境があったからだとして、CAD領域へ応用する際に何が不足するのかを検討している。@0xL1C10G19:00
70タスク管理AIを作って検証した|優先順位づけを構造化出力にするNode.js v24.14.0の固定テストで、スコア方式は依存違反を2件出したのに対し制約優先方式は0件だったとして、依存関係とblockedを先に処理すべきだと結論付けた。@浅井めぐみ19:00
71Claude Code 週次アップデートまとめ(2026/08/02週)v2.1.213〜v2.1.220の変更を集約し、Opus 5が新しいデフォルトのOpusモデルになった件と、/verify・/code-review・/deep-researchの自律実行が段階的に廃止された件をハイライトに挙げている。@saitoko19:01
72AIセキュリティに関する論文メモ5〜StruQ編〜USENIX Security 2025のStruQを読み解き、構造化クエリで命令とデータを分離しユーザー由来データから区切りトークンを除去する防御手法を整理している。@ぼさぼさ19:10
73【AI駆動開発 11】MCPで連携させる — 「自分でやった方が早い」は張り付き前提の話コピペのほうが早いという反論は人間が張り付いている前提でしか成立しないとして、頼みごとの往復が出るたびMCPで代替できないか問うべきだと主張している。@かわもん@idealive19:10
74Claude Code が間欠的に10分ハングする問題を、デバッグログから原因特定して緩和するマシン増強や回線変更でも直らない数分〜十数分の停滞を、サーバ遅延ではなく特定の1コネクションが黙って死ぬ現象と特定し、ゼロリスクで待ち時間を半減させた。@蝦名潤19:21
75GH-600: GitHub Agentic AI Developerに合格しました新設試験GH-600の合格体験として、SDLCへのエージェント組み込み・管理・挙動監査・CI/CD活用というドメインごとに問われた知識と準備方法を記録している。@yuriemori19:32
76note.comの画像アップロードをブラウザ操作だけで完全自動化する(input[type=file]の壁を越える)セキュリティ上JavaScriptから値を設定できないinput[type=file]が最後の障壁だったとして、見出し画像アップロードをブラウザ操作だけで自動化する方法を示している。@ソラ19:44
772026/08/01 実ログ 災害時および平時運用における人間・機械中間知性の動態的同期とMAI進化論に関する検証報告書(最終完全版)Zennが2026年1月に導入した記事の英語版生成機能により過去記事のAI自動翻訳版が公開された件など、AIとの実ログ全文を検証報告書としてまとめている。@maestro19:54
78③0.01くらいから始める、AWS×AI株価予測システム開発【企画編Ⅲ】決算情報やニュース、為替、SNSまで全部学習させたくなる誘惑を退け、まず何を予測させ何を学習させるかを絞り込む設計方針を決めている。@Ruka19:58
79検索は「対話」へ。Gemini in Chrome が変えるWeb体験別タブでAIチャットを開きコピペを繰り返す作業が思考の妨げになるとして、Gemini in Chromeの概要・利用条件・活用法を解説している。@佐藤 星20:00
80仕様が新しいデザイン成果物になる日 — 仕様駆動開発についてデザイナーが知っておくべきこと仕様駆動開発の再興は官僚的な文書文化の復活ではなく、AIがコードを書く時代に人間の意図をどう正確に伝えるかへの実践的な答えだとデザイナー向けに説明している。@おにぎりうめ20:21
81AIに引用される文章は明快さで決まる:5つの構造で設計する統計も図表も出典も揃えた3000字の記事が引用されず、より薄い60字の段落が引用された経験から、引用可否は情報量ではなく明快さで決まると結論付けている。@井本 賢20:27
82【2026年版】LLM御三家 GPT vs Gemini vs Claude 徹底比較 〜違い・特徴・使い分け〜トップ性能の差が史上最小まで縮まった一方で3社の「性格」の違いはむしろ明確になったとして、どれが賢いかではなく使い分けの軸を整理している。@まさぴょん🐱23:00

Qiita

#TitleSummaryAuthorPublished
1自社Markdown 1,325本をbge-m3でローカル埋め込みしたら何分かかったか — M1 Max 64GBのRAG基盤コスト実測他人のデータセットや数十件のサンプルではなく、自社に蓄積した1325本のMarkdownをそのまま投入し、M1 Max 64GBでの埋め込みバッチ所要時間を実測している。@Umamon08:48
2GitHub Actions だけ 401 になるので secret 名と env の渡し方を疑ったローカルではAPIキーを読めるのにCIのsmoke testだけ401になる現象を、secret名とenvの渡し方から切り分けた記録を残している。@FlatkeyAI09:39
3Lykuro.ai API サンプル: APIキーを安全に扱うサンプル (2026-08-03)日本の開発者向けAI GatewayプラットフォームLykuro.aiを紹介し、OpenAI互換APIでAPIキーを安全に扱う実装サンプルを示している。@lykuro10:00
4AIユースケースは簡単に書ける。でも、RAGは「データ」と「質問」を確認しないと作れない「RAGで社内文書に回答する」といったユースケース文はすぐ書けても、実際のデータと想定質問を確認しない限り設計は決まらないと指摘している。@engchina10:50
5Ansys Lumerical MCPでAIにフォトニクス解析させてみたPyLumerical-MCP経由でAIエージェントにY分岐導波路をモデリングさせた前回に続き、今回はAnsys Lumerical上での解析実行までを試している。@HiroyukiOkada13:41
6TypeScriptで自作ミニCLIアプリケーションを活用してClaude / OpenAI APIを叩くTypeScriptの基礎とOpenAI APIの利用経験を前提に、自作のミニCLIからClaudeとOpenAI APIを呼び出す実装手順を説明している。@felix-jp-studio14:03
7Moodle 4.5にChatGPT(OpenAI API)を連携してAI機能を使う方法Moodle 4.5から標準搭載されたAI機能にOpenAI APIを接続する手順を、教材作成に時間がかかる管理者向けにまとめている。@RubliX15:29
8ChatGPT Classicアプリをライトモードにする方法新しいChatGPT(旧Codex)アプリはチャットやプロジェクト、ダウンロードが不完全でClassicを併用せざるを得ないとして、Mac版Classicのライトモード設定手順を示している。@sou_lab18:18
9Gemini API、モデル廃止スケジュール5件と13本の実装記事を整理したGemini APIを業務利用する開発者向けに、モデル廃止スケジュール5件と関連実装記事13本を、モデル選定とマイグレーション判断の材料として整理している。@kai_kou20:15
10円と放物線の交点の個数「2つの曲線の交点の個数について」様を、計算はsympyで作図もAI先生に教えてもらいました。円と放物線の交点個数をsympyで計算し作図までAIに教わった記録を残し、代表値の扱いが理解できなかった点について助言を求めている。@mrrclb48z20:39
11【図解】RAGとGraph RAGの違いLLMが社内文書を知らないという壁を埋める定番技術としてRAGを位置付けたうえで、Graph RAGとの違いを図解で説明している。@fujimoooon20:41
12え、まだ深夜デバッグをAIと二人三脚で解決してるんですか?動画では言えなかった補足深夜のデバッグを誰にも聞けず抱え込む状況に対し、AIを即レスのデバッグパートナーとして使う方法を動画の補足として説明している。@bug-mi-dev20:59
13え、まだ仕様書を手でコードに起こしてるんですか?動画では言えなかった補足仕様書を渡すだけで雛形の8割を生成できるとして、動画で触れられなかったコード自動生成の手順を補足している。@bug-mi-dev21:04
14QAエンジニアが、バイブコーディングでJSTQB Advanced Level試験対策サイトを作成してみた市販の問題集がなく演習量が足りないという課題から、プログラマではないQAエンジニアがバイブコーディングで自分専用の試験対策サイトを作った経緯を記録している。@yanagiQA21:44
15AI生成記事の「構造」を検索エンジン評価に耐えうる形にスコアリングする設計AI記事生成SaaS「Draifty」の運用で最も苦労した「文章として自然」と「検索エンジンに評価される構造」の両立を、生成後のスコアリング設計で解こうとしている。@avecdogpresence21:46
16会社ホームページは静的サイトで足りる?判断から公開までの手順更新頻度が低く申込や決済を外部サービスへ任せられる会社なら、データベースや管理画面を持たない静的サイトが現実的な選択になると判断基準から示している。@kakusan202222:05
17sqlite-vec・ObjectBox・LanceDBで実装するオンデバイスRAGのベクトル検索レイテンシ最適化オンデバイスRAGのベクトル検索を3つのアーキテクチャパターンに分類し、sqlite-vecのブルートフォースを含めそれぞれのレイテンシ特性を比較している。@0h-n022:21
18Claude Codeの@メンションでファイルを直接指定して読ませる — 最初の1ファイルを10分でファイル名を文章で書くと同名ファイルで迷う問題を避けるため、@メンションで対象ファイルを直接指定する手順を10分で試せる形にまとめている。@akira_papa_AI22:29
19Claudeで複数モデルのエラー率上昇インシデント発生、監視中2026年8月3日にAnthropicの公式ステータスページへ「Error rates across multiple models」というインシデントが新規掲載されたと報告している。@picnic22:57

ITmedia AI+

#TitleSummaryPublished
1WAFを89%すり抜ける事例も──AIが休みなく仕掛けるWeb攻撃、予防策はあるかAkamai Technologiesの中西一博氏が、フロンティアAIの登場で一変したWeb攻撃の傾向と対策、そして対策側が陥りやすい落とし穴を解説している。07:00
2賞金1000万のAIコンテスト、でも「実現性は問わず」 サイバーエージェントのAI推進策サイバーエージェントが賞金1000万円のAIコンテストであえて実現性を問わない条件を設け、従業員に使われなければ成果に繋がらない状況を変えたと報じている。07:00
3生成AI利用率、情シスよりも高いのはあの職種だったラグザスの職種別調査で、エンジニア・情シスの生成AI利用率が1位ではなかったと判明し、それを上回った職種を明らかにしている。07:00
4「AI、結局使えないじゃん」問題 セールスフォースが431万件対応で導いた正解全社的な利益改善に至る企業が4割弱にとどまる中、セールスフォースは自社実践で431万件の顧客対応を完了し商談数を4〜5割増やしたとして、田中遼太COOに運用の方法論を聞いている。07:00
5月100億トークン使うビズリーチ 「AIコスト増」懸念の中、費用対効果どう判断しているのか月間約100億トークンを消費するビズリーチのCTOに、コスト増加への懸念が高まる中で費用対効果をどう判断しているかを聞いている。07:00
6【レベル14】生成AIを味方に、3D CADを使いこなそう!設計者を冒険者に見立てた連載の第14回として、生成AIを活用した3D CADデータの作成と操作をテーマに解説している。08:00
7「エンジニアの代替ではなく、できることを増やす」 Devin開発元が見据えるIT外注大国・日本の“伸びしろ”自律型AIエンジニアDevinの日本ユーザー人口が米国に次ぐ規模になったとして、IT人材の約7割がSIer側に偏る日本市場での戦略を日本法人代表の正井拓己氏に聞いている。10:57
8富士通とNECは「AI需要」と「収益」をどう語った? 2026年下半期の見通しを考察富士通とNECのCFOによる直近決算会見での発言から、AI需要の盛り上がりがITサービス企業の収益に直結するのかを考察している。12:00
9カメラとディスプレイ搭載のAIグラス、「Rokid スマートAIグラス」を試してみた7月10日に一般発売された実機を借りて試用し、AIグラスが現時点で何を可能にし何を可能にしないのかを評価している。18:42
10実在女性の中学時代の体操着姿からAIわいせつ画像作成・投稿か 男逮捕、高校生書類送検警視庁などが名誉毀損と児童買春・ポルノ禁止法違反の疑いで姫路市の会社員(32)を逮捕し、加工を依頼した鹿児島県の高校3年男子生徒(17)も書類送検したと報じている。20:08

GIGAZINE

#TitleSummaryPublished
1AppleのMacBook Airが世界的なメモリ不足で品薄に、開発中のスマートグラスは健康機器としての活用を検討AI向けデータセンターの急増によるメモリ不足でMacBook Airの一部モデルは配送が8月後半から9月になる見込みとなり、小売業者も過去に例がないほど在庫が限られていると訴えていると報じている。11:53
2「DeepSeek-V4-Flash-0731」が登場、GPT-5.6 Lunaより安価で同等性能のオープンモデル中国のDeepSeekが商用利用可能なライセンスでオープンモデルを公開し、GPT-5.6 Lunaより安価に同等性能を出せると報じている。12:45
3AppleがAIによる報告が殺到していることを受けバグ報告の提出件数に上限を設定AI活用で脆弱性発見が加速する一方でAI生成の質の低いバグ報告も急増したため、Appleがセキュリティ研究者の提出件数に上限を設ける対応を始めたと報じている。13:50
4中国の軍事研究者がOpenAIやAnthropicのAIモデルを抽出して国内の軍事システム開発に利用していたことが判明学術論文と特許の調査から、中国の軍事研究者が米国製モデルの出力を「知識蒸留」で小型・安価な国産モデルへ移し替え、チップ輸出規制を迂回していたとみられると報じている。14:45
5「Kimi K3」を開発した中国のMoonshot AIはAlibaba経由で約2万個のNVIDIA製チップを使用したとの報道一部ベンチマークでGPT-5.6 SolやClaude Fable 5を超えたKimi K3の開発に、Moonshot AIがAlibaba経由で約2万個のNVIDIA製チップを使ったとBloombergが報じたと伝えている。15:00
6AI支援で作られた「コラッツ予想の反証」は無効、Leanのカーネルバグを突いていたことが判明Leanに受理された反証が実際には中核部分の不具合を利用していたとして、開発者のレオナルド・デ・モウラ氏が経緯を公開し数学的には成立していないと説明したと報じている。21:00
7年間売上が16億4000万円を超える「1人事業者」がAIの支援を受けて2年で約3倍に急増Stripeのデータをもとにした推計で、年間売上1000万ドル超の1人事業者が2023年から2025年の2年間で約3倍に増えたと判明したと報じている。21:30

Publickey

#TitleSummaryPublished
1アトラシアン、AI時代の仕事用ブラウザ「Diaブラウザ」のWindows版リリースへ。ウェイトリストへの登録開始Arcブラウザの開発元を買収したアトラシアンが、現在Mac版のみのDiaブラウザについてWindows版を今年秋にリリースすると表明し、ウェイトリスト登録を開始したと報じている。00:56

The Decoder

#TitleSummaryPublished
1Two teams solved the same quantum crypto problem using GPT-5.6 just three hours apart(2つのチームが同じ量子暗号の未解決問題をGPT-5.6でわずか3時間差で解いた)2つの研究チームがGPT-5.6 Sol Ultraで同じ量子暗号の未解決問題を独立に解き3時間差で論文を投稿したとして、全員が同じモデルを使う時代に「独立した発見」が何を意味するのかを問うている。19:49
2Unicorn, pelican, Middle-earth: OpenAI co-founder Karpathy is looking for the next AI vibe test(ユニコーン、ペリカン、中つ国——OpenAI共同創業者カルパシー氏が次のAI「バイブテスト」を探している)アンドレイ・カルパシー氏が『指輪物語』冒頭の1段落をClaude Opus 5に渡して5500行のコードによる3Dブラウザシーンを生成させ、新たな体感テストの候補として示している。21:07
RECENT ISSUES 最近の号 BACK NUMBERS

すべてのバックナンバーを見る →