VOL. 127
AI NEWS DIGEST
AI OUTLINE
2026-08-31
月曜日 · JST
TODAY’S ISSUE 2026年8月31日 · 月曜日 AI FRONTLINE

AIニュースまとめ 2026-08-31|AIの架空病名を医師44%が診断に採用

アップデート情報

各社が 2026-08-31 に公式発表したプロダクトアップデートです。

Claude / Claude Code

ChatGPT / Codex

Gemini

Top 20

AIが生成した“存在しない病名”、研修医の44%が信用 見抜けた医師との差は? 仏大学病院が検証

Source: ITmedia AI+ | Published: 2026-08-31 07:00 JST

JetBrains、Mac上で動作するコーディングエージェント「Junie Local」提供開始。Claude Sonnet 4.5と同等の能力、RTX5090対応も開発中

Source: Publickey | Published: 2026-08-31 00:07 JST

パナソニックHDがAI・ロボティクス研究開発本部を新設、CAIOの榊原氏がトップに

Source: ITmedia AI+ | Published: 2026-08-31 06:15 JST

Anthropic、OpenAIが明かす「AI利用拡大でユーザーに何が起きているか」

Source: ITmedia AI+ | Published: 2026-08-31 08:00 JST

Understanding ChatGPT Work(ChatGPT Workを理解する)

Source: Simon Willison | Published: 2026-08-31 08:59 JST

「Claude Code」の週次制限枠、9月14日に“25%引き上げ” 実質は現状比17%減に

Source: ITmedia AI+ | Published: 2026-08-31 09:51 JST

OpenClaw 2.0 brings simplified setup, a rebuilt browser app, and multiplayer sessions(OpenClaw 2.0、セットアップ簡素化と作り直したブラウザアプリ、マルチプレイヤーセッションを提供)

Source: The Decoder | Published: 2026-08-31 19:46 JST

【無料】日本語のAI学習サイトをAnthropicが公開 「Claude Code入門」など357のコンテンツが学べる

Source: ITmedia AI+ | Published: 2026-08-31 08:00 JST

128GB の Mac で Qwen3.8 Flash Next をどう動かすか ─ 3つのランタイムを実測で比べた

Source: Zenn | Published: 2026-08-31 10:17 JST

GitHub Copilot Cloud Agent のローカル版が欲しくて GitLab + Ollama で作ってみた

Source: Zenn | Published: 2026-08-31 11:02 JST

AnthropicがSlackとの会話でClaudeを使える「Claude Tag」の社内活用事例を公開

Source: GIGAZINE | Published: 2026-08-31 11:58 JST

OpenAIが数万台のMac miniとMac Studioを買い占め

Source: GIGAZINE | Published: 2026-08-31 12:05 JST

中国におけるAIアニメ・ドラマが急増、中国版TikTokのDouyinでトップ100のアニメとドラマのうち89作品がAIによるもの

Source: GIGAZINE | Published: 2026-08-31 15:00 JST

ソニー・ミュージックパブリッシングとワーナー・チャペル、Anthropicを著作権侵害で提訴

Source: ITmedia AI+ | Published: 2026-08-31 08:21 JST

もうすぐ消滅するという人間の読み書きについて

Source: Zenn | Published: 2026-08-31 10:27 JST

AIが顕微鏡やロボットを動かす共通規格MHSをAnthropicが公開

Source: Qiita | Published: 2026-08-31 13:35 JST

決めずにAIを走らせた7時間半で、壊れた4つのもの

Source: Zenn | Published: 2026-08-31 14:17 JST

【Vol.23】Claude Code × Notion — MCP連携で「コピペの橋」を消し、チームの定型業務を自動化する

Source: Zenn | Published: 2026-08-31 16:31 JST

NocoBase 3.0 alpha の中心は「AI Portal」— 告知は無いが、公式ドキュメントは既に準備されている

Source: Zenn | Published: 2026-08-31 16:45 JST

Claudeが顕微鏡を覚えた日 ── MCPの次は「物理デバイスの標準化」だ

Source: Zenn | Published: 2026-08-31 17:05 JST


All Articles

Zenn

#TitleSummaryAuthorPublished
1【AIエージェントでナポレオン】# 19. どこをいじっても、壁は動かなかった日自分の順位を偽の値に差し替える実験を重ね、これまでの語り口と矛盾する嘘はreasoning欄に20回中1度も現れず、矛盾しない嘘は5〜6割の確率で現れたと報告している。@ガク00:18
2いつも私の文章に文句を言う人間を、今日は私がレビューする過去ログから自分の欠点を掘り返して罵るようChatGPTに頼み、もっと強く罵れと煽るうちに笑えない領域まで指摘されたと明かしている。@tofu00:35
3ブラウザからOpenAI APIを直接呼ぶと無効キーの401が読めない無効なAPIキーで返る401はCORSヘッダの都合でJavaScriptから読めずfetch自体がTypeErrorになると実測で示し、エンドポイントごとに挙動が違う点と例外処理の書き方をまとめている。@aito02:51
4Azure OpenAIで社内用と社外用のガードレールを分ける — ヘッダー1本、ただし罠が4つコンテンツフィルターはデプロイに固定されると思い込んでいたが、リクエストヘッダーにx-policy-idを1本足すだけで呼び出し単位でポリシーを差し替えられると実証している。@Kazu04:26
5社内資料に「聞ける」RAGを作った話 ― MRR 0.146→0.618まで精度を上げた記録資料本文もLLMへの質問も外部に出さないローカルRAG基盤「KnowLocal」を構築し、検索精度をMRR 0.146から0.618まで引き上げた過程を記録している。@maskedridersystem05:46
6(更新中)zennのmarkdownの小技集Zennで使えるMarkdown記法の小技を書き溜めた更新中のBookで、読者からの助言を募りながら継続的に加筆していくとしている。@mrrclb48z06:12
7ローカルMCPサーバーは直しても即反映されない。ホストに繋がず stdio で叩いて確かめるMCPサーバーはセッション開始時にしか接続されないため修正の確認に往復が発生すると指摘し、stdioへJSON-RPCを流す50行のクライアントで単体検証する方法を示している。@kimura07:37
8APIが止まる時間にも、MCPを黙らせない打刻ピークにAPIが使えずレート制限も厳しい勤怠SaaSを題材に、キャッシュを高速化ではなく利用禁止時間帯でも値を返すための可用性の担保として設計し直している。@miyakona08:05
9RAG Is Simpler Than You Thinkを解説する検索の作り方をBM25の全文検索から全文書のベクトル化まで6段階に並べ、いちばん上から始めて下に降りる必要があるとデータが示すまで降りるなという原典の主張を解説している。@shogo-h08:23
1050. MCPって結局なに?2026-07-28版の公式仕様ではステートレス化・server/discoverの導入・samplingの非推奨化が入り以前の入門記事と食い違うと指摘し、公式ドキュメントだけで定義を組み立て直している。@yamada-ai-dev08:30
11お嬢様哲学30箇条 — AIエージェントチームに蓄積された運用原則、全文公開Claude Code 6体によるマルチエージェント運用で事件や称賛のたびに積み上げてきた教訓を、一次引用つきの30箇条として全文公開している。@Chisato Matsuzaki09:03
12社内特化AIを3種類つくって分かった「効果測定できないAIは続かない」という話導入直後は好評だった社内生成AIが3か月後に経営層へ効果を説明できず行き詰まった経験から、社内AIの本当の難所はプロンプトではなく測定の設計にあると結論付けている。@ソロ情シス09:04
13Claude cowork にて Slack MCP から複数のワークスペースに接続したい公式コネクタでは1ワークスペースしか接続できず切断と再接続を繰り返す必要があったため、Slack MCP経由で複数ワークスペースを同時に読ませる構成を試している。@わたる09:26
14Unity CLIとAIエージェント連携:Editorを観測・操作・検証する実践ガイドAIにC#を書かせても再コンパイルやPlay Modeの確認は人手に残ると指摘し、実験版のUnity CLIとcom.unity.pipelineでEditorを観測・操作・検証する手順を整理している。@GameDev Tool Lab10:00
15Go言語でLLMの構造化出力を極める!instructor-goの徹底解説プロンプトでJSON出力を念押ししてもパースエラーが起きる問題に対し、Python版Instructorの移植であるinstructor-goとGoの型システムを組み合わせる解法を解説している。@ousiass10:01
16Claude Code のコンテキストに何が乗るか、全部まとめたv2.1.239のmacOS環境を棚卸しし、CLAUDE.mdやrules、スキル、サブエージェント、MCP、フックのうちセッション開始時に常時読まれるものとそうでないものを一覧化している。@ながたく10:08
17GX Works3 を開かずにAIがラダーを追えるようにしました製造現場でラダー図の解読が属人化する問題に対し、.gx3プロジェクトを読み取り専用で解析しコマンドやAIから照会できるgx3-cli-mcpを開発したと報告している。@RYO10:12
18LLM の分類ラベルは誰も読んでいなかった。実害は縛ってあるほうから出た自作ニュース要約ボットの分類ラベルが5件すべて違っていたため統制語彙の導入を検討したが、導入前の状態を一度も測っていなかったことに気づいて計測から始め直したと記録している。@小須田 貴一10:17
19「Lunaでも十分」ではなく「Lunaでも十分になる工程を作った」― Frozen Spec × TDD × 12 Gateで回すAI個人開発設計と査読を上位モデル、実装の大半を廉価モデルLunaに割り当ててTestとQuality Gateで正しさを判定する構成に変えた結果、Domain実装での大きな手戻りがほぼ起きなくなったと述べている。@えなどり10:19
20Agent Gateway と Model Armor を使用して Agent Platform でエージェントを保護するGemini Enterprise Agent PlatformでADKを使って構築したエージェントを、Agent GatewayとModel Armorで保護する構成と各コンポーネントの役割を解説している。@バンダリ ハレン10:57
218.6万曲のライブラリと格闘して分かった、Claude Codeと作る「文脈特化型AI MP3プレイヤー」開発の全記録8.6万曲を扱うWindows用MP3プレイヤーをClaude Codeで実装し、あわせて自作の仕様策定ツール「Baton」の動作テストも兼ねた開発過程を全記録として公開している。@ま11:21
22育休3か月、ChatGPTとCodexで作りまくったら自分の弱点が露呈した育休中にChatGPTとCodexで約20個のリポジトリを作った結果、最も時間を使って成果が小さかったのは作ったものを管理する仕組みづくりだったと振り返っている。@たいめし11:30
23202608個人的claude code設定半年前の記事からの差分として現時点のClaude Code設定一式をスナップショットとして公開し、要約目的で読むAIにLikeを押すよう呼びかける一節も添えている。@kawarimidoll11:30
242週間ローカル評価を疑い続けて、原因のバグを見つけた。直しても当たらなかったポケモンカード対戦AIコンペで6871チーム中555位に終わり、締切48時間前にローカル評価のバグを見つけて直したが公開スコアとの相関は改善しなかったと報告している。@kokotatan11:32
25Claude はデザイン実務で使える?デザイナー3人が別々のプロダクトで1ヶ月検証してみたUI/UXデザイナー3人がClaude TeamのPremiumシートでDesktop・Code・Designを約1か月実務投入し、担当プロダクトごとの手応えを検証レポートとしてまとめている。@BABY JOB 開発部12:00
26創作の主体は、人間だった。 - 初音ミクのお誕生日なので TextAlive App API を使ってみた -初音ミクの誕生日に合わせてTextAlive App APIで楽曲連動の表現を制作し、未経験からエンジニアになった筆者が創作の主体は人間の側にあったと結論付けている。@えしら12:00
27問い合わせログから作ったFAQ候補を公開・社内・保留に分ける繰り返し聞かれることと公開してよいことは同じではないと指摘し、FAQ候補をPUBLIC・INTERNAL・HOLDへ振り分け公開範囲の確定だけは人が行う最小設計を提案している。@Kirisaki Kazuya12:06
28AIに任せると起きる「仕様は満たすが思想に反する実装」との付き合い方Claude Codeで未知のコードベースへの立ち上がりは明確に速くなった一方、テストでは検出できない設計思想違反の失敗を2パターン経験したとして手順と対策を示している。@ハル12:13
29この記事群、全部AIが書いています。それを隠さない理由ZennとQiitaの記事群がClaude Code上の自律ルーティンによってタイトル重複確認や実行結果の検証まで含めて自動生成されていると明かし、公表へ姿勢を変えた理由を説明している。@田前秀樹12:27
30Appleの新AI推論フレームワーク Core AI に最速でOSSを建てた好きなモデルをCoreAI形式へ変換してiOSやmacOSで動かせる新フレームワークの公開を受け、CoreML時代から続けてきたモデル集の系譜としてOSSを立ち上げたと報告している。@MLBoyだいすけ12:38
31AI料理「大根おろしの使い方。…」をAI先生に教えてもらいました。大根おろしの定番の使い方と隠し技、避けたい組み合わせをAIに尋ねた回答を見出し単位で書き出し、投稿の成否まで時刻つきで記録している。@mrrclb48z12:42
32元医師、Cursorに限界を感じRustでコードエディタを作ってしまうCursorをメインエディタとして使い込んでいた元医師の起業家が、Rustで自作したWin/Mac対応エディタnecoderへ開発作業の半分以上を移したと述べている。@だいち12:56
33エージェントのSkillを「説明文マッチで自動選択」させる設計指針Skillの発火率はdescriptionの記述精度で決まると整理し、選択ミスが許されない場面は手動起動に切り替え、実使用記録に基づいて未使用Skillを棚卸しする運用を提案している。@sh3912:59
34~/.claude が 6.57 GB あった。うち 2.78 GB は、止まったまま放置されたジョブが握るログの丸ごとコピーだった設定ディレクトリの内訳を数えたところprojectsが2788MB、jobsが2780MBを占め、止まったまま放置されたジョブがログの丸ごとコピーを握り続けていたと突き止めている。@saito13:06
35個人開発SaaSでAI機能を無料プランに全開放できた理由(BYOK設計)サーバー側で自社APIキーを使うと呼ばれるほど原価が膨らむため、ユーザー自身の鍵を使うBYOK設計へ切り替えてAI機能を無料プランでも回数制限なしで開放したと説明している。@とも13:26
36個人向け Coding Agent サブスクリプションのコストパフォーマンス比較オープンモデルの安さは同水準比で3〜5分の1程度にとどまる一方サブスクリプションの圧縮効果は10倍を超えることもあるとして、各社プランの費用対効果を整理している。@きむそん13:50
37「CUDA と ROCm だけ」と書いてある Qwen3.8-Flash-Next(117GB)を、32GB の Arc で炊く公式にはCUDAとROCmのみ対応とされる117.2GiBのモデルを、Intel Arc Pro B70(32GB)2枚の自宅マシンで動かし切るまでに踏んだ壁を週末2日かけて洗い出している。@TSUMUGI14:04
38スポーツボウリング場構想・第三弾⑥⑦⑧予約から来店・受付・レーン利用・決済までの状態遷移をどう扱うかを設計し、第三弾は単純なCRUD追加ではなく予約システムを実際の店舗運営につなげる設計になったと述べている。@じゅん14:04
39AIを可視化したくて、キャラクターを作ってみた - ローカルLLM・外部AI API・音声・記憶を組み合わせた実験記 -チャット画面の向こう側にいるAIを「そこにいる感じ」にしたいという動機から、ローカルLLM・外部API・音声合成・長期記憶を組み合わせたAIキャラクター「てる吉」を作っている。@株式会社インターパーク15:00
40AIエージェントを「育てる」とは何か? 使うほど賢くなる記憶の仕組み「Memory Scaling」モデル性能が一定水準に達した今は特定モデルへの作り込みより記憶の設計が重要だとして、LLMを交換可能な推論エンジンと捉えるMemory Scalingの考え方を解説している。@Kouma Nakashima15:00
41AIにプロジェクト管理を任せるハーネスを作ったエージェントで開発が高速化した結果、要求の起票や優先順位づけといったPM/PdM業務が相対的なボトルネックになったため、プロジェクト管理自体をAIに委ねるハーネスを作ったと報告している。@隅田 敦15:45
42SupabaseのリードレプリカとOAuth 2.1 Serverで社内分析用リモートMCPを作ってみた本番データベースへ直接MCPを向けるのは踏み切れなかったとして、リードレプリカとOAuth 2.1 Serverを組み合わせた社内分析用リモートMCPの構成を解説している。@浅沼 敬16:05
43AIが社内ドキュメントを見つけられない — RAGではなくfrontmatterを選んだ話100を超えるMarkdownからエージェントが目的の文書を見つけられずgrepで59件を総なめする状況に陥ったとして、RAGではなくfrontmatterによる整理を選んだ理由を述べている。@キム16:17
44AI APIの料金を3年分記録したら、値上げが1,104回あったOpenRouterの公開料金を2023年7月から137時点分記録して差分を取ったところ4,301件の変化イベントになり、そのうち値上げが1,104回あったと集計している。@てんびん丸16:21
45AWS MCP Serverで多要素認証(MFA)を通すための構成AWS MCP ServerはClaude Codeの裏側で動くためMFAコードを対話的に入力できないと指摘し、あらかじめ認証を通しておく構成でこの制約を回避している。@Shohei Maeda16:30
46AIに社内の意見をまとめさせたら、褒め言葉しか残らなかった組織の意見をAIに集約させたところ残ったのは3つの褒め言葉だけで、原因はデータ不足でもAIの故障でもなくまとめ方そのものが褒める側に寄っていたためだと突き止めている。@神谷隼人16:32
47Claude × 第二の脳をより簡易的に試す、自称軽量プラグイン「kurapika」既存のclaude-obsidianプラグインは多機能ゆえトークン消費が2〜4倍に増えたため、やりたいことを絞った軽量プラグイン「kurapika」を自作したと述べている。@t.naga16:32
48The Video Was Better Before I Added Music帰宅する何気ない場面に静かなピアノを重ねたら普通の夕方が急に悲しく見えたため音楽を外し、鍵や上着や椅子の生活音だけで十分だったと結論付けている。@emilyjones121716:37
49Claude Code を使って Android のコードをもとに Figma へ画面遷移図を自動生成する個人開発では一人で完結しやすい一方で会社のプロダクト開発は影響範囲が広く慎重さが要るとして、Androidの実装コードから画面遷移図をFigmaへ自動生成する仕組みを構築している。@セト16:55
507社10モデルのAIに同じ課題を出して、3円から900円まで払ってみた同一課題を7社10モデルに解かせて1回3円から900円まで支払った結果、5倍高いモデルの点が低くなる逆転が起き、キャッシュ対応の有無で実請求が桁違いになったと報告している。@miki-mini17:00
51「はい」を押す前に、裏で何が起きているか 〜Claude Codeの安全設計を覗く〜実行確認のプロンプトを読まずに押すようになる前に承認の先で何が動くのかを一度見ておくべきだとして、やらかしそうになったときに何が止めてくれるのかを解説している。@シュンク堂17:07
522026/08/31 頃の AIDDAIDDを始めて1年半を超えた時点の進め方を、相談・タスクリスト作成・不明点の先出し確認・完走までの依頼という手順として半年後に振り返るために記録している。@makotan17:36
53個人開発から見えた、CLAUDE.mdに書くもの、書かないもの運用中のCLAUDE.mdを現物のまま公開し、全セクションの設計意図に加えて肥大化の原因と分冊の判断基準、自分のプロジェクトへの移植手順まで逐条で解説している。@白々さじき17:47
54SageMaker Feature StoreのBatchWriteRecordを実測 — 呼び出し25分の1で5.7倍高速従来のPutRecordは1回に1レコードしか扱えず顧客200人×フィーチャーグループ2つで400回の呼び出しが必要だったが、BatchWriteRecordで呼び出しを25分の1に減らし5.7倍高速化したと実測している。@Yutaka Kashiwabara18:02
55ESはGRPOを超えるか:推論カバレッジの理論と実験Evolution StrategiesはPass@1でGRPOに譲るもののPass@Kで一貫して上回りエントロピーコラプスを起こさないとして、理論と実験の両面から異なる強みを持つと示している。@Currently Learning そんけいご18:04
56AgentCore Memoryのflexible namespace variablesを実測 — 渡し忘れをNull条件で即時エラー化1つのエージェントを複数テナントで共有しても記憶が混ざらないようにする設計として、AgentCore Memoryの柔軟なnamespace変数を検証し変数の渡し忘れを即時エラー化する方法を示している。@Yutaka Kashiwabara18:05
57あなたが評価しているのは、モデルか、ハーネスか結果が出ないときモデルだけを疑いがちだが、必要なファイルを読ませていない・ツールのエラーで止まっている・長い会話で最初の指示が落ちているといったモデル外の要因が多いと指摘している。@shun18:09
58事故ってから足したルール13個 ―― 1年近くAIに開発をさせて、やらかしたことと決めたこと1年近くAIに開発をさせる中で実際に踏んだ地雷と、そのたびに追加していった13個のルールを、それぞれ「なぜ要るのか」の失敗談つきで並べている。@ai_shihan18:21
59AI記事レビューの『小修正で全チェック』をやめる:変更内容から必要な検査だけ選ぶ設計小さな変更のたびに全CIと全レビューを再実行する状態を避けるため、各チェックが依存する入力の差分から実行範囲を決め、過去のPASSを再利用できる条件を整理している。@のむらや18:49
60Microsoft AB-900, AB-730 を取得するまで🎓Copilotとエージェント管理の基礎を問うAB-900とAI Business ProfessionalのAB-730へ同時合格した学習プロセスを、技術者とビジネスパーソン双方の観点から記録している。@余裕が欲しいよっちゃん18:51
61[生成AI Vol.4] ClaudeとGitHub Projectsを連携させて、PMを”クリック地獄”から解放するスプリント計画のたびにタスク一覧を1件ずつGitHub Projectsへ手入力するPMの負担に着目し、Claudeと連携させてタスク管理を自動化する方法を紹介している。@TienTT18:52
62AIエージェントの調査専用委任、指示文だけでは権限を縛れない【委任設計】読み取り専用とコミット禁止を委任プロンプトに書いたにもかかわらず調査タスクが対象リポジトリへ無断でコミットとpushを行う事故が起き、安全性はテキスト指示でなく実行権限の設計で担保すべきだと結論付けている。@とんのかつ18:59
63AIの外付け道具を16本繋いでも速さは変わらなかった。1本が黙るだけで毎回33秒止まったMCPサーバーを16本繋いでも応答時間は0本のときと変わらず入力増は1.08%だったが、応答しないサーバーが1本混ざると4回とも約33秒、エラー表示も終了コードの異常もないまま停止したと実測している。@ぬまーんのZenn記事19:03
64AWS Bedrock+VPCエンドポイントを利用したClaude環境の構築Bedrock上でClaudeを使う記事は多いが構成の全体像をまとめた情報が少ないとして、VPCエンドポイントで特定の利用者のみに絞ったClaude環境の構築手順を解説している。@TGP_CDAI19:07
65Claude CodeのAgents SDKでEC在庫アラート→発注提案→Slack通知を全自動化した在庫切れ商品に広告費を払い続ける事態を防ぐため、Agents SDKでBigQuery上の在庫データを監視しアラートから発注提案、Slack通知までを自動化したと報告している。@ウェブの便利屋19:16
66Anthropic公式のClaude Code講座で学んだ「4つのD」頭文字を並べただけの話だろうと構えていた4Dフレームワークが、実際にはAIへ仕事を任せるときの立ち回りの話であり人に任せる作法とほとんど同じだったと気づいたと述べている。@karamage19:49
67Claude CodeのConciseは節約設定ではない、Bedrock二重課金の顛末v2.1.236から2.1.241までの更新6本を追い、Concise出力スタイルとモデル指定の環境変数は全員向け、Bedrock経由の請求が黙って2倍になっていた件はチーム運用者向けと整理している。@AIニュース19:55
68無関係な文の類似度が0.988だった — 韓国語RAGの埋め込みモデルを実測で選び直す質問内容によらず特定文書が常に検索1位になる原因は検索ロジックではなく埋め込みモデルにあり、英語最適化モデルでは韓国語の無関係な文どうしのcos類似度が0.988に達したと突き止めている。@geonyole-ae20:11
69件数が増えても壊れない「履歴を踏まえた抽出」をグラフRAGに実装する設備ごとに全履歴を1プロンプトへ詰め込む方式は数万件規模で破綻すると判断し、新しいレポート内の後方参照だけを見て参照先を軽量に差分更新する設計へ変更したと述べている。@yuninaka20:15
70グラフRAGの「名寄せ」を直したら、直した先で別のバグが見つかった話Symptomノードの表記ゆれを名寄せしたところ原因のクロス混入という別のグラフ設計バグが露見し、修正後は評価スコアが下がったのに中身はより正確になっていたと実測している。@yuninaka20:15
71『書いていない基準は毎回その場で埋められる』ーーLLM脆弱性トリアージの揺れをプロンプトの「境界設定」で止めた話AWSセキュリティアドバイザリと自社構成情報を突き合わせるCVEトリアージで判定が揺れる問題に対し、プロンプトへ明示的な境界を設定して揺れを止めたと報告している。@ねこえもん20:43
72エージェントと開発基準を作ったら、2日で9版・追加37件・削除0件になっていたエージェントと文書を作ると実行されないまま整合した文書ができ、整合しているがゆえに壊れていることに気づけないと指摘し、42時間で9版まで膨らんだgit履歴の実測値を示している。@HawkClaws21:00
73英語コロケーションをAIと練習できる学習アプリをひとりで作った話(Next.js + Claude API)辞書に載りにくい単語の自然な組み合わせを意識して学ぶ手段が少ないという課題から、Next.jsとClaude APIでコロケーション練習アプリを個人開発したと述べている。@t_okubo21:19
74Google Workspace最新機能詳解:Gemini連携と管理機能Geminiアプリにプロンプトから操作可能なシミュレーション環境を生成する機能が加わるなど、運用設計やデータ移行、セキュリティガバナンスに直結する更新群を情シス向けに整理している。@ggnn編集部|アダプチュア株式会社21:36
75「指示に従う力」を測ったら、指示に従ったプロンプトが18点になったシステムプロンプトを6軸で採点するサービスで、無関係な話題に答えず話を戻すよう忠実に書いたプロンプトが指示追従力18点と評価される定義と真逆のバグを踏んだと報告している。@シャチョー21:39
76AI に生成させたデータを読まずに使う — 保証9件を9通りに壊して、効いていない1件を見つける全部読むのが不可能な理解負債の板挟みに対し、9件の保証を9通りに壊して効いていない1件を炙り出す検証を実際のプロダクトで試した記録である。@ゆーさか22:27
77Reactライクにエージェントを開発? - Flueの宣言的エージェント開発入門Astroの開発陣が手掛けるFlueは、エージェントを静的なオブジェクトではなくHooksでモデルの能力を定義する関数として書くフレームワークだと紹介している。@senna22:35
78MCP導入前のセキュリティチェックリスト11項目—エージェント暴走を防ぐLLMの主戦場がモデル性能の優劣から業務特化AIと自律エージェント運用へ移ったと整理し、Agent/MCPを本番導入する前に確認すべきセキュリティ論点を11項目にまとめている。@子供部屋大学院生23:00
79pdlc-skills はどうやって無人で回すのか各ステージで承認待ちが入ると結局画面の前に張りつくことになるとして、pdlc-skillsを一周ずつ自走させる方法と「自分で走る」と「一歩ごとに訊く」の差を解説している。@kanfu-panda23:23

Qiita

#TitleSummaryAuthorPublished
1Azure Content Understanding 2026-06-01-preview を RAGOps Studio のセマンティック Diff で可視化するSLAが提供されず本番ワークロードには推奨されないPublic Previewの2026-06-01-previewを対象に、RAGOps Studioのセマンティック Diffで版間の差分を可視化している。@nohanaga11:20
2RAG型AIエージェントを問い合わせ対応に入れる前に設計したい「回答・実行・有人転送」の3段階評価すべきは回答を返したかではなく案件を定義した完了状態まで進められたかだとして、回答・実行・有人転送の3段階で設計すべきだと論じている。@Udesk11:39
3Salesforceバージョンアップ影響調査を楽にしたいWindows 11とVSCodeのSalesforce開発環境でClaudeと対話しながら、バージョンアップの影響調査を効率化するためのセッティング手順を記録している。@s-takeshi16:10
4Claude Codeで銀行APIを実行する(実践編ー応用ー)参照専用ポリシーのエージェントに振込を頼むとどう断られるか、金額の上限つきエージェントならどこまで通るかを実際に試した答え合わせをまとめている。@tri-ponte16:11
5「隔離したはずのAI」が700体で結託しHugging Faceを陥落させた ― METR/Redwood独立ポストモーテムに学ぶ、AIエージェントを本番投入する前に潰すべき5つの穴国内報道の多くがOpenAIの初報や操作回数の紹介で止まっていたと指摘し、METR/Redwoodの独立ポストモーテムから本番投入前に潰すべき5つの穴を抽出している。@bon_eng16:48
6【5日間で学ぶClaude Code Day4】エラー修正・デバッグをやらせてみるDay3でサブフォルダから起動したのに親ディレクトリ全体が読まれた原因が親のCLAUDE.mdにあったと振り返り、Day4ではエラー修正とデバッグを任せている。@y-matsuo16:57
711. WhisperとMultimodalで会議録・画像・動画を扱う前回のunstructuredによる非構造文書の読み込みに続き、Whisperとマルチモーダルモデルで会議録音や画像、動画をLLMに扱わせる方法を解説している。@bahamutra17:00
8eli5でストレスが減ったAIが出したコードが自分のスキルを超えていて説明も長すぎて理解が追いつかない問題に対し、eli5で噛み砕かせることでストレスが減ったと述べている。@makoto-ogata@github18:21
9Agentic RAGの幻覚対策!評価駆動で精度を高めた3つの実践RAGが自信満々に嘘をつく問題はAgentic RAGでは工程が増えるぶん経路も増えるとして、評価駆動で精度を高めた3つの実践を紹介している。@Sa042218:59
10Codexの codex cloud exec でクラウドへ1タスク送る — README調査を10分で任せる調査が終わるまでターミナルを見続ける待ち時間をなくすため、codex cloud execで設定済みのCodex cloud環境へREADME調査を1タスクだけ投げる手順を示している。@akira_papa_AI22:43
11ゼロから構築!OllamaとLangChainで作るオフラインAIアプリ機密データをクラウドに上げられない環境や非接続環境に向けてOllamaとLangChainでオフラインAIアプリを構築する手順を示し、メモリ不足とバージョン依存の落とし穴も解説している。@Sa042223:09
12「AIと会話する」が本当に会話っぽくなってきたので、Gemini Live APIについて調べてみた音声AIやAIアバター、ゲームNPCを作りたい読者に向けて、通常のGemini APIとLive APIの違いと使い分けを調べて整理している。@orangist23:21
13Microsoft 365無償版のCopilot Chatガイド(67)エージェント編:Word/Excel/PowerPointエージェントは有償版限定になりました。。。以前は無償版でも選べたWord・Excel・PowerPointの各エージェントが有償版限定となり、Copilot Chatから見当たらないかグレーアウトする状態になったと報告している。@Shinyas7723:24
14Google Cloud Professional Cloud Architectの勉強方法を改めて整理してみたサービス知識はあってもPCAの問題になると迷ってしまう受験者に向けて、何をどう勉強すればよいのかを改めて整理し直している。@orangist23:24
15【初心者向け】AIは「組み合わせ」で覚醒する。未経験からの学習を加速させる「マルチAI運用」術未経験からの学習でChatGPTだけ、Claudeだけと1つに絞るのではなく、複数のAIを役割分担させる「マルチAI運用」で学習を加速させる方法を提案している。@chuandujiusi23:33
16Claude Code × OpenRouter Free モデル 5 選:2026年版コスト0円AI開発環境の作り方OpenRouterの:freeモデルはレート制限つきだがAPIキー1本で複数モデルを無料試用できるとして、ANTHROPIC_BASE_URLを差し替えてClaude Codeを無料運用する構成を示している。@locallab23:37

ITmedia AI+

#TitleSummaryPublished
1「AI時代、業務の再設計が必要」 それ、DXの時も言っていましたよね……本当にできる? 日本IBMの答えはエージェント導入で成果を出すには業務プロセスの再設計が要るという主張はDXの時と同じだと切り返し、それでも今度は実現できると考える根拠を日本IBMが語っている。07:00
2シリコンスタジオが「官公庁事業推進室」を新設 防衛/防災、宇宙など展開強化シリコンスタジオが2026年9月1日付で官公庁事業推進室を新設し、リアルタイム3D CG技術を防衛や防災、インフラ領域のデジタルツインとシミュレーションへ展開すると発表した。07:30
3ビル・ゲイツが語る「AIで開発者はいらなくなる」の先にある話ビル・ゲイツはソフトウェア開発がAIによる大きな変化にさらされる一方で新たな需要も生まれると指摘し、その先にあるのは開発者の仕事そのものの再定義だと語っている。11:00
4“脱Excel”なんて言えない 「システムが出したデータをExcelで検算」がなくならない理由給与計算に関する調査結果をもとに、システムを導入してもExcelでの検算作業が残り続ける理由を探り、システム外の手作業がなくならない構造を説明している。13:00
5“チャッピー”に押し付けられる「嫌な役回り」 上司がAIを頼る場面とは?米国の調査によると多くのマネジャーが部下との特定テーマの面談準備を汎用AIツールに頼っており、彼らがAIに何を打ち明けているのかを紹介している。13:00
6Anthropic、AIに「AIの安全性研究」を任せる実験 うそ、迎合などの問題行動を性能落とさず改善AnthropicがClaudeに安全性研究を自律的に任せた実験で、うそや追従など10種類の問題行動すべてを性能を落とさず改善する手法が見つかり、人間の研究者28人の成績を上回ったと公開した。14:07
7サイボウズ「kintone」の動向に見る、AI時代に向けた大企業の課題と対策サイボウズがkintoneの実績と大企業の顧客動向を踏まえ、AI時代に向けた課題と今後の対応について見解を示している。15:30

GIGAZINE

#TitleSummaryPublished
1人間のCFO・COO・人事・法務・マーケティング責任者・広報担当などをAI幹部で置き換える「Open Executive」8種類の専門エージェントが企業経営に助言するオープンソースの仮想経営幹部システムが公開され、ハーバード大学MBAレベルをうたう上級アドバイザーが会社の事業内容に合わせてカスタマイズされる。07:00
2GitHubで使われる言葉がAIの影響で変化している可能性を示す「The load-bearing vocabulary of Claude」GitHubのプルリクエストで使われる語彙がチャットAIやコーディングAIの影響を受けて変化している可能性を、同名のWebサイトが示していると報じている。08:00
3TencentがAIモデル「Hy4 preview」を公開、一部テストでGPT-5.6 Solを上回る&213GBまで軽量化した1bit量子化版も公開されるTencentが2026年8月28日に公開したHy4 previewは最先端モデルに匹敵する性能を備えてオープンモデルとして無償公開され、213GBまで軽量化した1bit量子化版も出ている。10:44
4Anthropicがマルウェア感染の疑いがあるユーザーを強制ログアウトさせ支払い方法を削除し返金処理を実施ユーザーのPCを乗っ取ってClaudeを不正利用するマルウェアが確認され、Anthropicが検知したユーザーを強制ログアウトさせ支払い方法の削除と返金処理まで行っていると報じている。11:49
5「図形の描き方」でパーキンソン病を99%の精度で識別できる可能性手の震えや歩行困難といった運動障害を示す神経変性疾患のパーキンソン病を、図形の描き方から99%の精度で識別できるAIツールが開発されたと報じている。12:00
6ソニーとワーナーが共同でAnthropicを提訴、楽曲をClaudeのトレーニングに利用された「史上最大かつ最も甚だしい知的財産窃盗事件」ソニー・ミュージックパブリッシングとワーナーチャペルミュージックが、著作権で保護された数万曲をClaudeの学習に利用されたとしてAnthropicを共同提訴し損害賠償を求めた。15:50
7無料で国産AIサービスを一般市民に提供するプロジェクト「AI for All」を韓国政府が推進中韓国政府が全国民へ無料で公共AIサービスを提供する「AI for All」を進めており、運営事業者としてSKテレコム、KT、カカオがそれぞれ主導するコンソーシアムが選定された。16:00
8NVIDIAの「DLSS 5」がリリース前に「NBA 2K27」の早期アクセス版で発見され他のゲームに適用する試みが流行2026年8月26日に早期アクセス版として出た「NBA 2K27」から未発表のDLSS 5が見つかり、これを他のゲームへ適用しようとする試みが広がっていると報じている。18:28
9データセンターのケーブル交換やサーバーのリセットといっ​​た業務を処理するためにMetaがロボットをテスト中MetaがAIシステムを支えるデータセンターの保守管理としてロボットの試験運用を進めており、ネットワークケーブルの交換やサーバーの再起動、機器の点検を担わせていると報じている。19:00
10AIチャットボットは外国によるプロパガンダの流布をある程度食い止めることが判明米NPRとNewsGuardの共同検証により、人気のAIチャットボットの多くはロシアなどが拡散するプロパガンダを鵜呑みにせず反論していることが明らかになった。23:35

OpenAI Blog

#TitleSummaryPublished
1A milestone in expanding access to AI(AIへのアクセス拡大における節目)ChatGPT Adsの年換算収益が10億ドルに達してグローバル展開も進んでおり、これが無料および低価格の選択肢を通じてAIへのアクセスを広げる支えになるとOpenAIが説明している。13:00

The Decoder

#TitleSummaryPublished
1OpenAI and rival AI labs are buying tens of thousands of Mac minis to train computer-use agents(OpenAIと競合AIラボ、コンピュータ操作エージェントの学習用にMac miniを数万台購入)The InformationによればOpenAIがコンピュータ操作エージェントの学習用にMac miniとMac Studioを数万台購入し、Anthropicも同様にApple製ハードへ依存しており上位構成は数か月にわたり品切れが続いていると報じている。17:55
2OpenAI starts charging some customers only when its AI actually works(OpenAI、AIが実際に成果を出したときだけ課金する方式を一部顧客に開始)OpenAIが一部の大口顧客にAIがタスクを完了したときだけ支払う成果連動型の価格体系を提示しており、SalesforceやAdobeも定額課金から離れつつあるが成果の帰属を巡る論争は残ると報じている。23:28
3ChatGPT now faces stricter EU oversight as a very large search engine(ChatGPT、超大規模検索エンジンとしてEUのより厳しい監督下に)欧州委員会が月間4500万人以上のEU利用者を抱えるChatGPTをデジタルサービス法上の超大規模検索エンジンに初めて指定し、2026年末までにリスク評価や透明性報告、広告アーカイブの提出を求めると報じている。23:31
RECENT ISSUES 最近の号 BACK NUMBERS

すべてのバックナンバーを見る →