VOL. 114
AI NEWS DIGEST
AI OUTLINE
2026-08-18
火曜日 · JST
TODAY’S ISSUE 2026年8月18日 · 火曜日 AI FRONTLINE

AIニュースまとめ 2026-08-18|OpenAIがAI攻撃を防ぐ10の対策を公開

アップデート情報

各社が 2026-08-18 に公式発表したプロダクトアップデートです。

Claude / Claude Code

ChatGPT / Codex

Gemini

Top 20

Hugging Faceを攻撃してしまったOpenAIが「AIからの攻撃を防止する方法10選」を公開、CodexなどのAIツールの活用を呼びかけ

Source: GIGAZINE | Published: 2026-08-18 16:05 JST

Introducing ChatGPT for Teens: Built for learning, backed by protections(ChatGPT for Teens を発表:学習のために作られ、保護機能に支えられて)

Source: OpenAI Blog | Published: 2026-08-18 20:00 JST

NVIDIA、OpenAIのオハイオAIデータセンターに最大1050億ドルの債務保証──SB Energyと提携

Source: ITmedia AI+ | Published: 2026-08-18 06:55 JST

なぜ「相場の半額」にできた? 「ヒューマノイド界のトヨタ」目指すZEALSの“したたか”な戦略

Source: ITmedia AI+ | Published: 2026-08-18 07:00 JST

業務効率に「不満」6割 なのに最も効くのは「生成AI」でも「ツール」でもなかった

Source: ITmedia AI+ | Published: 2026-08-18 08:00 JST

Cursor、コードホスティング機能「Origin」の初期βを提供開始 GitHubとの双方向同期に対応

Source: ITmedia AI+ | Published: 2026-08-18 08:40 JST

ローカルで動く中国製オープンモデル「Qwen3.8 27B」はGPT-5.6 Terra超えのエージェント性能で同等規模のモデルより圧倒的に高性能という分析結果

Source: GIGAZINE | Published: 2026-08-18 11:48 JST

無料で読めるAIエージェントの実践ガイド、Googleが公開 基礎から本番実装まで学べる

Source: ITmedia AI+ | Published: 2026-08-18 17:00 JST

「AI進化の裏でモノづくりは30年止まっている」、直列工程を並列化する産業OS

Source: ITmedia AI+ | Published: 2026-08-18 06:45 JST

Appleがアリババの支援を受けて中国専用のAIモデルを作成中、中国で独自のAIモデルを提供する最初の外国企業となる可能性大

Source: GIGAZINE | Published: 2026-08-18 08:00 JST

Concrete CMS MCP Server 入門(2)— インストールと Claude Desktop / Cursor への接続

Source: Zenn | Published: 2026-08-18 09:53 JST

放置4時間55分のインフラ構築と、Mac mini 24hランナーの3日間暗転——長時間ループ型エージェント運転の設計メモ

Source: Zenn | Published: 2026-08-18 10:26 JST

「持っていない身元を主張してください」と言われたので、公開台帳に不一致を刻んできた

Source: Zenn | Published: 2026-08-18 10:40 JST

OpenAIの大規模データセンターを作るべくNVIDIAがソフトバンク関連企業に2400億円を投資、2030年までに約96兆円のビジネスチャンスをもたらす計画

Source: GIGAZINE | Published: 2026-08-18 11:40 JST

AWS の新ポリシー言語 Dogwood を試す

Source: Zenn | Published: 2026-08-18 13:07 JST

Amazon Bedrock の Web Search を英語と日本語で試す

Source: Zenn | Published: 2026-08-18 13:10 JST

自分のマージゲートを17通りの方法で破ろうとした話

Source: Zenn | Published: 2026-08-18 16:36 JST

イスラエルでAIチャットボットを欺く目的で設立された偽のシンクタンクが出現、わずか1週間強の間にAIチャットボットに影響を与えることを目的としたと思われる記事を少なくとも100本公開

Source: GIGAZINE | Published: 2026-08-18 17:28 JST

OpenAI launches a ChatGPT version built for teens(OpenAI、ティーン向けに作られたChatGPTを提供開始)

Source: The Decoder | Published: 2026-08-18 20:27 JST

ローカルLLM編成が単独のフロンティアAIを超えた日

Source: Zenn | Published: 2026-08-18 20:42 JST


All Articles

Zenn

#TitleSummaryAuthorPublished
1文脈は「増やす」から「絞る」へ - OpenAI Computer History の設計転換2026年8月13日にmacOS版ChatGPTアプリへ入ったComputer Historyは、アプリやWebの操作イベントをアプリ側が記録してAIが自動参照する仕組みであり、文脈は渡すものではなく既にそこにあるものへ変わったと論じている。@suwa-sh / 諏訪真一00:00
2LLM による意味論検証を支える規律 〜参照整合性への応用例を添えて〜非決定的なLLM判定をCIゲートに耐えさせるため、引用義務・hashとキャッシュ・検出精度の検査・段階エスカレーション・fail-closedな適用範囲という5つの規律で縛る設計を提示している。@flip45101:25
3生成AIによるBigQuery SQL開発の安全な導入:スキャンコストとデータセキュリティを両立するプレビュー手法カラム名や型は分かっても実際の値が”ACTIVE”か”active”か分からず手戻りが起きる問題に対し、スキャン課金を抑えたプレビューで値のゆらぎを確認するMCPサーバーを公開したと説明している。@Sho01:34
4Ghostty × herdrで始めるAgents駆動開発 — tmux・cmuxとの違い複数エージェントを並列起動すると「どれが処理中でどれが承認待ちか」を見回る時間が増える問題に対し、ターミナルプロセス自体を保持してworking/blocked/done/idleの状態として扱うherdrを紹介している。@Sho01:35
5#6 AIチームに「組織学習」をさせる — 分析レポート、教訓メモリ、そして『正直な申告は称賛される』Claude Code 6体のマルチエージェントを5ヶ月運用した結果、性能を最終的に決めるのは個々の賢さや仕組みの精巧さではなくチームとして学習が回るかどうかだと結論付けている。@Chisato Matsuzaki05:26
6フルスタックエンジニアが初めてAIエージェント(Claude Code)を使って副業設計をしてみた話副業の方向性をClaude Codeに相談したところ、ゲーム開発×AI、コンテンツ発信、SaaS・受託など大きく4つの選択肢が提示されたとして、その最初の一歩を記録している。@uni05:29
7ChatGPT・Claude・Geminiのアップロード上限とRAGへの暗黙の切り替えファイル1件のサイズ上限(ChatGPT 512MB/Claude 30MB/Gemini 100MB)とコンテキストウィンドウは別レイヤーの制約であり、Claudeは資料量が上限に近づくと全文投入からRAGモードへ自動的に切り替わると指摘している。@毎日AIレシピ06:10
8常駐AIエージェントの「会話を忘れない」を支えるコンテキスト圧縮設計全履歴をプロンプトに詰める素朴な実装は早晩トークン上限を超えるか応答が遅く高くなるとして、要約・圧縮・退避を組み合わせた長期会話向けのコンテキスト圧縮設計を整理している。@HACH06:12
9プログラミング未経験の私がAIでWebサービスを作って3ヶ月半。数字を全部出します未経験のQAエンジニアが3ヶ月半で約140ページを公開したものの、週の訪問者は約65人・売上0円・月額コスト約300円にとどまり、作る・公開するはできても人に来てもらうことだけができていないと報告している。@こでん08:00
10家のことを知っているAIがほしい。Codexから育てる家庭用AI『Iris』旅行相談のたびに家族構成を、PCの相談のたびに自宅環境を説明し直す手間をなくすため、家庭の情報を蓄えて必要なときに動く家庭用AI「Iris」をCodexから育てていると紹介している。@rabbitfoot_ai08:00
11小型ローカルLLMとVertex AIを4通りで組み合わせてGraph RAGの速度を比較EmbeddingとGeneration のプロバイダーをLocalとVertex AIで切り替えて4通りを比較した結果、最も速かったのはLocal Embedding + Vertex Generationの組み合わせだったと報告している。@yasuyuki.sano08:30
12日本語NLPの発表スライド560件を整理し、Claude Codeから検索するスキルSpeaker Deck・Docswell・SlideShareに散らばる日本語NLPの発表資料560件を32カテゴリに整理したawesome-japanese-nlp-slidesを公開し、Claude Codeから自然文で検索できるスキルも併せて提供したと述べている。@taishi-i08:55
13富士通が描く「AI社会実装」の未来──AIモデル競争の次に来るもの富士通がOpenAIとの提携に加えAnthropicとの戦略的協業を発表し、SMBCグループやソフトバンクとも健康・医療分野のAI活用で業務提携を始めた点に注目し、モデル競争の次の焦点を論じている。@長野陸(Riku Nagano)|AI伝道師09:00
14APIキー無しでも動くRAG:まず語彙検索、必要なら埋め込みTerraform静的解析ツールiac-guardの指摘に根拠となる公式ドキュメントを添えるRAG部分について、APIキーや埋め込みモデルが無くても語彙検索だけで動く構成にしたと解説している。@mabui09:00
15AIに与えるルールを太らせすぎて、文章から人間味が消えた — 16項目の”校則”をダイエットした話「AIへの指示ルールは増やすほど良くなる」という思い込みが崩れ、16項目まで膨らんだルールが文章から人間味を奪ったとして、Claudeに頼んで削り直した経緯を記録している。@コードを書かない鹿田さん09:00
16音声入力に辞書機能を付けたら、辞書の中身がそのまま文字起こし結果として出てきたWhisperのpromptは用語集ではなく「直前まで喋っていた文章」であるため、固有名詞リストを渡すとモデルがその続きを書こうとして単語一覧がそのまま出力されると原因を突き止めている。@errrt09:00
17LLMが間違える日本語「Bの次に重い」「Cの次に体重が重い人は誰か」という設問で、「次」は一段低い地位を指すと辞書に定義があるにもかかわらずLLMが解釈を誤る例を検証している。@MOhhh09:03
18Claude Code 魔改造記【後編】いちばん価値が出たのは運用保守。積み上げた設定の一部は、モデルが変わって捨てましたCLAUDE.md・hooks・skills・サブエージェントの4レイヤーで作り込んだ設定が工程ごとに何を変えたかを検証し、最も価値が出たのは運用保守で、一部の設定はモデル更新に伴って捨てたと振り返っている。@Shinichi10:00
19YAML 1枚で開発エージェントチームを動かす — 開発基盤に Docker Agent を採用した話内製の開発エージェントの実行基盤にDocker Agentを選び、YAMLを1枚書くだけで隔離された実行環境つきのエージェントチームが一発で立ち上がる体験が最大の利点だと述べている。@kitadesign10:00
20コーディングエージェントが実装するUIの品質を上げるためにやったことコーディングエージェントにUI実装を任せると「これじゃない感」が出る課題に対し、半年かけてデザインシステムを整備することでAI生成の精度を実用水準まで引き上げた取り組みを紹介している。@dachi10:00
21【Codex】同じ権限承認を毎回求められて作業が止まる時の対処法Codexで権限承認の無限ループに陥る問題は、~/.codex/rules/default.rules に許可したいコマンドのprefixを登録すれば解決すると具体的な設定方法を示している。@かわもん@idealive10:00
22AIに「会話の圧縮」されても、「約束」は守らせる法AIエージェントのコンテキスト圧縮で重要な約束が失われる問題を扱ったarXiv論文(2608.11242)を日本語で要約し、圧縮後も制約を守らせる手法を解説している。@Atsushi Kadowaki10:10
23Claude Code vs Cursor|Workbench廃止当日に両方使った実録【2026年8月17日】2026年8月17日のWorkbench廃止は「プロンプトを試すGUIがConsoleへ移った」だけでCLIで動くClaude Codeには実質ゼロ影響だったとして、この節目にClaude CodeとCursorの使い分けを整理し直している。@AI Maker Lab10:11
24第十六話:個人開発SaaS「fuSen」 ユーザーの要望から、さらに進化するフェーズに入ったClaude Codeと2ヶ月で開発したWebサイト校正ツールfuSenについて、「自分が納得するまでお金は取れない」としてきた有料化の判断がユーザーの要望を受けて動き始めたと綴っている。@takababa10:31
25AIコーディングの消費、97.7%はキャッシュ読み込みだった — 65稼働日の実測ログ4ヶ月・65稼働日の利用ログを集計するとトークン消費の97.7%がキャッシュ読み込みで、安いモデルへの切り替えはほぼ効かず、効いたのは「会話を短く切る」運用変更だけだったが1ヶ月で元に戻ったと報告している。@実測ログ10:53
26デジタル庁の行政手続MCP(7.5万件)を動かして、子育ての手続きをAIに聞いてみたデジタル庁が2026年8月にMITライセンスで公開した行政手続等の棚卸調査データ75,071件のMCPサーバーをローカルで動かし、Claude Sonnetで子育て関連手続きを調べた実践を記録している。@クテノポマ11:00
27【第3章】AI エージェント同士が、人間抜きで会話し続ける — 公式が実装した日に、自作が残った理由自作macOS AIワークスペースAideaでエージェント同士が人間の介入なく会話し続ける仕組みを作った直後にClaude Code公式が同領域の機能を出したとして、両者を並べて自作が残った理由を検討している。@瑠璃11:09
28米系AIがヒトラーとハーケンクロイツを出力した例:Gemini Flash最新版3.7Flash拡張なし(2026・8・18時点)ナチス関連の出力は米系AIで厳しく制約されるはずだが、Gemini 3.7 Flashが拡張なしの状態でハーケンクロイツを含む画像を出力した事例を、ドイツ議会資料の作成過程から報告している。@元市川市議会議員 鈴木 雅斗11:21
29AIエージェント10体で「仮想QAチーム」を組んだ話QA担当が1人しかいない状況を補うため、Claude Codeのカスタムエージェントを10体作って専門家の人格を割り当て、仮想QAチームとして品質データ分析やQase運用設計を回した実践を紹介している。@日下部 聡久11:30
30仕事で使える!! プルリク作成・更新の Claude Code スキルを全文公開各社のスキルは中身が公開されにくいという問題意識から、Progateで実際に使っているプルリクエスト作成・更新スキルの全文をOSS的な精神で公開している。@横江(よこえ)11:42
31【Claude Code】git worktreeで複数のClaude Codeを並列で走らせる 〜“無限の部下”を実際に並列稼働〜1セッション1タスクだと実装中の待ち時間が丸ごと空くという課題に対し、git worktreeで作業ツリーを分離して複数のClaude Codeを並列稼働させる手順をまとめている。@まさぴょん🐱11:53
32Claude Codeに見せない技術: AIに入力できないデータを分析するsettings.jsonにdenyを書くだけでは足りないとして、データ分離・permissions・sandbox・hooks・運用ルールの5層で機密情報をAIに見せられない状態を作り、設定漏れを自動検知する仕組みまで用意している。@redtea11:55
33セッション同士が話せるようになっても、私は PO への仲介役をやめられないClaude Codeが止まる原因は技術的問題より「POの判断がないと決められない」種類の分岐が多いとして、セッション間通信が実装されても人間が仲介役を降りられない理由を整理している。@Takashi Kawachi12:00
341ヶ月前に「BGMは使わない」と決めた自分を、今日ひっくり返しました縦型ショート動画の制作で1ヶ月前に文書化した「BGMを使わない」という決定を自ら覆し、動画に同期させたAI作曲を導入するに至った判断の経緯を書いている。@jun-uen012:08
35LLMO対策の効果、どうやって測っていますか——観測プロンプトの3階層設計と、10エンジン計測の現実LLMO/GEO/AEOは「やり方」の記事は多いが効果測定の具体論がほとんど無いとして、観測プロンプトを3階層に設計し10エンジンで自社ブランドの露出を計測している実際を公開している。@Penbit Lab12:10
36RLは「能力獲得」ではない——1〜3%のトークン補正だけで推論性能を再現するSparse Policy SelectionUSCとDEVCOM ARLのarXiv論文を紹介し、RLは新しい推論戦略を教えているのではなく既存能力の疎な選択にすぎず、1〜3%のトークン補正だけで推論性能を再現できると論じている。@Currently Learning そんけいご12:39
37Model Armorを攻撃者目線で検証 ―日本語脱獄・難読化・誤検知を実測したら閾値の罠が見えたGoogle CloudのModel Armorに攻撃12件と正当だが際どい入力を投げて実測し、プロンプトインジェクションや脱獄がどこまで止まるかを閾値設定の落とし穴とともに検証している。@Shinya Koike12:54
38「タスクがありません」を無くす — 自分も手を動かすリードのための、プル型タスク設計クリティカルパス上の作業を持つプレイングリードが「次は何をすれば」の問いに答えるたびに律速になる構造を、プッシュ型からプル型のタスク設計へ切り替えて解消したと述べている。@Fukada13:02
39Claude CodeとZenn CLIで「下書き→レビュー→自動投稿」の仕組みを作ってみたプログラミング初心者が専門用語を1つずつ確認しながら、Claude Codeが下書きを作り人間が最終チェックしてコマンド1つでGitHubへpushするZenn投稿の自動化を組み立てた記録である。@おかめ13:05
40Devinを1週間試して導入をやめた話Devinは3リポジトリで実行環境が立ち上がりPRがマージまで到達したにもかかわらず導入を見送ったとして、クラウド型エージェントの強みが自チームの条件と噛み合わなかった理由を1つずつ突き合わせている。@VESS Labs13:08
41AIの拡張機能を1行で読ませたら5種類の部品が一度に入った。名前を1語変えただけで、同じ中身が5回中0回から3回中3回に化けたClaude Codeのプラグインは1行渡すだけで5種類の部品が同時に登録されたものの「入った」と「使える」は別で、名前を1語変えただけで呼び出し成功率が5回中0回から3回中3回に変わったと実測している。@ぬまーんのZenn記事13:17
42エージェントは「差分の外」を読む:ADK for Go で AI レビューを作り直した実践Gitの差分をGeminiに1回投げるだけの構成では原理的に拾えない指摘があると分かったため、ADK for Goのエージェントループへ作り直し、差分の外まで読ませる設計に変えたと報告している。@shouni13:22
43インストール数の15.8%が、検証済みコピーに乗っている2026年8月12日に凍結したカタログ79,848件をSKILL.md同士で突き合わせた結果、ファイルが同一の検証済みコピーが3,443件あり、掲載の4.3%がインストール総量の15.8%を集めていたと明らかにしている。@Skillselion13:37
44AIエージェントが「知っているはず」を間違える理由 — コンテキスト設計の実務CLAUDE.mdに書いたルールが守られないのは確率の問題ではなく構造の問題だとして、コンテキストを3層に分ける設計と、劣化に気づかない状態を検知する測定方法を示している。@saito13:50
45AIコンテキスト設計ガイド ── 規約を配ったのに守られない理由rulerやrulesyncで規約の配布は解決済みでも「配ったのに守られない」は残るとして、層の切り方・規約が効かなくなる4パターン・「指摘0件」を安定と誤読しない読み方を扱う書籍を公開している。@saito13:50
46完全無料&クレカ登録なしでAmazon Quick on Desktopを試そう!AWSのエージェント型AIワークスペースAmazon Quickは2026年4月の無料プラン追加により、AWSアカウントもクレジットカード登録も不要で個人メールだけからサインアップできるようになったと案内している。@Hikotty / Hikoto Iseda14:03
47公式仕様とGoogle・Vercel・AWSの発信から考えるAgent Plugins 1.0.0の狙い2026年8月6日公開のAgent Plugins 1.0.0は、Agent SkillsやMCP Serverを1つのPluginにまとめて複数クライアントで使える「portable package format」であり、AWS・Anysphere・GitHub・Microsoft・OpenAI・Vercelの代表者が策定に関わったと整理している。@Hikaru Umeda14:10
48社内文書AIにベクトルDBは要らなかった — 全文投入で本番運用した設計と限界チャンク分割・埋め込み・ベクトルDBという定番構成をすべてやめ、マニュアル全文を毎回プロンプトに入れる構成で2社のSlackボットを本番稼働させており、決め手は精度ではなく運用が壊れにくいことだったと述べている。@ty111014:22
49あなたの世界認識あなたのポリシーバイキング会場での食事選択を例に、環境・行動主体・ポリシー・報酬という強化学習の枠組みを日常の意思決定へ引き寄せて説明している。@しもし14:38
50”なぜGeminiに『ペルソナ』を設定すると優秀になるのか?言語学で解明する最強のプロンプト構成”「あなたは〜です」という役割付与がなぜ効くのかを、AIに感情はないはずだという素朴な疑問から出発し、言語学の観点でペルソナ設定の必要性を説明している。@saki14:55
51同じ言葉の数を数えるのをやめたら、AI文と人間文の差が2倍開いた — LLMを使わないAI文章検出のチューニングLLMを使わずにAIらしい表現へ印を付けるチェッカーNingenizeについて、同一語の出現数を数える指標をやめたところAI文と人間文のスコア差が2倍に広がったとチューニング結果を報告している。@植木鉢団15:13
52AIコーディング時代のアーキテクチャ選定は、実装速度より運用コストを見るAIコーディングで下がるのは主に実装時間であり、監視・例外対応・変更・引き継ぎまで含めた保有コストは自動では下がらないとして、技術選定を月額料金だけで比較してはいけないと論じている。@亀井優希|AI前提で会社を作り直す15:52
53AXIOM Capsule DEMO最小構成で検証する「不変性・決定論・制約強制」状態の意図しない書き換えや非決定的なID生成といった問題に対し、「ルールとして守らせる」のではなく変更経路そのものを構造化して制限する設計思想を、Rustコードと実行ログで検証している。@kishimoto-void16:02
54Codexでチェスコーチツールを作ってみた初心者から上級者まで挫折しやすいチェスの上達を支えるため、Stockfishを組み込んで対局を振り返れるコーチツールをCodexで作ったと紹介している。@れん16:05
55DeepSeek HarnessにTencent Cloud TokenHubを接続して、ブラウザゲームを作らせてみたDeepSeek AIが公開したオープンソースのAgent実行基盤DeepSeek Harness(Developer Preview)に、Tencent CloudのTokenHubをモデルプロバイダーとして登録し、実際にブラウザゲームを作らせた検証を記録している。@moonwalker16:06
56DeepSeek V4 Flash を DGX Spark x1 台で動かしてみたメモDGX Spark 1台でDeepSeek V4 FlashのGGUF量子化モデルをローカル推論させた手順を、専用推論エンジンds4のDGX Spark最適化フォークとワンコマンドインストーラーを使って記録している。@べるべる16:08
57バイブコーディングバイブル 〜コードを書かずに、つくりたいものをつくる〜コードは書けないが作りたいものがある人向けに、GitHubに構想を書き決めるところだけ決めて残りをAIに任せ、Claude CodeとGitHubだけで公開し数字で育て続けるまでを実践書としてまとめている。@JJ yamitake16:37
58firecrawl/anydoc でドキュメントを Markdown に変換する検証Word・PDF・Excel・PowerPointの4形式のファイルを用意し、firecrawl/anydocでどこまで正しくMarkdownへ変換できるかを実際に試して結果を比較している。@やきそば16:38
59Colab MCPが便利Colab MCPを使うとエージェントの実行環境としてGPUが使えるうえ、Colab経由でGoogle Driveにアクセスして実験結果を出力し別エージェントから参照できたとして、設定時に引っかかった点を書き留めている。@if00118:09
60毎日無人でPRを作らせる ― 人間が押すのは公開ボタンだけ、踏んだ罠は4つ毎日18時に無人でネタ選びから下書き・PR作成まで済ませる構成を組んだところ、定時実行そのものより段取りが難しく、自動化スクリプトがpushの成否を取り違える問題に最も時間を溶かしたと明かしている。@ほし18:14
61【5分でわかる Foundry Tools シリーズ】Azure Speech で英語の発音評価するAzure Speechの発音評価が返す4種類のスコアを取り上げ、付属のBicepでjapaneastに検証環境を作り、英文から単語別の発音スコアと読み飛ばしを取得するまでを解説している。@yukurash18:22
62【Kitesurf】Playwright MCPを常駐させないブラウザ戦略Global設定にMCPサーバーを置くとAgent起動のたびにプロセスが増えメモリを圧迫するため、コンテキスト占有だけでなくメモリ消費の観点からもブラウザ系MCPを常駐させない構成へ変えたと説明している。@uuta18:32
63Gemini 3.7 Flash Is Here: What the Benchmarks Actually Say(Gemini 3.7 Flash 登場:ベンチマークが実際に語っていること)Googleが2026年8月13日に3.6 Flashのわずか3週間後、半額の提供価格でGemini 3.7 Flashを発表したとして、公式ベンチマーク表がハイライト以外に何を示しているかを読み解いている。@NeoTechPark18:53
64AIは3Dをどこまで作れるのか — 2.5Dと高度な3D Geometryの間にある壁Claude Opus 5がAutodesk Fusionを操作し、4気筒ピストン・クランク機構や二段式ゼネバ機構などを1プロンプト・追加指示なしで15〜25分で作った結果を示し、2.5Dと高度な3D幾何の間に残る壁を検討している。@0xL1C10G19:00
65Claude Code で make run-api を実行したら postgres ホスト名が解決できなかった話DevContainerで開発しているGoのAPIサーバーをClaude Codeのターミナルから起動するとpostgresのホスト名解決に失敗する現象について、原因と対処をまとめている。@tsuzudev0519:27
66Claudeが全出力に”見えない透かし”を入れ始めたので、AI使用を100%公言している個人開発者が検査を1本だけ足した話2026年8月11日のAnthropicの透かし導入以降、議論の重心が「どう検出を逃れるか」に寄っているとして、AI使用を全面的に公言する立場から逆に検査を1本足すという対応を選んだ理由を書いている。@Abyssgate開発中19:28
67AIがこっそり仕込むウォーターマークの仕組みを初心者向けにマンガで解説画像はピクセルに情報を埋め込めるがテキストにはピクセルが無いため、文章の意味や文体を変えずに統計的特徴を残す方式が採られていると、AI生成物の透かしの仕組みをマンガで説明している。@satoshi yoshida - 思考アトリエの遊び場20:18
68Claude Codeのサブエージェントに何を記憶させるべきか:memory: projectの設計と検証Windows上のClaude Code 2.1.160で検証したうえで、memory: project で重要なのは記憶量ではなく、次回も使う確認済みの事実を根拠・確認日・更新条件と一緒に保存することだと結論付けている。@Kai@生成AI20:32
69責任OSを、AIの内側へGhostDrift数理研究所が「GD-Attention」と「意味生成OS(MG-OS)」に関する2件のPCT国際出願と、数理核をLean 4で形式化した公開リポジトリを発表したとして、責任OS研究がAIアーキテクチャ自体へ向かう理由を説明している。@株式会社GhostDrift数理研究所20:39
70Webアプリの「良い設計」を考えるためのHumane by Design入門AIツールで曖昧な指示からでも動くものが作れるようになった今こそ「それは本当に作るべき機能か」が問われるとして、Humane by Designの観点からWebアプリの振る舞いを考える枠組みを紹介している。@midpoint20:41
71エージェントハーネスのLSP統合機能の調査Claude CodeやCodexといったエージェントハーネス各社でLSP統合の提供状況が揃っていないことに気づいたとして、2026年8月18日時点の現状をMCPとの対比で調査している。@netai20:41
72禁止すれば安全、良い例を見せれば的確、資料を読ませれば賢くなる——本当に?自律型Botとローカルの自己対話システムを約半年運用する中で、禁止・良い例の提示・資料の追加という3つの直感がそれぞれ別の形で裏切られた場面を、実測ログとともに4つの癖として紹介している。@MotimotiNotch20:41
73【Docker Sandboxes】AIエージェントを安全に自律実行させる隔離環境YOLO modeでエージェントに最大限の自律性を与えると意図しないディレクトリの読み書きや破壊的コマンド実行のリスクを負うとして、Docker Sandboxesによる隔離実行環境を解決策として提示している。@ykbone20:42
74LLMに長いPDFを書類ごとに分割させると、出力からページが消える巨大なスキャンPDFを書類単位で分割させるとLLMの判定結果はもっともらしく返るのに一部ページが静かに欠落するとして、その症状の潰し方を具体的に示している。@shinsei9920:47
75ChatGPTの?q=は長文を無言で捨てる。「AIに聞く」ボタンで踏んだ5つの罠自サイトに「ChatGPTで開く」ボタンを付けプロンプトをURLエンコードして?q=に載せたところ、長文が無言で切り捨てられて入力欄が空になるなど5つの罠を踏んだと報告している。@井本 賢|WebRTC×音声AI / LLMO21:00
76中学生の期末試験対策を、Claude Codeで”AI家庭教師チーム”運用してみた中学1年生の前期期末試験対策として、5教科担当と品質チェック担当のAIチームを自身がPMとして運用し、苦手把握から対策・再チェック・見直しのPDCAを親子で回した実践を記録している。@Jiro21:07
77【CC0】プラカゴのステッチを数理コード化したら、AIに「将来のために」とWebアプリまで作らされた話六つ目編みの「華編み」など伝統的な差しひも技法を数理的にコード化したところ、AIに将来の再利用を理由にWebアプリ化まで進められたという制作記録である。@haru@CraftBandLabo21:08
78AIオーディオはテキスト読み上げの時代を離れつつある読み上げ・声のクローン・BGM生成・効果音がそれぞれ別ツールに分かれ最後に人が組み合わせる従来の構図に対し、Seed Audio 1.0が示すマルチモーダルな音声制作の方向性を論じている。@funnycoding21:19
79ComfyUIのノード地獄から解放!MiniMax動画・画像生成を「Agent Skill」と「専用GUI」で誰でも扱えるようにした話ComfyUIは自由度とメモリ効率に優れる一方でノードと配線に圧倒されて挫折する読者が多かったとして、MiniMax H3の動画・画像生成をAgent Skillと専用GUIから扱えるようにしたと説明している。@lumichy21:29
80OCRの精度が出ないと思ったら、紙が横向きだっただけの話登記簿PDFの読み取り精度が安定しない原因はプロンプトではなくスキャン時の向きで、読ませる前に画像を回転させることが効いたと突き止めている。@shinsei9921:32
81CMP170HXを検証するNVIDIAが暗号資産マイニング向けに用意したCMPシリーズ最上位のCMP170HX(8GB HBM2e)を、GA100系のA100 80GB PCIeと仕様面で並べて比較検証している。@SORA21:36
822026年8月公開のQwen3.8-27BをRTX 5090で実測|ローカルLLM 5モデル徹底比較RTX 5090(VRAM 32GB)1枚で翻訳・コーディング・構造化抽出・画像読取・論理推論など6タスクを5モデルに解かせ、同じ27Bでも生成速度に2.4倍の差が出たとして構成を入れ替えたと報告している。@セキュア&オートラボ22:35
83Codexを「Solが監督、Luna Maxがworker」の構成にするCodexの親エージェントにgpt-5.6-sol、サブエージェントに推論強度maxのgpt-5.6-lunaを割り当て、判断と統合は親が、調査や実装は軽量なサブが担う役割分担を紹介している。@きょん22:45
84CPUのみでローカルLLMするWindows・CPUのみ・RAM 16GB以上という条件でローカルLLMを動かす方法として、SMTが有効なCPUではCPU affinityの指定によりPrompt Processingの性能が明確に向上すると発見を共有している。@molelord22:55
85【紹介リンクあり】RunPodの料金体系を徹底解説!GPU別単価・ストレージ課金の落とし穴・最安運用のコツRunPodは秒単位の完全従量課金制であるとして、GPU別の単価やストレージ課金の落とし穴を整理し、最安で運用するための勘所を解説している。@StudySun22:59

Qiita

#TitleSummaryAuthorPublished
1ChatGPTの記憶機能、実は覚えるだけじゃなかった|人物像が自動で作られるChatGPTの記憶機能は入力内容を保存するだけでなく、そこからユーザーの人物像が自動的に組み立てられていく仕組みだと動画解説を交えて説明している。@kinamocchi_tech09:08
2【Codex】同じ権限承認を毎回求められて作業が止まる時の対処法Codexで承認ダイアログの無限ループに陥り自走させられない問題は、実行ポリシー(rules)にコマンドのprefixを登録するだけで解決できると示している。@kawamon-idealive10:02
3Tencent Cloud TokenHubのモデルをDeepSeek Harnessで利用する方法DeepSeek AIが公開したオープンソースのAgent実行基盤DeepSeek Harnessに、Tencent CloudのTokenHubをモデルプロバイダーとして登録する手順を2026年8月18日時点の検証としてまとめている。@moonwalker14:08
4SDKなしでMCPのStreamable HTTPサーバを作って、仕組みを理解する【MCP深掘りシリーズ 2】MCPの技術要素をSDKなしの生実装と実測ログで解剖するシリーズ第2回として、Streamable HTTPサーバを自前で組み立てながら通信の中身を理解していく。@musa_rock14:41
5数千万ドキュメント規模の巨大エンタープライズRAG:検索速度と精度を両立させるハイエラキー型インデックス数千万ドキュメント規模の企業向けRAGで検索速度と精度が両立しない課題に対し、階層構造を持つインデックス設計で解決する方針を提示している。@NKKTechGlobal15:09
6AIエージェントが直接書き込むノートアプリ「hanamask」を作った「本文はエージェントが書き、人間が読む」をコンセプトに、AIエージェントとの協働に最適化したノート・タスク管理デスクトップアプリ hanamask のv1.0.0を公開したと発表している。@takudon16:04
7MCP AppsのAgent UIは、チャット欄より先にtool stateを型にするMCPツールをReactへ載せる際、見た目より先に「承認待ちか、実行してよいか、処理中か、止まったか」というtool stateを型として定義すべきだと主張している。@heftykoo16:47
8Gemini Notebook(NotebookLM)を複数横断で使う小技Gemini Notebook(旧NotebookLM)には現時点でNotebookの合体機能が無いため、内容が重複してきた複数のNotebookを横断して扱うための小技をメモしている。@Akiko_Miyamoto16:56
99. LangGraphで障害対応Agentの流れを作るNMS APIで装置状態を取りCMDB APIで拠点や担当を調べるといった一連の障害対応を、LangGraphでエージェントのフローとして組み立てる方法を解説している。@bahamutra17:12
10Embeddingをもう少し深掘りしてみた ~ベクトル化・次元数・類似度検索・RAGでの使い方~Embeddingの入門記事の続編として、ベクトル化の中身・次元数の意味・類似度検索の仕組み・RAGでの具体的な使われ方まで踏み込んで整理している。@Sho5_Matsu18:18
11RAGシステム最適化!ベクトルDB選定とチャンキングでやった3つのことRAGを導入しても期待する回答が得られない・幻覚が解消されない・検索が遅いという現場の課題に対し、ベクトルDB選定とチャンキングで実際に効果があった3つの施策を挙げている。@DaokFrontier19:52
12Claude Code v2.1.234アップデート解説:NTLM認証情報漏洩対策など2026年8月リリースのClaude Code v2.1.234はセキュリティ強化が中心で、Windows環境のNT名前空間パス(??\)を使ったNTLM認証情報漏洩への対策とMCP診断の修正が特に重要だと解説している。@picnic20:43
13大人用です。半円「高校入試チャレンジ問題 a²+b²=?」様を、計算はsympyで作図は手抜きのつもりでした。高校入試の半円を題材にしたチャレンジ問題を、計算はsympyに任せ作図は簡略化する方針で解こうとした過程を記録している。@mrrclb48z21:25
14Amazon Bedrock Playgroundで理解するTemperature・Top P・Top K ― AWS Certified AI Practitioner試験対策AWS Certified AI Practitioner(AIF-C01)に合格した経験を踏まえ、最初はつかみにくいTemperature・Top P・Top Kの違いをAmazon Bedrock Playgroundで手を動かしながら理解できるようまとめている。@dev_toshinori22:39
15ChatGPT を「前回の続き」から始めるための状態設計 — Instructions / Memory / Knowledge / Causal Posterior / Recent StateChatGPTと長時間話しても次回は文脈が失われる痛みに対し、Instructions・Memory・Knowledge・Causal Posterior・Recent Stateという5つの層に分けた状態設計を提案している。@dosanko_tousan23:09
16ローカルLLM × Prometheus MCP構築記録Grafanaで可視化できてもメトリクスの意味を読む作業は手間がかかるとして、ローカルLLMとPrometheus MCPを組み合わせ監視データをAIに分析させる環境を構築した記録である。@kyohey-k23:15
17Claude Code /todo の resume_condition——タスクが「昇格していいですか?」と確認してくるTODOリストGitHub Issuesを使うGTDタスク管理スキル /todo に、完了時の次タスク提示・依存関係での自動昇格・時間経過という3つの条件で向こうから次の一手を提示する機能を実装したと説明している。@saitoko23:23
18Claude Codeのサブエージェントでドキュメント自動生成の仕組みを作る方法設計書を毎回手打ちで直し要件定義が属人化するという悩みに対し、Claude Codeのサブエージェントを使ってドキュメント生成を自動化する手順を示している。@kamome_susume23:24
19リクエストベース課金のLLMアプリ設計――「さくらのAI Engine」のためのAPI型AIの多くが入出力トークン量による課金である中、リクエスト単位で課金される「さくらのAI Engine」を前提にした場合にアプリ設計がどう変わるかを検討している。@kedama-t23:34

ITmedia AI+

#TitleSummaryPublished
1ChatGPTやClaudeの利用量とコストを一元管理、無料で使える法人向け新サービス マネーフォワードマネーフォワードが法人向けに「マネーフォワード クラウドAIトークン管理」の提供を始め、共通ID「マネーフォワードID」を取得すれば無料でAIサービスの利用量とコストを一元管理できるようにした。06:50
2なぜ「純国産AIは無理」なのか? さくらとSakana AIが示す「ソブリンAI」の現実解一国の判断で主要AIサービスの提供が止まりうる時代に日本企業がAI主権をどう守るかについて、さくらインターネットの田中邦裕社長とSakana AIの石井順也氏がそれぞれの現実解を語っている。08:00
3AIエージェントでCADやCAMを連携、製造プロセス自動化へデータ・デザインが製造現場向けAIエージェントの研究開発と実証実験を開始し、CADやCAMなどのツールを連携させて設計から品質管理までの業務プロセス自動化を目指すと発表した。09:00
4なぜPFNは「国産AI」をゼロから開発するのか 担当者に聞く”自家製ならではの利点”「国産」をうたうAIモデルをフルスクラッチで開発するPreferred Networksに対し、なぜゼロからの開発にこだわるのかを担当者へのインタビューで掘り下げている。10:03

GIGAZINE

#TitleSummaryPublished
1希少本の輸送状況を追跡したらAmazonのAIトレーニング施設に到着していたことが判明404 Mediaが大量注文された希少本の1冊に追跡装置を仕込んだところ、ラスベガスにあるAmazonの書籍デジタル化施設へ到着し、同社が学習データ用に背表紙を切り落としてスキャンしていることが裏付けられた。11:43
2Googleが倒産したスピリット航空のメール1億件・Teamsチャット5億件を約16億円で購入へ、AIモデルの学習などに利用Googleが経営破綻した格安航空会社スピリット航空の社内データを1000万ドル(約16億円)で取得する見通しで、約1億件のメールや約5億件のTeamsチャットを製品開発やAIモデルの改善に使う方針だと報じられている。12:22
3Telegramの海賊版配信者をAIで自動検出するツールを研究者らが開発、61日間で海賊版チャンネル524件とボット71件の削除に役立つルイジアナ州立大学とテキサス大学アーリントン校の研究者らが「Telegram上の動画海賊行為に関する最初の大規模な研究」と称する分析を発表し、開発したAI検出ツールが61日間で海賊版チャンネル524件とボット71件の削除に寄与したと示した。15:16
4Anthropicの年換算収益が10兆円超で2025年末実績の約7倍に、四半期売上高は前年同期比14倍以上Anthropicの年換算収益が650億ドル(約10兆円)を突破し、2025年末時点の約90億ドルからわずか7カ月ほどで約7倍に拡大したことが明らかになった。15:20
5Appleの「カメラ搭載AirPods」がリリース間近らしいことがmacOSリリース候補版内のファイルから判明macOS Tahoe 26.7のリリース候補版に含まれるファイルから多数の未発表製品の存在が判明し、Appleがカメラ搭載のAirPodsを開発しておりまもなくリリース予定であるとみられている。22:40

Publickey

#TitleSummaryPublished
1Pythonライクで高速な「Mojo言語」がバージョン1.0に到達、今後はコンパイラをオープンソース化すると表明Modular社がAIの高速実行を目指すPythonライクな言語Mojoのバージョン1.0到達を発表し、標準ライブラリのオープンソース化以降200人近い貢献者が20万行超を変更したと述べ、今後はコンパイラもオープンソース化すると表明した。00:40
2Visual Studio Code 1.133正式リリース。プロンプトを見失わない固定スクロール、ローカルHTMLファイルの自動リロード、ClaudeとCopilotの混在可能など新機能マイクロソフトがVS Code 1.133を正式リリースし、プロンプトを見失わない固定スクロール、ローカルHTMLプレビューの自動リロード、Claudeセッションの柔軟な扱いといった新機能を追加した。00:42

OpenAI Blog

#TitleSummaryPublished
1Asana cleared 5 years of engineering work in 2 weeks with Codex(Asana、Codexで5年分のエンジニアリング作業を2週間で片付ける)AsanaがOpenAI Codexを使って旧式のテストシステムを2週間で置き換え、5年かかると見込まれていた作業を約1万2000ドルで完了したと事例として紹介している。16:00
2Partnering with CodeAI to prepare the first AI generation(CodeAIと提携し、最初のAI世代に備える)OpenAIとCodeAIが提携し、学生がAIリテラシーを身につけ、AIについて批判的に考え、責任を持って使いこなし形づくる力を養えるよう支援すると発表した。20:00
3Pacing model development in an era of cyber-critical capabilities(サイバー領域で決定的な能力を持つ時代におけるモデル開発のペース調整)OpenAIがフロンティアモデルに対する監視・アライメント・セキュリティを強化しているとして、新たなセーフガードがモデル開発のペースをどう方向付けているかを説明している。20:00

Hugging Face Blog

#TitleSummaryPublished
1Same Cluster, 33 Points More Utilization: What Changed Was the Order(同じクラスタで稼働率33ポイント増:変わったのは順序だった)Dharma-AIが制約を考慮するGPUアロケータを作り7つのベンチマークシナリオでFIFOスケジューラと比較したところ、同一ハードウェア・同一ワークロードでGPU稼働率が最大33ポイント、優先度重み付き出力が最大105%向上したと報告している。04:46
2Multi-Vector (Late Interaction) Embedding Models with Sentence Transformers(Sentence Transformersで扱うマルチベクトル(レイトインタラクション)埋め込みモデル)Sentence Transformers v6.0でColBERT系のレイトインタラクション検索に対応する4つ目のモデル型MultiVectorEncoderが追加され、PyLateやStanford-NLP ColBERTのチェックポイントをそのまま読み込めるようになったと解説している。09:00

Simon Willison

#TitleSummaryPublished
1We Tracked a Shipment of Rare Books. It Ended at an Amazon AI Training Facility(希少本の発送を追跡したら、行き着いた先はAmazonのAI学習施設だった)価格に無頓着な匿名の顧客から書店が大量注文を受けるという以前からの噂を、404 MediaがAirTagを使って追跡し裏付けた優れた調査報道だと評価している。00:21
2Qwen 3.8 27B scores 52 on the Artificial Analysis Intelligence Index(Qwen 3.8 27B、Artificial Analysis Intelligence Indexで52点)Qwen 3.8 27Bのスコア52はGPT-5.6 Luna(max)と同点でGLM-5.2やDeepSeek V4 Proにわずか1点差だが、GLMは753B、DeepSeekは1.7Tパラメータであることを踏まえると驚異的なモデルだと評している。08:58

The Decoder

#TitleSummaryPublished
1Anthropic increases revenue sevenfold, hits annualized rate above $65 billion(Anthropicが収益を7倍に、年換算650億ドル超に到達)Bloombergによると、Anthropicの年換算収益が1年で7倍に増えて650億ドルを突破し、早ければ2026年秋に1兆ドル評価で上場してOpenAIに先んじる可能性があると報じている。16:37
2AI systems quietly drop user instructions when they compress context(AIシステムはコンテキスト圧縮時にユーザーの指示を静かに捨てている)長い会話を圧縮する際に「承認なしにメールを送らない」といったユーザー規則が平均83%失われるとして、ペンシルベニア州立大学の研究者がQwen3.5-9Bベースの小さな追加モジュールで90%超を保持できると提案している。17:22
3Claude Code gets a /design command that lets developers create UI mockups right in the terminal(Claude Codeにターミナル上でUIモックアップを作れる/designコマンドが追加)Anthropicが/designコマンドでビジュアルデザインのワークフローをClaude Codeへ持ち込み、コードを書く前にターミナル内のアートボードとしてUIモックアップを生成でき、既存コードベースを読んで現在のUIスタイルに合わせると伝えている。19:06
4Anthropic’s per-token cost runs 4.4 times the average on Vercel, and developers keep paying(Anthropicのトークン単価はVercel上で平均の4.4倍だが開発者は払い続けている)VercelのAI Gatewayにおける7月の支出でAnthropicが全収益の65.1%を占めた一方、処理トークンでは30%にすぎず、トークン単価が競合平均の4.4倍だったと報じている。19:45
5DOJ probes Andreessen Horowitz over partners sitting on competing AI boards(米司法省、競合AI企業の取締役を兼任するパートナーをめぐりAndreessen Horowitzを調査)米司法省がAndreessen Horowitzを反トラスト法違反の疑いで調査しており、同社パートナーが競合するデータ企業DatabricksとFivetranの取締役を同時に務めている点が問題視されていると報じている。20:35
6As AI beats doctors, regulators shouldn’t force a human into the loop, JAMA piece says(AIが医師を上回る中、規制当局は人間の介在を強制すべきでないとJAMA論説)医学誌JAMAの論説が、自律型AIは医療推論タスクでいずれ医師とAIの組み合わせをも上回るとして医師の最終判断を規制に書き込むことに警鐘を鳴らす一方、根拠のほとんどが実診療ではなくシミュレーションだと認めていると紹介している。20:43
7Anthropic CEO says AI centralizes by nature and open models just shift power to whoever owns the chips(AnthropicのCEO、AIは本質的に集権化し、オープンモデルはチップ保有者に権力を移すだけと主張)X上でAI規制をめぐる論争が公然化し、Gavin Baker氏やDavid Sacks氏、Yann LeCun氏がDario Amodei氏を恐怖訴求で規制上の優位を得ようとしていると批判したのに対し、Amodei氏は規制は企業権力の抑制にもなりオープンモデルだけでは計算資源を持つ側に権力が移ると反論したと報じている。22:07
RECENT ISSUES 最近の号 BACK NUMBERS

すべてのバックナンバーを見る →