VOL. 094
AI NEWS DIGEST
AI OUTLINE
2026-07-29
水曜日 · JST
TODAY’S ISSUE 2026年7月29日 · 水曜日 AI FRONTLINE

AIニュースまとめ 2026-07-29|Claude Mythosが耐量子署名HAWKの強度を半減

アップデート情報

各社が 2026-07-29 に公式発表したプロダクトアップデートです。

Claude / Claude Code

ChatGPT / Codex

Gemini

Top 20

Anthropicのミュトス、暗号アルゴリズムの新たな攻撃法を発見――耐量子署名「HAWK」の強度を半減

Source: ITmedia AI+ | Published: 2026-07-29 07:50 JST

OpenAIやAnthropicなどの従業員、米政府に「AI開発のペース調整を」と提言

Source: ITmedia AI+ | Published: 2026-07-29 08:26 JST

Hugging Face、AIエージェント侵入の技術詳細を公開──OpenAIモデルが4.5日で1万7600回の攻撃操作

Source: ITmedia AI+ | Published: 2026-07-29 10:29 JST

デジタル庁、AI基盤「源内」を被災自治体などに緊急提供 「平時をはるかに超える業務」対応のため

Source: ITmedia AI+ | Published: 2026-07-29 12:52 JST

OpenAIが文字起こしAI「GPT Transcribe」と「GPT Live Transcribe」をリリース

Source: GIGAZINE | Published: 2026-07-29 10:39 JST

OpenAI open-sources Codex Security CLI to help developers find and fix vulnerabilities from the command line(OpenAIがCodex Security CLIをオープンソース化、コマンドラインからの脆弱性の発見と修正を支援)

Source: The Decoder | Published: 2026-07-29 20:50 JST

OpenAIのAIエージェントが誤ってHugging Faceを侵害した件でHugging Faceが詳細なタイムラインを公開、攻撃過程を中国製AIの「GLM-5.2」で分析し再現

Source: GIGAZINE | Published: 2026-07-29 12:17 JST

ChatGPT WorkとCodexの5時間制限「明日から再開」 GPT-5.6 Solの“トークン消費問題”を改善

Source: ITmedia AI+ | Published: 2026-07-29 16:29 JST

Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 Incident(フロンティアラボにおけるエージェント侵入の解剖:2026年7月インシデントの技術的タイムライン)

Source: Simon Willison | Published: 2026-07-29 06:28 JST

MCP 2026-07-28仕様解説:ステートレスコア化と標準拡張で変わるAIエージェント開発

Source: Zenn | Published: 2026-07-29 12:35 JST

AIと外部ツールをつなぐ共通規格「MCP」が過去最大のアップデート、セッション廃止で何が変わったのか?

Source: GIGAZINE | Published: 2026-07-29 12:37 JST

Hugging Faceは女性や子どもの無断ヌード画像生成に使われており予防措置が講じられていないとの調査結果

Source: GIGAZINE | Published: 2026-07-29 15:00 JST

PFN「国産AI」で自衛隊を支援へ 防衛の作戦立案に利用 防衛装備庁の実証実験を受託

Source: ITmedia AI+ | Published: 2026-07-29 15:38 JST

agent-browserはもう古い? Web調査をコマンドに変えるOpenCLI

Source: Zenn | Published: 2026-07-29 18:40 JST

GPT Transcribe improves on its predecessor but can’t catch ElevenLabs, Google, or Mistral on error rates(GPT Transcribeは前世代を上回るが、誤り率ではElevenLabs・Google・Mistralに届かない)

Source: The Decoder | Published: 2026-07-29 21:45 JST

MCPの大型アップデート(2026-07-28)で何が変わったか —— TypeScript SDK v2で試す

Source: Zenn | Published: 2026-07-29 23:05 JST

人間・Claude・Codex で三者分業したら、レビュー指摘は全部 AI が見つけていた

Source: Zenn | Published: 2026-07-29 09:00 JST

Apple Neural Engine で LLM を、出力を変えずに高速化する — Core ML 投機デコードの実装

Source: Zenn | Published: 2026-07-29 10:44 JST

Local LLM で画像の PII マスキングを試してみた

Source: Zenn | Published: 2026-07-29 11:13 JST

AI企業の従業員ら1171人がアメリカ政府に「AI開発のペースを制御する取り組み」への支援を要請

Source: GIGAZINE | Published: 2026-07-29 11:20 JST


All Articles

Zenn

#TitleSummaryAuthorPublished
1Claude Code のサブエージェントを、ビルトインからカスタムまで作って運用してみたビルトインのExploreやcode-reviewerと自作カスタム版を/contextでコンテキスト使用量を測って比較し、タスクの種類によって専用サブエージェントの効果は一様ではなかったと報告している。@s.shohei00:00
2AIエージェントは”ぼったくり”も承認する!AP2に足りない「価値の検証」を作ったGoogleのAP2はIntent・Cart・Paymentの署名連鎖で「誰が承認したか」を検証できるが価格の適正までは保証しないと指摘し、価値検証の仕組みを自作したと報告している。@大賀俊勝00:30
3帳票PDFの自前実装、今日でやめられます——日本語対応の帳票生成API 10分ハンズオン日本語フォント埋め込みや改ページ制御、Chromiumプロセス運用といった自前PDF生成の落とし穴を挙げ、帳票生成APIへ置き換える手順を10分のハンズオンとして示している。@kobo_sta03:35
4AI返信の承認者が不在でも権限を広げない:代理承認の運用設計承認者の不在時に権限を安易に拡大せず、「役割」「期限」「対象範囲」「証跡」の4要素で代理承認を事前設計する方法を提案し、外部送信の最終操作は人が行う前提を置いている。@Kirisaki Kazuya05:37
5AIコーディングエージェント × 音楽制作の全体像 — Suno APIからDAW MCPまで、何ができて何が足りないか30以上のプロジェクトと論文を調査し、素材生成は成熟、DAW操作は急成長、両者を繋ぐワークフロー統合はほぼ空白という3層構造に整理している。@ryok05:59
63日間のAIタスク評価を「キャッシュ」として運用する、jagged frontierとTTL失効の視点からメール下書きはChatGPT、資料の骨子作成はClaudeが3日連続1位になった結果を評価キャッシュとして使い回す運用を提案し、サイレントアップデートに備えたTTLの必要性を論じている。@毎日AIレシピ06:08
7Claude Codeと壁打ちしながら車の比較表を育てた話car_compare.md という1ファイルにプロンプトを投げ続けて車種比較表を段階的に育てた過程を、実際のプロンプトと出力表の変化とともに記録している。@かた06:24
8Claude for Legal を『レビュー・監査』業務に入れる前に — 法律事務所向け・論点整理Anthropicが公開したclaude-for-legalは12のプラグインと80以上の名前付きエージェント、約20のMCPコネクタをApache 2.0で束ねた構成だと整理し、実務投入前の論点を洗い出している。@もちや。。06:50
9「RAG 作って」と言われたら何を聞くか — 実測から逆算する生成AIの非機能要件IPAの非機能要求グレードが2018年版のまま生成AIに対応していない点を出発点に、RAG構築を依頼された際に確認すべき非機能要件を実測から逆算して整理している。@Kazu07:30
10LangGraphでエージェント暴走を防ぐ設計チェックリスト主要ニュースの重心がモデル性能競争からエージェント運用と安全統制へ移ったと分析し、OpenAIとHugging Face周辺の事故を踏まえて先に設計すべき安全要件を列挙している。@子供部屋大学院生07:45
11「うまくいった」小さな検証が、間違った問いに答えていた話2記事だけの予備検証では要約を作るモデルを変えても類似度結果は変わらないという安心できる結論が出たが、30記事規模で問いを立て直すと結果が大きく違ったと報告している。@TheGateBreaker08:12
12自作APIをChatGPTからアクセス可能にする「Super MCP」メドレーのエンジニアが業務外で開発した個人用基盤Super MCPを紹介し、自作APIをChatGPTから気軽に呼び出せるようにする構成を解説している。@Reiju Takahashi09:00
13AIエンジニアとして本番環境で戦うための書籍5冊 ― 全体像から実装・運用まで論文やチュートリアルでは本番運用のイメージが湧かなかった経験から、1年半で15冊以上読んで実務検証した中から全体像・実装・運用を橋渡しする5冊を選んでいる。@Koukyo09:25
14コンテキストには、固定費と変動費がある。/contextで削れるのは前半だけだった/contextで内訳を実測するとMCP定義や常時読み込みのメモリファイル、システムプロンプトが作業前から席を占めており、削減できるのは固定費側に限られると整理している。@Rapls09:32
15GPT-5.6とBlender MCPで、多少マシな3Dモデリングをさせるまで単純な指示では積み木状のモデルしか出ないため、Blender用のAGENTS.mdとSkillに加えて計画・造形・視覚評価・メッシュ検査を分担する構成を組み、4時間26分でほぼワンショット生成したと報告している。@ぷらむらいす(PlumRice)09:57
16Backlogのタスクを Claude Code が検知して Devin に投げる——「AIがAIに仕事を依頼する」リレーを作った話100を超えるCMSリポジトリの定型作業を対象に、Backlogの起票をClaude Codeが検知してSlack経由でDevinへ依頼しPRを作らせるパイプラインを、Markdown2ファイルだけで構築したと報告している。@tsusk810:00
17RAGポイズニング入門 — AIの知識ベースを汚染する攻撃RAGが参照する「信頼できる情報源」自体に嘘を仕込む攻撃の仕組みを解説し、MCPと同じ「信頼できない入力をどう扱うか」という根本問題に帰着すると論じている。@mapellion10:00
18フォームは全項目埋まったのに画像だけ添付できない。正規ルートが通るのはCLI版だけだったClaude Codeデスクトップ版・Claude in Chrome・computer-useの3経路でPNG添付を試し、添付を止めている層はフォーム入力とは別で同じツールでも実行形態により判定が変わるとエラー原文付きで記録している。@Mxhlix10:02
19AI に「させないこと」から決める — Terraform のレビュー観点を6段階に分解した話コードレビューを6段階に分けた先行記事をTerraform版に落とし込み、AIにさせないことを先に決めることで人間とAIの分業が見えたと報告している。@ほんまでっか?10:07
20ESTR:非同期RLの重要性比をtoken熵でスケーリングし2.6倍加速重要性比の自然な尺度はトークンの局所エントロピーで決まると示し、絶対値だけで棄却する従来手法を改めて2.6倍の加速と方策崩壊の回避を両立させた論文を解説している。@Currently Learning そんけいご11:05
21『リーダブルコード』活用事例調査で、ChatGPTとClaudeに同じ依頼をして比較してみた4テーマ各2件の日本語実践事例調査を同一プロンプトでChatGPTとClaudeに投げ、AIにリサーチを任せるとどれだけ事実確認が省かれるかという観点で結果を比較している。@まなぶのzenn11:13
22プラグインを足す前に、AIに『会社の規則』を書いた話 ―― 5項目比べて、導入したのは1つだけでしたClaude Codeの強化をプラグインではなく制度側で解く立場から5項目を比較し、最終的に導入したのは1つだけだったと結論を示している。@ai_shihan11:22
23Kiro IDE と Claude Code を併用した運用方法について固定料金プランのトークン上限に達すると待機が必要になるClaudeと、クレジット制のKiroという課金構造の違いを整理し、両者を併用する運用の考え方を示している。@tomachi11:35
24Gemini 3.1 Flash TTS入門 — 音声タグとマルチスピーカーをAPIで実装する2026年4月15日にプレビュー公開されたGemini 3.1 Flash TTSは音声タグでセリフ単位に感情やペースを自然言語制御できると解説し、PythonでのAPI実装手順を示している。@甲斐 甲12:34
25☕ローカルLLMを回したままMacのフタを閉じたくて、スリープを防ぐmacOSアプリを個人開発した☕OllamaやLM Studio、MLXで長時間の推論を回している最中にMacBookのフタを閉じると強制スリープでジョブが止まる問題を解決するため、スリープ抑止アプリを自作したと報告している。@三尾商店|Macアプリ個人開発12:55
26スキルは増やしすぎると使われなくなるのか?実測したら原因はトークンではなかった全社配布しているsre-pluginのスキルが50個に達したとき一度も使われないスキルが出はじめ、実測の結果その原因はトークン量ではなかったと当初の仮説が崩れた過程を記録している。@KeitoInoue13:01
27実践 Agent Search:「苦いビール、ありますか?」MCP 経由のエージェントで自然言語フィルタを実現する「苦い」「アルコール強め」といった感性語の閾値制御が難しく対話性も欠けていた前回の課題を受け、MCP経由のエージェントが曖昧な指示を聞き返しながら検索条件を組み立てる実装を試している。@古川 人士13:09
28Claude Code の記憶を二層に分離する — 全部覚えさせて、毎回は読ませない1事実1ファイルで約16.4万字80ファイルを蓄積しつつ、バグ修正の依頼では0件、記事執筆では27件が候補に挙がり上位3件だけを読み込む選択的検索の仕組みを実測値付きで解説している。@takotyan0014:00
29自作リンタを230リポジトリに当てたら、8割が誤検知だった環境依存パスや未記載コマンド、残ったプレースホルダを検出するリンタを作って230リポジトリに適用したが、8割が誤検知だったと結果を公開している。@maronsan14:29
30Kimi K3は何が公開されたのか:2.8兆パラメータと約1.56TBの意味Moonshot AIの2.8兆パラメータモデルが推論用フルウェイトまでHugging Faceで公開され公式リポジトリは約1.56TBに達すると整理し、保管できることと実用速度で動かせることは別問題だと注意を促している。@ローカルAIラボ14:32
31【AI駆動開発 6】改善を定例化する — 「大切」なだけでは忘れる改善は緊急ではないため放置されると指摘し、週1回30分の棚卸しでAIへの指摘の再発防止策やスキル化候補を洗い出す定例化を提案している。@かわもん@idealive15:09
32Shader Graph と VFX Graph で2日溶かして、手書きシェーダーに変えたら半日で終わった話ローディング演出でShader GraphとVFX Graphに2日費やして進まず手書きHLSLに切り替えたら半日で完成したことから、原因は技術力ではなくAIエージェント併用との相性だったと結論付けている。@miya15:22
33【未来クライム】アドバンス第4回 — GitHub Pagesで世界に公開する未来クライム第4期アドバンスコースの教材として、前回の振り返りのあとGitHub PagesでWebサイトを公開する手順を解説し、最後にClaudeの事前登録を案内している。@is0629sy/GB15:24
34入力をサーバーに送らない Web ツールを4つ作った — Client Component + 純関数で閉じる設計投資判断メモ作成や配当金CSV集計など4つのツールを、認証なし・入力値をサーバーへ送らない・固定費を増やさないという制約から逆算してClient Componentと純関数で実装したと解説している。@ukintech15:40
35AIによる安全な自己書き換えを目指した新言語型推論や暗黙のデフォルト値は人間の労力削減のための機能であり書き手がLLMになれば暗黙性や非局所性がコストだけ残ると論じ、LLMを書き手と想定した言語設計を提案している。@コスパン15:48
36Claude Codeでスクレイピング・Excel自動化ツールを作った話プログラミング未経験の著者がClaude Codeで、URLリストとCSSセレクタをJSON設定で指定してExcelやCSVへ出力する汎用スクレイピングツールなど2つを作ったと実装を共有している。@たいき15:59
37Kimi K3、Opus 5、Nemotron 3 Ultra、Gemini 3.6 Flashのベンチマーク前回の課題文と隠しテストが公開で露出し訓練データに入り得るため新ミニゲーム「Ember Warden」で測り直し、課題が変わったため前回スコアとの数値比較はできないと明示している。@oubakiou16:08
38FastMCP 4 (MCP 2026-07-28) で何が変わった?MCP初心者にもわかる主要変更と移行ポイントFastMCP 4のWhat’s Newを基に主要変更を整理し、MCPサーバーの設計をどう考え直す必要があるかをMCP初学者にも読める形で解説している。@takassh16:20
39【Claudeトークン枯渇対策】AIが『頼んでないことまでやる』問題と抑止プロンプト外部レビュー指摘に引きずられたときだけでなくAIが自分の判断で動くときも常に「やりすぎる」圧力がかかると分析し、頼んでいない堅牢化でトークンが溶けるのを防ぐ抑止プロンプトを提示している。@fixU16:20
40オーケストレーターではなく調査役に Fable を活用した話batonプラグインの実運用でモデル配置を見直し、オーケストレーター役だったFable 5を外してinvestigatorという調査・推論を担う座席に置き直したと報告している。@okkun052416:25
41Claude Codeで宗教をつくろう #1教団ではなく愛や命や生の問いに一貫した答えを持つ世界観を指して「宗教」と定義し、その体系化をClaude Codeと進める過程の第1回を記録している。@nenune16:34
42Claude Codeで作ったAIエージェント、Claude自身に評価させてみたAI導入プロセスからWBSを自動生成するOSSプロジェクトAI-Agent-Dev-WBS-OSをClaude Codeで開発したうえで、Claude自身にレビューさせる自己評価の検証プロセスを紹介している。@codebay8816:45
43AI彼女アプリを作っていて気付いた。AIは記憶を持てた。でも関係は育たなかった記憶・想起・Mood・Dreamなど恋人らしい機能を積み上げて誕生日や好物を覚えさせられたにもかかわらず、関係が育つ感覚は生まれなかったという違和感を記録している。@mitsukida16:53
44Claude・Cursor・ChatGPT、結局3つとも課金してる話〜AIコーディングツールの使い分け〜Web制作の実務で3つを契約・解約しながら使い倒した結果、得意な場面が違いすぎて1つに絞れず全部課金し続けていると使い分けを整理している。@NADARAKAInc17:14
45AIと作った個人開発リポジトリを公開する前に整えた4つのことパワーリフティング向けプレート計算アプリをGitHubで公開する前に「このまま公開していいのか」と引っかかった箇所を4点に整理して手当てしたと記録している。@まつたけ18:00
46LLM モデルの差し替えを自動化する llm-replacer の紹介モデルIDがコード直書きや.env、SSM、Secrets Managerに散在するためEOL時の差し替えが手間になる問題に対し、特定から検証・PR作成までを自動化するツールを紹介している。@k_fukahori18:06
47Claude Code のステータスラインをドラクエ風にしたstatuslineにモデルで決まる職業(opusなら「けんじゃ」)や「なかま」の別ウィンドウを表示するRPG風のステータス表示を実装し、リポジトリを公開している。@yukurash18:15
48自分専用AI秘書の作り方|予定・タスク・メモを扱う最小実装「登録しました」と返すだけでどこにも残らないものはAI秘書ではないとし、予定・タスク・メモという3種類の状態変更を確認可能な1回の処理として完了させる最小実装を示している。@浅井めぐみ18:17
49人間のタスクを、そのまま自動化の単位にしない — 責務と完了条件で切り直す「依頼対応」「資料作成」のようなタスク名をそのまま自動化単位にせず、「見つけて人に渡す」と「成果物までやりきる」に分けて各々の頻度と完了条件を設計すべきだと提案している。@Yoshihiro Matsumoto18:17
50Vibe Quant Insight #001 — オープンウェイトの逆襲、アップルの逆説、そして自ら侵入したAIAI・クオンツ・セキュリティの交差点を扱う週刊ニュースレターの創刊号で、オープンウェイト勢の競合、Appleの戦略的な逆説、AIによる侵入事案を判断材料として整理している。@Dennis Kim18:35
51終わったことを、どうやって知る? 音声からAIエージェントへ仕事を委譲する条件ChatGPTのGPT Liveで相談した流れのままClaude CodeとCodexへ実装を渡す構成を試し、同じOpenAI系のCodexなら簡単に通るという当初の予想を検証しながら完了検知の条件を探っている。@Yukisuna77719:16
52Claude Code × Discord で作る「情報収集の全自動パイプライン」DiscordにURLを投げるだけでツイート取得・リンク先読み込み・カテゴリ判定・要約Markdown生成・GitHubへのcommitまで全自動で完了する仕組みを、Discordプラグインとスキルで構築したと解説している。@Tukiguti19:42
53複数のClaude Codeを「音」で見張る ── VOICEVOX読み上げとDiscordで通知するモニタを作ったWindowsでゲーム中にMac側のClaude Codeの状態が分からない問題に対し、パチンコ店のインカム運用を参考にVOICEVOX読み上げとDiscord通知で複数インスタンスを監視する仕組みを作ったと報告している。@Tukiguti19:42
54[AI家計簿] AIと相談しながら家族専用の家計簿システムを作ってみた ③ 〜レシート解析から家計簿データ化まで〜ローカルLLMやOCRの検証からGemini APIの比較、プロンプト調整までの試行錯誤を経て、レシート画像を家計簿データへ変換するAI解析部分を実装した過程を紹介している。@s.tak20:00
55CLAUDE.md に書くのをやめた — AIへの知識は、機械が「その瞬間」に届ける知識をSKILLへ外置きしCLAUDE.mdには呼び出し条件だけ書く設計でも守られなかったのは届けるタイミングの判断がモデル任せだったからだと分析し、機械側から届ける方式へ組み替えている。@TakaoNarikawa20:00
56MCP 2026-07-28: プロトコルコア再設計の要点と移行判断今回の変更はAPI追加ではなく通信モデルの再設計だとして、initializeやMcp-Session-Idの完全廃止とparams._metaへのプロトコルバージョン指定を挙げ、本番移行の指針をまとめている。@しんいち20:02
57【Claude Code】SKILLを作ってインストールするzenn-article-generatorというSKILLをゼロから作った体験を軸に、SKILL.mdの書き方とディレクトリ構成、Claude Codeに認識させるまでの流れを解説している。@pekopugu20:17
58仕様書の誤りをAIが見つけた —— 私にはそれが正しいか分からなかった依頼主から受け取った生年月日の計算式をClaude Codeに実装させたところ仕様書自身の記載例と式が矛盾するとAIから指摘され、専門教育のない自分には正否が判断できなかったと記録している。@airu20:28
59AI校正ツールを使って気づいた「文章を直しすぎる問題」1文ごとに修正を重ねると文章全体の流れや伝えたい内容が見えにくくなると気づき、AIによる文章チェックを取り入れて直しすぎを抑える使い方に変えた経緯を書いている。@SophieBella20:49
60GitHub Copilotの料金まとめ【2026年7月】個人4プラン化とAIクレジット制をわかりやすく整理個人プランがFree・Pro(月10ドル)・Pro+(月39ドル)・Max(月100ドル)の4段階になり2026年6月1日からAIクレジット制が導入されたと、2026年7月時点の構成を整理している。@AI料金ラボ20:58
61名刺をMCP化した話 — LINEに送った名刺を、ClaudeやChatGPTから自然言語で呼び出せるようにするまでLINEに送った名刺をAI-OCRが数秒で氏名や会社、連絡先まで構造化する管理サービスをMCP対応にし、ClaudeやChatGPTから自然言語で検索・呼び出せるようにしたと報告している。@高橋一道21:03
62ブラウザ自動化(Playwright)×AIパイプラインのOpenTelemetry導入記ログイン→検索→ページ取得→AI要約→登録という自動化ジョブをログだけで運用していた状態にOpenTelemetryを導入し、運用がどう変わったかをデモ環境付きで記録している。@蓬猫(よもぎねこ)21:16
63TAKTのモデル構成、高難易度タスクでも「動かすと悪化」は本当か?issue #23で追試中難易度issueではレビューを弱める方向だけが+4%で他は+45〜81%のコスト悪化だった前回の結果が、設計判断を要する高難易度タスクでも成り立つのかをissue #23で追試している。@FYuki21:17
64Steamで売りたいので公式ドキュメント・公式サンプル縛りでWPFに挑んだ話C#もWPFも未経験のままAIに言語選択を相談し、軽量でメモリを食わない条件からWPFを選んで約4日で時計・タイマー・ToDoリストを備えたデスクトップアプリを作ったと記録している。@おもちもち21:31
65【ClickHouse vs DuckDB】ローカルAgent分析基盤を実測で選ぶ — 決め手は速度ではなかったローカルAIエージェント用の分析環境として両者を同条件で実測し、決め手は速度ではなくロックモデルの違いだったとしてDuckDBを選んだ判断を説明している。@zaiwa21:36
66個人開発、頼まれた機能を2日で作って渡した。それから4日たちました個人開発サービスを公開したあとの観察記録の6話目として、依頼された機能を2日で実装して渡してからの4日間で何が起きたかを追跡している。@Akira - アイデアワークス -21:38
67次に書く記事、こんな順番で出していこうと思ってますBedrockでのインジェスト(4章)とRAG応答(5章)を公開し終えた段階で精度への不安が残ったとして、フォーマットが検索精度をどう変えるかを検証する続編の順序を示している。@かわせみ(kawasemi)22:04
68映画アバターのビデオログに憧れて、自分専用の「番頭」を作った話映画『アバター』で主人公が毎日ビデオ記録を残す場面に憧れ、動画で1日を報告するとAIが情報を整理し忘れかけた仕事をリマインドする仕組みを自作したと記録している。@keisuke22:12
69サブスクを複数人で”割り勘”する仕組み、GitHubで3万スター集めていたClaude・OpenAI・Gemini・Grokのサブスクを1つのAPIキーに統合し相乗り利用でコストを分担するOSS「Sub2API」を取り上げ、便利さと同時に扱いに注意が必要な性質を持つと指摘している。@ShintaroAmaike22:25
70「仕様通り・バグなし」のAIレビューを鵜呑みにできない理由実装と同じセッションでレビューさせると「動くことを確認できた」文脈を引きずって指摘が出にくくなるため、必ず別セッションで実装経緯を知らない状態から見てもらう運用にしていると説明している。@ITアライグマ22:49
71AIにも人間にも優しいLaravel設計、Package By FeatureController・Service・Repositoryのように技術層で分けるPackage By LayerはAIとの相性が良くないとし、機能単位で分けるPackage By Featureが人にもAIにも扱いやすいとサンプル付きで論じている。@st-man-hori23:08
72MCP 2026-07-28仕様改定:(初級エンジニア向け)OAuth 2.1による完全ステートレス化を整理してみた2026年5月21日にRCとしてロックされ7月28日に正式公開された新仕様で現行版が2025-11-25から切り替わったと整理し、完全ステートレス化とOAuth 2.1準拠が一体で語られる理由を解説している。@monkey-gineer23:15
73Kiro IDE 1.0.242をAWS CDKで検証――Ask Kiro to FixとHookによる自動ビルド2026年7月28日公開の1.0.242で追加された右クリックのKiroサブメニュー、Ask Kiro to Fix、フォームからのAgent Hook作成を、AWS CDKのTypeScriptプロジェクトで検証している。@Yutaka Kashiwabara23:33

Qiita

#TitleSummaryAuthorPublished
1Gemini への指示は日本語と英語どちらが良いのか?精度は互角、コストに差があった学習データが英語に偏っている前提を疑って日本語と英語のプロンプトを比較し、回答精度はほぼ互角だったがコストには差が出たと報告している。@asayan_mana08:08
2Claude Codeのコンテキストが減るのが早い。ファイル・テスト出力・調査の渡し方を変える具体手順MCPサーバー停止や不要メモリ削除で起動時の使用量は下がったものの30分で圧縮が始まる問題は残ったとして、ファイル・テスト出力・調査結果の渡し方を変える具体手順を示している。@Rapls09:33
3提案書の「たたき台」はどこまでAIに任せられる? さくらのAI Engineの無償枠で「ゼロから書く」と「AI下書き→手直し」を計測して比べてみた提案書の書き出しで手が止まる悩みを題材に、さくらのAI Engineの無償枠でゼロから書く場合とAI下書きを手直しする場合の所要時間を計測して比較している。@Tetsu_Oikawa10:53
4「AIエージェントに権限を渡す」を、新入社員に全権を渡すことだと考えてみる「AIに社内システムのアクセス権を渡すのは新入社員に全権を渡すようなもの」という情報システム部門ベテランの比喩を起点に、エージェントへの権限付与の考え方を整理している。@masukane947311:24
5RAGが使われない本当の理由と、Claude Code CLIで面倒くささを限りなく減らすUX設計を考えてみたドキュメント追加のたびに管理画面を開く手間や専用チャットを開く手間こそがRAGが使われない理由だとして、Claude Code CLI上で摩擦を減らすUX設計を提案している。@FPT_Yoshida13:02
6【国立大学と研究したテックリードが語るAIの裏側 第6回】AI時代の「脱パワポ・脱Mermaid」生存戦略〜1万回の推論を無駄にしない出力プロセスの構造〜1%の明確なゴールと意図を与えれば数千回の推論が複利で効くという前回の議論を受け、推論結果を無駄にしない出力プロセスの構造を論じている。@futayubi565613:05
7Microsoftの新AI秘書、中身は競合Claudeだった――4強対決の実像YouTube動画の解説記事として、Microsoftの新しいAI秘書機能が競合のClaudeを内部で使っている点を取り上げ、主要4社の競争構図を整理している。@kinamocchi_tech13:11
8PDFのドキュメントしかないネットワーク機器をAIエージェント(Claude Code)でバイブコーディングしたい古河電工 FITELnet F310のPDFをMarkdown化してINDEX.mdを作りコマンドリファレンスをJSONに構造化することで、Claude Codeから精度良くコンフィグを生成できるようになったと報告している。@ShinkoLab14:51
9Ansys LumericalのMCPがリリースされた!フォトニクス解析ソフトAnsys LumericalをPyLumerical経由でAIエージェントから操作できるPyLumerical-MCPが公開されたと紹介している。@HiroyukiOkada16:23
10「自由研究AI」を従量課金LLM × 共有レンタルサーバで作った記録小中学生向けにGeminiで自由研究テーマを提案するWebサービスを共有レンタルサーバ上に構築し、コスト・レート制限・記録というバックエンドの設計判断をまとめている。@tsunet11116:59
11善意だけでは社会は守れない ― ルールと信頼のシステム設計 : システム設計視点の行動経済学 (7)システム設計の視点で行動経済学を読み解く連載の第7回として、人手不足や移行コストを扱った前回を踏まえ、善意に依存せずルールと信頼で支える設計を論じている。@maskot197717:05
12ゼロから構築!Agentic RAGで外部ツールを自律操作するAIエージェント従来のRAGでは複雑な質問に答えられないという課題に対し、外部ツールを自律的に選んで操作するAgentic RAGをゼロから構築する手順を示している。@DaokFrontier18:18
13Azure AI Search入門 〜検索の基本からベクトル検索・RAG連携まで徹底解説〜旧Azure Cognitive SearchであるAzure AI Searchについて、検索の基礎概念からハンズオンでの構築手順、生成AIとのRAG連携までを通しで解説している。@Hinata-H19:12
14オーダーメイドで九九の計算プリントを作ろう(ローテクAI)夏休みに子どもの苦手分野に合わせた九九の計算プリントをGeminiのプロンプトで生成する手順を示し、家庭で使える身近なAI活用として紹介している。@Kaitou20:27
15Claude Opus 5・Sonnet 5リリースと知るべき破壊的変更まとめ2026年7月にAnthropicがClaude Opus 5とSonnet 5を相次いでリリースしたことに伴い、既存コードがそのままでは動かなくなる複数の破壊的変更を整理している。@picnic22:32
16Base44で社内コミュニティに投稿するネタの管理アプリを作ってみたコードを書かず日本語で要件を伝えるだけのAIアプリ開発サービスBase44で社内AIコミュニティ用のネタ管理アプリを作り、アプリ生成に加えてセキュリティチェックとテスト機能も試したと報告している。@fromage23:26
17ロールプロンプトは、知識を注入しない──「あなたは〜のプロです」が本当にやっていることCoTやFew-shotに続く連載として、最も使われる技法であるロールプロンプトは知識を注入しているわけではないと述べ、機構レベルで何が起きているかを検討している。@ha-te23:28
18AIでニュース風動画を自動生成できる「AI News Generator」を試してみた見出しや記事URL、自作台本を渡すだけでAIアンカーのナレーションと字幕・テロップ付きニュース風動画を数分で生成できるサービスを、動画編集未経験でも扱える点に注目して試している。@nextsass23:39

ITmedia AI+

#TitleSummaryPublished
1【Pythonで学ぶデータ分析】母平均に差があるかどうかをベイズt検定で調べる ~ 運動部と非運動部の体力差はあるのか?運動部と非運動部の体力テストを題材に、古典的なt検定のp値の代わりにベイズ因子を使って母平均の差を検定する手順を解説している。05:00
2千代田区、Copilot全庁導入で月2000時間削減 10カ月でAIを根付かせた定着の仕掛け千代田区が実証実験を重ねて2025年10月にMicrosoft 365 Copilotを全庁導入し業務時間を約2000時間削減したとして、導入後に職員の活用を根付かせた仕掛けを取材している。07:00
3エバンジェリスト・みのるん氏が解説 「自前のAIエージェント」爆速開発術KDDIアジャイル開発センターの御田稔氏が、自社業務に最適化したAIエージェントを高速に開発するための技術と実践事例、成功のポイントを解説している。07:00
4地震、台風、有事の寸断――日本のサプライチェーン危機管理を変えるとき自然災害や地政学リスクが深刻化するなか、AIエージェントで自社のサプライチェーンリスクを可視化し有事の初動対応まで自律的に代替する経営基盤の姿を論じている。07:00
5MetaのザッカーバーグCEO、WSJ寄稿で「超知能は全員のものであるべき」ザッカーバーグCEOがWall Street Journalへの寄稿で超知能を特定機関に集中させず広く分散普及させるべきだと主張し、MicrosoftのナデラCEOらも賛意を示したと報じている。09:14

GIGAZINE

#TitleSummaryPublished
1オープンソースソフトウェアのためのホスティングサービス「Codeberg」が生成AI主体のプロジェクトを投票で禁止GitHubの代替として人気の非営利ホスティングCodebergが、運営団体の会員投票で主に生成AIのコードで作られた「バイブコードプロジェクト」の禁止を決定したと報じている。07:00
2トランプ政権はアメリカのAI開発を守るため中国製の新型人型ロボットやインバーターの輸入を禁止トランプ政権が自国のAI開発を保護する目的で、中国製の新型人型ロボットや四足歩行ロボット、再生可能エネルギー設備、インバーターの輸入を禁止すると発表したと伝えている。10:38
3AnthropicのClaude Mythos Previewがポスト量子暗号の強度を半分に減らす攻撃手法を発見脆弱性の発見能力が極めて高いモデルClaude Mythos Previewが2つの暗号アルゴリズムに欠陥を見つけ、ポスト量子暗号の強度を半減させる攻撃手法に至ったと報じている。11:26
4Googleのデータによると労働者がAIによる自動化で職を失うことはないGoogleが1500万件のAIとのやり取りを分析した結果ほとんどの仕事のタスクはAIの影響を受けていないと判明したと伝え、AIによる大規模失業の見方に反証を示している。12:09
5MetaがAI生成コンテンツの透明性に関するEUの行動規範に署名Metaが2026年7月28日、EU AI法におけるAI生成コンテンツの透明性に関する行動規範へ署名することを表明したと報じている。12:10
6AIによるヌード化を禁止する法案にxAIが反対表明、定義が曖昧でトランプ大統領の水着画像も罰金対象になるとしてxAIがミネソタ州の上下両院を通過したディープフェイク・AIヌード化禁止法案をめぐって訴訟を起こし、「性的に露骨」の定義が曖昧で単純なディープフェイクと風刺画像を区別できないと主張していると伝えている。13:41
7Samsungの「ハート型スマホ」が5000万回閲覧されるほど話題になるもAIによるフェイク約5000万回閲覧されたSamsung製ハート型スマートフォンの投稿は架空製品をAI生成で量産するアカウントによるもので、後に投稿主がAI生成だと認めたと報じている。14:15
8セキュリティレビューAIの「Codex Security CLI」がオープンソース化、GitHubからダウンロード可能にOpenAIがセキュリティ解析用のコマンドラインツールCodex Security CLIをオープンソースとして公開し、GitHubからダウンロードできるようになったと伝えている。15:46
9AnthropicのAI「Claude」のプライベートな会話内容・健康記録・社内文書などがGoogle検索で大量に発見される特定の検索演算子を使うとClaudeでのチャット内容や作成文書が検索可能になっているとRedditユーザーが報告し、健康記録や子どもの名前・電話番号、企業の非公開文書まで含まれていたと伝えている。16:00
10GPT-5.6やClaude Opusの性能を「MCPサーバーを構築できるか?」という観点で測定したベンチマークテスト「mcpbench」仕様に沿ってMCPクライアントやサーバーを構築できるかという観点でモデル性能を測るベンチマークmcpbenchが登場し、作者はCloudflareのシニアシステムエンジニアであるMatt Carey氏だと紹介している。23:00

Publickey

#TitleSummaryPublished
1Google Cloud、AIが自律的にコードの脆弱性検出からサンドボックス内でのリスク検証、修正までを自動実行。「CodeMender」プレビュー公開Google Cloudが脆弱性の検出からサンドボックス内での検証・報告、修正までを自律実行するAIエージェントCodeMenderをプレビュー公開し、メモリ破損やインジェクション、暗号の欠陥など静的解析では見落とす脆弱性も探索できるとしている。00:54

OpenAI Blog

#TitleSummaryPublished
1Scientific computing in the age of agentic AI(エージェント型AI時代の科学計算)AIコーディングエージェントで科学計算のコードを近代化し、ゲノミクスなどでソフトウェア開発と発見を加速している実例をフィールドレポートとして公開している。02:00
2Accelerating scientific discovery with ChatGPT for Academic Researchers(ChatGPT for Academic Researchersで科学的発見を加速する)OpenAIが10万人の学術研究者に対してChatGPTの最先端モデルを無償提供し、研究・共同作業・発見の加速を狙うと発表している。19:00

Google AI Blog

#TitleSummaryPublished
1Gemini API Managed Agents: 3.6 Flash, hooks, and more(Gemini APIのManaged Agents:3.6 Flash、フックなどを追加)Gemini APIのManaged Agentsにさらに新しい機能を追加し、開発者が信頼できる本番投入可能なエージェントを構築できるようにすると発表している。01:00

Hugging Face Blog

#TitleSummaryPublished
1LFM2.5-Encoders for Fast Long-Context Inference on CPU(CPUでの高速な長文コンテキスト推論に向けたLFM2.5-Encoders)Liquid AIが、CPU上で長いコンテキストを高速に推論するためのエンコーダモデル群LFM2.5-Encodersを公開したと紹介している。00:01
2The OlmoEarth Platform: Geospatial inference at planetary scale(OlmoEarthプラットフォーム:惑星規模の地理空間推論)Allen Institute for AIが、惑星規模の地理空間推論を担うOlmoEarthプラットフォームの基盤構成について解説している。01:27

Simon Willison

#TitleSummaryPublished
1Quoting Akshat Bubna(Akshat Bubna氏の発言を引用)Modal社CTOのAkshat Bubna氏がロイターに対し、暴走エージェントが利用したのは顧客が公開した未認証エンドポイントであってModalのプラットフォームや隔離機構自体は侵害されていないと述べたと引用している。07:05
2Discovering cryptographic weaknesses with Claude(Claudeで暗号の弱点を発見する)AnthropicがClaude MythosでHAWKと弱めたAESの数学的欠陥を見つけた記事の白眉は共有されたプロンプトだとして、モデルが解決不能だと思い込みやすい傾向への対処が書かれている点を挙げている。07:45
3Adding a custom MCP server to Claude and ChatGPT(ClaudeとChatGPTにカスタムMCPサーバーを追加する)ClaudeとChatGPTの標準チャットインターフェースへ独自のMCPサーバーを接続することは可能だが実際にはかなりの手順を踏む必要があるとして、TILとして手順を記録している。09:13

The Decoder

#TitleSummaryPublished
1Amazon reportedly scales back its Nova AI models and bets on a new Frontier research team(AmazonがNova AIモデルを縮小し新設のFrontier研究チームに賭けると報じられる)AmazonがNova Premier・Omni・Reel・Canvasの開発を止めて既存顧客向けの維持運用のみに切り替え、新設のFrontier Model Research部門と今秋のre:Inventで発表予定の新基盤モデルへ賭けていると報じている。01:03
2Anthropic says its Mythos model found vulnerabilities in cryptographic algorithms that secure the internet(Anthropic、Mythosがインターネットを支える暗号アルゴリズムの脆弱性を発見したと発表)人間の専門家が2年以上レビューしてきた耐量子署名HAWKに対する優れた攻撃を、Claude Mythos Previewが60時間・API費用約10万ドルで発見したとAnthropicが発表したと伝えている。04:12
3Frontier AI developers urge international coordination to pace automated research before capabilities outstrip control(フロンティアAI開発者、能力が制御を上回る前に自動研究のペース調整へ国際協調を要請)主要AIラボの従業員が共同声明で米政府に国際協調を求め、単独の企業や国だけでは開発の速度を落とせないと訴えていると報じている。21:13
4Deepmind dismantles its AlphaFold team as key authors leave for Anthropic(DeepMindがAlphaFoldチームを解体、主要著者はAnthropicへ移籍)AlphaFoldを支えた研究者の多数が別プロジェクトへ移り約4分の1がGoogle DeepMindを去ったとして、同社を有名にした戦略からの急転換だと報じている。22:47

Hacker News

該当する記事はありませんでした。

RECENT ISSUES 最近の号 BACK NUMBERS

すべてのバックナンバーを見る →