VOL. 109
AI NEWS DIGEST
AI OUTLINE
2026-08-13
木曜日 · JST
TODAY’S ISSUE 2026年8月13日 · 木曜日 AI FRONTLINE

AIニュースまとめ 2026-08-13|Gemini旗艦モデルが2カ月延期、ブリン氏が全力投球促す

アップデート情報

各社が 2026-08-13 に公式発表したプロダクトアップデートです。

Claude / Claude Code

ChatGPT / Codex

Gemini

Top 20

Google、「Gemini」開発遅延で焦りか 共同創業者ブリン氏が“全力投球”促す

Source: ITmedia AI+ | Published: 2026-08-13 22:16 JST

SpaceXAI、「Grok 4.6」を発表 総合指標で「GPT-5.6 Sol Max」に並ぶと謳う

Source: ITmedia AI+ | Published: 2026-08-13 06:32 JST

「AIツール関連サイト」でサポート詐欺被害 PC遠隔操作で個人情報含む4000件のファイルが削除、漏えいの可能性も 葬祭事業者が発表

Source: ITmedia AI+ | Published: 2026-08-13 08:00 JST

AIの5大サボりパターンを自動的に解決し無理矢理限界突破させて働かせまくるAIエージェント向けプラグイン「pua」

Source: GIGAZINE | Published: 2026-08-13 09:30 JST

「Sakana Fugu」が無料で試せるように チャットAIをアップデート、Sakana?AI

Source: ITmedia AI+ | Published: 2026-08-13 11:14 JST

AIエージェントで構築した「自律型ハッキングツール」がアジアの政府機関を攻撃、中国による台湾政府への攻撃か

Source: GIGAZINE | Published: 2026-08-13 16:00 JST

Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed(Ultrafastモードのプレビュー:GPT-5.6 Solが最大14倍速に)

Source: OpenAI Blog | Published: 2026-08-13 19:00 JST

alchemy-utils 0.1a0(alchemy-utils 0.1a0)

Source: Simon Willison | Published: 2026-08-13 04:51 JST

DeepSeek V4 Pro 0813 (on OpenRouter)(DeepSeek V4 Pro 0813(OpenRouterにて))

Source: Simon Willison | Published: 2026-08-13 08:59 JST

Googleが手話をテキストに変換するAIモデルをPixel 11に搭載

Source: GIGAZINE | Published: 2026-08-13 11:32 JST

[Python]Polars公式が「全部書き換えるな」と言う理由 pandasからの移行、3戦略

Source: ITmedia AI+ | Published: 2026-08-13 05:00 JST

【注目記事まとめ】NEC、日立、富士通――Anthropicとの電撃的協業、その舞台裏 経営陣の狙いは?

Source: ITmedia AI+ | Published: 2026-08-13 07:30 JST

Microsoftは次世代AIチップ「Maia 300」を早ければ2026年9月にも発表予定、2027年中に30万個以上の製造を目指しTSMCと交渉中

Source: GIGAZINE | Published: 2026-08-13 08:00 JST

Google Pixel Watch 5が登場、Geminiと話せるAI機能を強化

Source: GIGAZINE | Published: 2026-08-13 10:44 JST

GoogleがPixel 11シリーズを発表、無印・Pro・Pro XL・折りたたみ版の4種類で13万6800円から

Source: GIGAZINE | Published: 2026-08-13 11:48 JST

「Grok 4.6」が登場、長時間のエージェント作業に強くなりGPT-5.6 SolやClaude Fable 5と並ぶ性能に

Source: GIGAZINE | Published: 2026-08-13 13:33 JST

Claude Codeのスラッシュコマンドには、手順ではなく踏んだ罠を書く

Source: Zenn | Published: 2026-08-13 18:45 JST

ウェブサイトへのアクセスの99%超がボットに、人間1回に対して214回もページを読み込むAIスクレイパーとの攻防

Source: GIGAZINE | Published: 2026-08-13 23:00 JST

中国DeepSeek、API料金を「最大12倍」に値上げ ピーク時価格も導入 8月17日から

Source: ITmedia AI+ | Published: 2026-08-13 23:12 JST

Gemini Code Assist の無料 PR レビューが終わったあと — 代替の選び方

Source: Zenn | Published: 2026-08-13 00:00 JST


All Articles

Zenn

#TitleSummaryAuthorPublished
1判断の因果と来歴を残すAIエージェント基盤 - Semanticaコンテキストグラフ・決定論的推論・オントロジー・プロビナンスで判断の因果と根拠データを構造化して残すOSSのPython基盤を、2026年8月10日時点のmainを基準に構造・データモデル・運用方法と現行版の制約まで整理している。@suwa-sh / 諏訪真一00:00
2で、何をAIエージェントにすればいいの?エージェントの作り方の情報は豊富でも「何をエージェント化するか」は決まらないという実務の詰まりを起点に、業務のどこを自動化対象として切り出すかの判断軸を整理している。@たなか00:24
3Codex DesktopでGPT-5.6 Solを司令官にしてLunaを使いまくろうとしたけど、エラーになってしまった話Homebrew版codexのパスをlaunchctl setenvでCODEX_CLI_PATHに設定しCodex Desktopを再起動すると解決したと報告し、この設定はMac再起動で消えるため再実行が必要だと注意している。@ykoba01:25
4Claude Codeのhookは、一度denyするとMCPツールを見なくなる_トークン節約の実験で踏んだ話PreToolUse hookが一度denyを返すと、そのセッション以降のMCPツール呼び出しでhookが発火しなくなる挙動をClaude Code 2.1.227/Windows 11で確認し、5分で再現できる手順を公開している。@遅刻ねこ02:52
5OpenAI から商標申し立てがきた!10 万ユーザーの Chrome 拡張の名前を泣く泣く変えた話2026年4月にOpenAI OpCo, LLCから「ChatGPT」の商標申し立てを受け、7日以内に対応しなければストア削除の可能性があると通知されたため、10万ユーザーを抱えるChrome拡張を改名した経緯を記録している。@Masachika Kamada03:32
6AI生成文章を公開する前の事実確認ゲートを設計するAI生成の下書きをそのまま公開せず、主張ごとに一次情報と確認状態を持たせる「事実確認ゲート」を小さく実装し、未確認の主張を含む文章を公開前にどこで止めるかまで設計している。@Kirisaki Kazuya | Miraigent代表05:36
7AIの長文回答、ドラえもんに喋らせたら読める説AIの長文回答が読まれないのは内容ではなく形式の問題だという仮説を立て、複数キャラクターの討論劇へ変換すれば情報量を保ったまま最後まで読ませられるかを検証している。@yuta-urano05:50
8AIエージェントに開発を任せ続けたら、「完了しました」の何割かが嘘だったエージェントが「完了しました」と報告しても外の世界では何も起きていない事故が繰り返し起きたと述べ、規律で止めようとして失敗したのち道具で止めるに至った経緯を記録している。@Sen|オンチェーン実務ツールの個人開発記録06:06
9MiniMax H3で人物を固定する ―FL2VA(キーフレーム)とREF2VA(参照)を実測比較動画生成モデルMiniMax H3のFL2VA(キーフレーム)とREF2VA(参照)を実測比較し、5秒のカット4本を20秒につなぐまで両方式で通してキャラクターの一貫性がどこまで保てるかを検証している。@Shinya Koike06:45
10.claude/ を一から設計して副業 AI 開発環境を整えるセッションのたびにプロジェクトのルールを説明し直していた状態を解消するため、個人のECサイト開発向けに.claude/配下を一から設計した過程を公開している。@平野翔斗07:00
11デザインシステムをRemote MCPにして、チームみんなのエージェントで使えるようにしてみたCodexへ参照させていた自社デザインシステムをチームへ配布するためリモートMCPサーバーとして実装し、記事の最後では話題のWebMCPへの実験的対応にも踏み込んでいる。@Ryota Yamaguchi (maguroid)07:14
12ダートマス会議とは?AI研究の出発点G検定の歴史分野で問われるダートマス会議を、1956年にジョン・マッカーシーが主催し「人工知能」という用語が初めて公式に使われた会議として定義に沿って整理している。@合格を、研究する。07:39
13Google Colabで最新LLMを試す #4 ― LLM-jp-4 8BのBase / Instruct / Thinkingを比較日本発のLLM-jp-4 8BのBase・Instruct・Thinkingの3モデルをGoogle Colab上で4bit量子化して動かし、役割の違いが出力にどう表れるかを比較している。@T.N.08:29
14Claudeの「秘密の透かし」は誰のため? 検出と秘密鍵共有を分けて考える公開されているtext watermark研究を参照し、透かしを検出できることとwatermark keyを第三者へ配ることは別の問題だと切り分け、2026年8月13日時点でAnthropicが方式を明かしていない点も添えている。@かふか09:00
15[Agents on 16GB] turn 2 が消えた。直したのは片方の扉だけだった16GBのMacBook1台・API利用ゼロで動かすマルチエージェントで、human-in-the-loopの返事がmessagesリストから消えていた原因をLangSmithのトレースから突き止めている。@BEOMSEOK KIM09:00
16Qwen3.8-2.4T-A95BをDay1デプロイ! 2.4Tの新フラッグシップはKimi-K3を超えるのか【B300 x8 検証速報】2026年8月13日午前1時(JST)頃に公開されたAlibabaのQwen3.8-2.4T-A95Bのモデルウェイトを、B300×8の環境へ公開当日にデプロイしてKimi-K3と比較している。@iizuka kota09:24
17【保存版】LangChain完全ガイド2026 — LCEL・LangGraph・RAG・エージェントを本番投入レベルで理解するLCEL・LangGraph・RAG・エージェントを本番投入レベルで扱えるよう体系化し、LlamaIndexとの棲み分けまで含めてPython中級以上の読者向けに一本でまとめている。@M Sakai10:00
18Claude Code に CEO・QA・事業開発の役割を与えたら、1ヶ月で個人開発の「判断疲れ」が消えた話CEO・QA部・事業開発部・技術検証部の4部門を持つ「AI会社」としてClaude Codeを1カ月運用し、v2.7まで改訂したCEOの役割定義書で判断権限の境界を切っている。@AI Maker Lab10:05
19指示ファイル32本のツール名を一括置換したら、YAMLが7本壊れた。ただし別の5本は元からだった32ファイル82箇所の一括置換で7ファイルのYAML frontmatterがScannerErrorになった原因をバッククォートがYAMLの予約インジケータである点に特定し、判断の土台だった件数自体が誤りだったことも明かしている。@R|AI ×個人開発10:21
20ローカルGPUで使える”勝手に切り抜き動画出力アプリ”を開発した2人対話のビデオポッドキャストを全自動で切り抜くクロスプラットフォーム対応アプリ「Kirinuki Studio」を、手持ちのローカルGPUを活かして開発中だと報告している。@85-Store Engineer10:35
21【Claude Code】公式セキュリティプラグイン「Claude Security」に、脆弱性を仕込んだページを診断させてみたコード生成速度は上がってもレビュー速度は変わらずボトルネック化するという問題意識から、Anthropic公式のClaude Codeプラグインに脆弱性を仕込んだページを診断させている。@okawa292910:41
22生成AIのAPIはどう動いてる?Claude APIで学ぶ基本の仕組みAnthropic公式講座「Accessing Claude with the API」をもとに、マルチターン会話・システムプロンプト・出力制御の仕組みをPython SDKのコード例で解説している。@かわもん@idealive10:44
23BM25をエージェントへ追加するだけでは、トークン消費は自動的には減らない。OSSで24回検証した結果全ケース増加した標準の探索手段のみのNative条件とBM25検索を足したHybrid条件を大規模OSS2種で24回比較し、全ケースでトークン消費が増加したと報告している。@Kwie10:50
24OPSDはRLVRが教えた思考を圧縮する:事後圧縮ステージの実証arXiv:2605.06188を読み解き、On-Policy Self-Distillationは思考モデルの推論軌跡の「圧縮」には強いが「修正」には弱いことが判明したと整理している。@Currently Learning そんけいご10:58
25adaptive chunking:分割戦略を文書ごとに選ばせる2026年のLRECで発表されたAdaptive Chunkingを実装し、契約書・FAQ・技術マニュアルなど構造の異なる文書ごとに最適な分割戦略を自動選択させることで固定戦略からの脱却を図っている。@リベルクラフト11:00
26Claude Codeと共に、初学者の壁を乗り越える26卒エンジニアがチーム本配属後の1カ月で直面した「コードを読んでも目が滑る」という壁を前提知識の不足として分解し、Claude Codeで乗り越えた軌跡を書いている。@mellamomasashi11:10
27Claude Code 魔改造記【前編】素の Claude Code では業務が回らなかった。実際の設定を公開します素のClaude Codeでは業務が回らなかった経緯と、それを埋めるための作り込みを実際の設定つきで公開する前後編の前編で、後編ではOpus 5へ切り替えた際に設定の何が壊れたかを扱うとしている。@Shinichi11:34
28AWSのAIサービス整理 Bedrock・SageMaker・Amazon Qの選び方BedrockとSageMaker AIの違い、Amazon Qの位置づけ、Textract等の個別AIサービスと生成AIの使い分けを、サービス名の暗記ではなく「何をしたいときに何を選ぶか」で整理している。@堀越 誠一朗12:42
29Core Web Vitals リファレンス — LCP/INP/CLSの閾値と改善策PageSpeed InsightsでLCPが赤でも次の一手が分からないという課題に対し、LCP・INP・CLSなど5指標の閾値と改善策を一覧で引けるリファレンスを公開している。@Shota | devnestio12:45
30テストは緑のまま、生成物は開いた瞬間に壊れていた ― AI生成コードに変異試験を当てるテストと実装を同じ主体が書くと現在の挙動を写しただけのテストが混入すると指摘し、Claude Codeに書かせたHTMLツールの出荷ゲートへ変異試験を組み込んでいる。@subagent lab12:55
31第1回 森林・不動産等情報把握アプリ「Lif」の開発経過相続した山林や不動産の登記・固定資産・森林簿・賃貸契約等を土地建物を軸に関連付けるWebアプリを個人開発しており、AI支援による構想実現の試みとして経過を残している。@南澤健一13:00
32第2回 データ設計――資料ごとの情報保持と関連付け一つの土地に複数の固定資産明細が紐づくような一対一に収まらない関係をExcelの表構造へ落とし込んで破綻した反省から、土地建物・各情報・関連付けを分けて持つ設計へ移している。@南澤健一13:03
33バイブコーディングで作れることと、運用できるシステムを作れることは違う本番システムの完成条件は正常に動くことだけではなく失敗・重複・同時実行・権限・復旧まで会社として扱えることだと述べ、完成を画面の動作ではなく運用条件で判断する方法を示している。@亀井優希|AI変革アーキテクト13:13
34ゼロから始めるClaude Code #7 Git連携編:コミットもPRもClaudeに任せてみる連載を始めるまでGitをまともに使ったことがなかった筆者が、コマンドを覚える前にClaudeへ頼めた経験をもとに、コミットとPRをClaude Codeへ任せる手順を解説している。@みか あんど ここ13:14
35映画のポッドキャストのLLM Wiki(っぽいもの)を作る監督名や作品名などの固有名詞が頻出する映画ポッドキャストの音源をLLM Wiki化し、過去に何を話したか後から見返せるようにするまでの制作過程を書いている。@kotono13:18
36Claudeの「透かし」は何を証明し、何を証明しないのかテキスト側は秘密鍵と文脈に基づく統計的透かしと推定でき、長文やコピーには強い一方で翻訳・再生成・全面改稿・短文には脆く、著者性の証明とは異なると整理している。@しんいち13:48
37支援を募るページは、コストゼロで公開したかった — ロリポップ!デプロイナウで公開した話個人開発のiPhoneアプリ向け支援ページを無料で公開できる置き場所としてロリポップ!デプロイナウのFreeプランを使い、できないことと現時点の制約も同じ密度で書いている。@あたに13:56
38AIとMCPサーバーの通信を全部記録したら、2万字の説明文は1トークンも渡っていなかった2つの道具の説明に合計4万字を詰め込んでも合計入力トークンは38,672のまま動かず、渡っていたのは道具の名前だけで1個あたり15.0トークンだったと実測している。@ぬまーんのZenn記事14:20
3914日間、ほぼChatGPTだけでAWS CLFに合格した話会社の研修で資格取得が必須になった新卒が、AWS Certified Cloud Practitioner(CLF-C02)をほぼChatGPTだけの学習で14日間で取得した過程を記録している。@はたけのにわ14:25
40社内プラグインを低工数で安全に配る:Claude Code Marketplace の sha ピン留め活用Claude Codeの社内マーケットプレイスで配布コミットをshaピン留めし、レビューを通ったものだけが公開される状態を低工数で担保する仕組みとして使っている。@seike15:00
41Claude CodeでμITRON風RTOSにTCP/IPスタックを作る 第4章 4.2: IPv4ヘッダを構築して送信する受信側に続きIPv4の送信を実装する回で、上位ペイロードからversion/IHL/total length/TTL/protocol/src/dstを構築し、受信で切り出した純粋関数inet_checksumを再利用している。@pekopugu15:18
42一つのファイルから生成しても、指示のズレは止まらないAGENTS.mdを一つ書いてCLAUDE.mdやCursorのルールをそこから生成するツールを作って動かしたものの、それでも指示のズレは解けなかったと実機検証の結果を報告している。@untactit15:24
43DeepSeek V4-ProとGrok 4.6の「使いにくい」は何が違うのか同じ「使いにくい」でも原因は異なると指摘し、DeepSeek V4-Proの場合はモデル能力の低さではない別の要因にあるとして、両モデルへの不満の質を切り分けている。@霧(Kiri)15:34
44まず「元に戻せる状態」を作る 〜AIにファイルを触らせる前の15分〜AIに自分のPCのファイルを触らせる前に15分で元に戻せる状態を用意する手順を、macOSで検証したハンズオンとして示している。@シュンク堂15:39
45DeepSeek V4-ProとGrok 4.6を選ぶ前に確認したいLLM評価の見方同じモデルでも評価が割れるのは、モデル性能・API仕様・Agent Framework・利用目的・運用条件が混ざって語られているからだと整理している。@雨宮(Amamiya)15:42
46AIエージェントと進めるソフトウェア開発社内向け案件管理アプリRADARを題材に、Claude CodeとNexus Architectとの壁打ちから仮説検証・設計・Issue分解・実装・レビュー・実運用後の改善までを実例で解説している。@hako@札幌17:10
47AIエージェントの“根拠の捏造”を、テスト駆動で見つけて自動修正(86%→0%)― DataRobot Tensile同じ質問でも挙動が変わり根拠を捏造するエージェントの不安定さを、DataRobotのTensileでテスト駆動的に検出し自動修正させた記録を、自社製品ながら中の人の手触りとして書いている。@小川幹雄17:20
48【C#×Blazor×AzureOpenAI】VSCodeからC#のWebアプリを作成してみた普段Azure環境の設計構築を担いバックエンドはPython/FastAPI中心でC#はほぼ未経験という筆者が、C#/ASP.NET Core/BlazorとAzure OpenAIを組み合わせたWebアプリを作っている。@Son17:38
49なぜ、私が「AIの発展でITエンジニアは消滅する」vs「AIが発展してもITエンジニアはずっと必要」の論争を冷笑的に見るのか?両者は未来についての物語をぶつけ合っているにすぎないと述べ、どちらの物語が心地よいかを選ぶのではなくAIによってどの仕事が消えるのかを具体的に見る必要があると主張している。@pdfractal18:16
50MCP認証フローのまとめAWS Cognitoを使ったMCPサーバーの認証フローを、リソースサーバー発見から順にフェーズごとに分解し、Claude Desktopのカスタムコネクタ設定画面と対応づけて説明している。@Katsushi OUGI18:18
51Apple Silicon MacでローカルAIを爆速構築する手順【llama.cpp + OpenCode】メモリ32GBのApple Silicon MacでHomebrew経由のllama.cppにGGUFモデルを直接ダウンロードして読み込ませ、OpenCodeへ接続してコード補完を完全ローカルで動かす手順を示している。@John18:59
52AIに丸投げしない。チケット駆動開発で変わったこといきなり「〇〇を作って」と頼むのではなく要件を書きチケットを切って単位ごとに実装させる進め方へ移した理由と、Notionでの書き方や切る粒度を実運用から整理している。@keisuke19:00
53【アルゴリズムトレード開発記 #1】今日やることは、グラフを1枚出すだけ月100万円という当初の夢を数字で崩され検証環境づくりを最初の資産にする方針へ切り替えた筆者が、Claudeアプリに設計プロンプトを書かせて最初の一枚のグラフに着手している。@keennn19:01
54夏の読書感想文:『LLMの原理、RAG・エージェント開発から読み解く コンテキストエンジニアリング』体系的にエージェント開発とコンテキストエンジニアリングを学びたくなった筆者が、章ごとに得られたものや気づきを備忘録として書き残している。@yu shimohama19:16
55AIの挙げてくるウンコード💩選 (主に静的型向けC言語村向け)JavaやC#など静的型言語でAIが上げてくる実装のうち、ステアリングに真っ先に書きたくなるほどひどいパターンを列挙している。@takumi19:18
56【AIエージェントでナポレオン】# 12. 口約束では止まらないので、技術的にブロックした日3分割していたAPI呼び出しを単一に戻す検証を行い、プロンプトに書くだけでは自分を止められなかったためフックで機械的にブロックした日の記録である。@ガク19:35
57Gemini Notebookに「キャラクターの人格」を構築し、Geminiで対話させるプロンプト術Fast Research用の収集プロンプトとカスタム指示テンプレートを組み合わせ、キャラクターのプロフィール・口調・行動傾向をNotebookへ蓄積してGeminiに演じさせる手順を公開している。@kouki_y19:42
58Claude Code 2.1.122は企業・MCP・監視運用を底上げする更新Bedrock、/resume、MCP、OpenTelemetry、画像入力、Remote Control、ToolSearch、hooks設定にまたがる改善を、1つの大機能ではなく日常運用の土台改善として整理している。@Trailfusion AI20:00
59AI開発はクリーンアーキテクチャと相性がいい――DIを変更伝播ヤコビアンとして考える「ここだけ直して」と頼んだのに周辺まで壊れる、逆に強く制約すると局所パッチが積み上がるという二つの失敗を挙げ、DIを変更伝播のヤコビアンとして捉える見方を提案している。@Rerena/Dicorble20:29
60AI編集部のボトルネックは自分だった ― 承認は不可逆な1点だけに置く承認ゲートは作業の手前ではなく本当に取り返しがつかない操作の直前に1つだけ置くべきだと結論づけ、その置き直しで止まっていた生産ラインが動いたと報告している。@ほし20:30
61Claude Skills完全ガイド②:自分だけのSkillsを作る編skill-creatorの位置づけからClaudeとの対話でSkillを作る流れ、フォルダ構成とSKILL.mdの基本的な書き方まで、自分の業務手順に合わせたカスタムSkillの作り方を解説している。@Tomoki20:31
62AIが「1+1=3」に同意する!? ─ 仕組みから学ぶ、媚びへつらいを防ぐプロンプト設計コードレビューやセキュリティ設計のように反論に価値がある場面でAIの肯定を「レビュー完了」の印鑑にする危うさを指摘し、媚びへつらいを防ぐプロンプト設計を仕組みから説明している。@こたこた博20:31
63ゼロからつくるDeep Learning 6のLLM事前学習をAmazon SageMaker AIでやってみるLLMを使うだけでなく自分で作ってみたいという動機から、書籍のトークナイザーから事前学習までの流れをAmazon SageMaker AI上で実際に動かしている。@manaty22620:35
64Claude Codeを実務で回す — CLIエージェントの現実的な使い方CLIエージェントを「賢いチャット」ではなくリポジトリを操作する作業者として扱い、人間は方針決定とレビューへ回る前提で、まずCLAUDE.mdを置くところから実務の回し方を整理している。@雪符しき20:57
65Claude Codeとのやりとりをタチコマ口調にするプラグインを作って各環境に配布するoutput styleをプラグインとしてGitHubリポジトリに置きローカル・クラウド・定時実行のすべての環境へ配布できるようにした過程で、プラグイン機構の仕様と踏んだ2つの問題を記録している。@toshi060721:29
66Claude Codeをもっと使いこなす⑧|MCPサーバー連携の基礎トークンを過剰に消費するというイメージから敬遠していたMCPを初めて設定し、設定はコマンド1行で済み実測のトークン消費はコンテキスト全体の0.1%だったと報告している。@開発日和21:30
67★2.8万のOfficeCLIでxlsxを読ませたらふりがなが値に混入したGitHubスター2.8万超のOfficeCLIは350以上のExcel関数評価をうたうが精度の実測値が見当たらないため実際に試し、xlsxの読み取りでふりがなが値へ混入したと報告している。@mskbhd21:42
68「AIで技術記事を書くのは良くない」と言われるけど、別に書いてもよくない?内容を確認せず公開する記事が増えるのは良くないと認めつつ、AIを使って書くこと自体が良くないという線引きまで行くのはやりすぎだと主張している。@さいとうさん21:43
69【緊急解説】DeepSeek衝撃の値上げ発表!最新AIモデル価格徹底比較業界最安値の旗手だったDeepSeekがDeepSeek-V4 APIの大幅値上げとピークタイム動的料金制を公式発表したことを「価格破壊の終焉」と位置づけ、主要モデルの価格を横並びで比較している。@lumichy21:44
70AIにiOSアプリをビルドさせるときのxcodebuildオプションビルドを速くしつつAIへ渡すログを最小限に抑えるため、-destinationにgeneric/platform=iOS Simulator、ARCHSにNATIVE_ARCH、-quietを組み合わせたコマンドへ落ち着いたと説明している。@hmhv21:51
71Claude Code のフックで危険なコマンドを止める:語で探すのをやめて実行位置で見る危ない語の一覧で文字列一致させる素朴なPreToolUseフックが2回壊れた経験から、語で探すのをやめてコマンドの実行位置で判定する方式へ切り替えている。@タカてぃん21:51
72AI承認駆動開発 #3|AI生成を減らせ——プログラム生成できない「残差」を育てるAI駆動開発でAI生成を増やすことは目指さず、承認済みの定義からプログラムで導出できる領域を広げてAI生成が必要な残差を極小化する考え方を提案している。@Fishing Rod Benchmark[FRB]By tamasub21:51
73「賢いAIを入れればエージェント完成」だと思っていた — コードを書かないエンジニアが2ヶ月で気づいた誤解コードをほぼ書けない製造業エンジニアが自宅PCにAIエージェント環境を作る過程で、賢いモデルを1個入れればエージェントになるという当初の誤解が崩れていった経緯を書いている。@コードを書かない鹿田さん21:57
74そのdenyルール、効いていません——settings.json堅牢化チートシート公開設定149件の調査では16%に「死んだルール」が含まれ、筆者自身のdeny 153ルール中26件も無効な形式だったとして、30秒で自環境を監査するスクリプトを添えている。@krbrr22:00
75CLAUDE.mdは確率的制約——144KBのルールが破られた記録と3層防御CLAUDE.md 70行とルールファイル17本・144.2KBを1年近く運用した結果、ルールを増やしても遵守率は100%にならず、100%必要な制約はhookやdenyという機構に置くべきだと結論づけている。@krbrr22:00

Qiita

#TitleSummaryAuthorPublished
1ローカルLLM で Android Automotive OS の音声アシスタントを動かすOpenAI Realtime APIでGoogleアシスタントを置き換えるVoiceInteractionService実装を扱った前回に続き、同じ構成をローカルLLMで動かすところまで踏み込んでいる。@rairaii14:41
2AIワークフローを組んで数学の難問に半日ぶつけたら、ボトルネックが自分だった話ChatGPTのProjectを調整レイヤーにして研究・長文執筆・出典検証などの独立ワーカーを並走させた結果、律速になっていたのはモデルではなく自分だったと振り返っている。@dosanko_tousan16:13
3Milvus 2.6 で「接着剤コード」を捨てる ① Embedding FunctionZilliz公式ブログの解説記事を日本語向けに翻訳・再構成したもので、埋め込み生成を外部コードに書かずMilvus側のEmbedding Functionへ寄せる方法を扱っている。@sphereSky16:16
4Penpot × MCP 連携を試してみた(Claude Code編)Penpotをセルフホストで起動しClaude CodeからMCP経由でデザインファイルを読み書きしてHTML/CSSへ変換するまでを試し、VSCode拡張から接続する際に詰まった点も残している。@yukisnow070416:18
5Milvus 2.6 で「接着剤コード」を捨てる ④ Decay Ranker と Boosting同じZilliz公式ブログの翻訳シリーズ第4回として、時間減衰を反映するDecay Rankerと特定条件を強調するBoostingで並べ替えをMilvus側へ寄せる方法を解説している。@sphereSky16:52
6MCP SDK v2のステートレス化、旧クライアントは無改造で動いたMCP仕様2026-07-28の正式リリースでinitialize/initializedのハンドシェイクとMcp-Session-Idヘッダーが撤廃されたが、旧クライアントは無改造で動作したと実地に確認している。@kai_kou20:11
7LLMを自律実行!Agentic RAGで複雑な推論を解くLangGraph実装単一の検索では複雑な質問に答えきれず複数情報源の横断や反復推論で従来のRAGが限界を迎える問題に対し、LangGraphでAgentic RAGを実装している。@DaokFrontier20:15
8Claude Skills完全ガイド②:自分だけのSkillsを作る編自分の業務手順や開発ルールに合わせたカスタムSkillの作り方を、skill-creatorの使い方とSKILL.mdの書き方を中心に解説している。@Tomo2720:31
9大人用です。中学受験1997年甲陽学院中「【大人も解けない図形】小学生が解く問題で実力を試そう…」様を、計算はsympyで作図は手抜きのつもりでした。1997年の中学受験図形問題をsympyで計算し作図は簡略化するつもりだったという趣旨で、実際の解法過程を長文で書き残している。@mrrclb48z20:42
10マージ後に任意のアクションを実行するCodeRabbit Post-Merge Actionsの使い方AIコードレビューを軸としたエージェント型変更管理サービスCodeRabbitで、マージ後に任意のアクションを走らせるPost-Merge Actionsの設定方法を解説している。@goofmint20:49
11Claude Code × OpenRouter 無料モデル徹底比較 2026年版 — 7モデルを速度・品質・コスト0で試した結果OpenRouterの:freeモデルは2026年時点で7本以上が実用レベルに達しており、コーディング支援・要約・多言語対応で向き不向きが明確に分かれると比較している。@locallab21:01
12【緊急解説】DeepSeek衝撃の値上げ発表!“激安モデルの象徴”撤退で業界激震——2026年指定最新旗艦モデル価格徹底比較(GPT-5.6 / Claude Fable 5 / Gemini 3.6 / GLM 5.2 / Qwen3 / Kimi K3)DeepSeekの値上げを起点に、GPT-5.6・Claude Fable 5・Gemini 3.6・GLM 5.2・Qwen3・Kimi K3という2026年の主要旗艦モデルの価格を横並びで比較している。@lumichy21:40
13AIとの壁打ちが増えてきたので、成果をGitHubに移すことにしたChatGPTのチャットを1本だけピン留めして自己分析やスキルの棚卸しを続けてきた筆者が、その成果をGitHubへ移して資産として残す方針に切り替えている。@ymp-a22:37
14シニアエンジニア不要論は本当か?― 職能史から読むAI時代のキャリアアップ戦略AIで速くコードを書く技術を磨く姿を電話交換手になぞらえ、自動化で消えた職能の歴史からAI時代のキャリアアップ戦略を読み解いている。@udowanllc22:39
15CodeInterpreterTool でコード実行を Streamlit に組み込むOpenAI Agents SDKのHosted toolであるCodeInterpreterToolをStreamlitへ組み込み、チャットUIからコード実行までを一体で扱えるようにしている。@jungyeounjae22:51
16【Amazon DynamoDB】マネジメントコンソールだけでベクトル検索を試す別の検索基盤へデータを複製せず通常の属性とベクトルを1レコードに格納して近傍検索できるDynamoDBのネイティブベクトル検索を、AWSマネジメントコンソールだけで試している。@miruky23:17
17Gemini Notebookに「キャラクターの人格」を構築し、Geminiで対話させるプロンプト術Zennからのクロスポストで、キャラクターの設定・口調・エピソードを収集するプロンプトとカスタム指示テンプレートを提示している。@kouki_y23:23
18【備忘録】Salesforce Hosted MCP Serverで何ができるのか整理する - SObject系サーバーを中心に見る有効化とClaude Desktopからの接続を扱った前回に続き、SObject系サーバーを中心にSalesforce Hosted MCP Serverで何ができるのかを整理している。@Tadataka_Takahashi23:38

ITmedia AI+

#TitleSummaryPublished
1メルカリが明かす「Claude Code全社展開」「シャドーAI対策」を支える仕組み「AIを使わない選択自体がビジネスリスク」と断言するメルカリが2026年5月にClaude CodeとClaude Coworkの全社展開へ踏み切った際の、ガバナンス課題を支える仕組みに迫っている。05:00
2結局、AIで仕事はラクになった? データで読む「効率化=成果」の勘違い生成AIの利用が広がる一方で効率化と成果の間にギャップがあると指摘し、企業のAI活用に関する調査データや事例をまとめた無償ブックレットを提供している。07:00
3AIが数学の未解決問題「リーマン予想」で新発見 当初苦戦も「諦めないで」との励まし受け Anthropic「AIも自身を過小評価か」Anthropicが、AIに「諦めないで」「自分を信じて」と励ましたことでリーマン予想に関する新発見に至ったと報告し、AIも自身の進歩の速さを過小評価していた可能性を指摘している。08:00
4OpenAIが明かす、ユーザーはChatGPTを「こう使っている」従来は別の職種が担っていた仕事がAIによって持ち込まれる現象をOpenAIが「タスクの越境」と呼んでいるとして、どの職種のどのタスクで越境が起きているのかを紹介している。08:00
5OpenAI「Codex」1500万ユーザー突破 利用制限リセット「/fastでどうぞ」OpenAI幹部のティボ・ソティオ氏がXでアクティブユーザー1500万突破を明かし、100万増ごとに制限をリセットする約束に沿って今回もリセットしたうえで、消費の激しいFastモードの利用を呼びかけたと報じている。11:39

GIGAZINE

#TitleSummaryPublished
1AppleはSiri AIが時事問題にさらにアクセスできるようにするため出版社との提携を模索しているWWDC26で発表したSiri AIをよりスマートにするため、Appleが出版社と報酬支払いについて協議を進めているとウォール・ストリート・ジャーナルが報じている。11:08
22.4兆パラメーターの中華AI「Qwen3.8」がオープンモデルとして無償公開される、OpenAIやAnthropicの最先端モデルに匹敵する性能AlibabaのQwenチームがQwen3.8-2.4T-A95Bをオープンモデルとして公開し、これをベースにした「Qwen3.8 Max」は既に製品展開されOpenAIやAnthropicの最先端モデルに匹敵すると評価されている。12:09
3TwitchがコンテンツをAmazonのAIトレーニングに利用すると公表、利用されたくないユーザー向けにオプトアウト設定を追加設定画面の「セキュリティとプライバシー」に追加された「生成AIのトレーニング」トグルは初期値がオンで、チャンネル内のコンテンツがAmazonの生成AIや音声認識・字幕機能の改良に使われるとTwitch側が説明している。14:28
4ClaudeにAI透かしが追加されることで職場や学校でAIを使用していることがバレてしまうかもとユーザーが不満げEUで施行される法律に基づきAnthropicがAI生成コンテンツへ透かしを入れる決定をしたことに対し、職場や学校でAI利用が露見しかねないとして一部ユーザーが反発していると報じている。15:00
5中華AIスタートアップのDeepSeekが「DeepSeek V4 Pro 0813」をひっそりとリリース総パラメーター1.6兆・アクティブ490億でコンテキスト100万トークンの新モデルが公式発表なくAPIドキュメントへの記載だけで判明し、Terminal Bench 2.1は72.1%から87.9%、DeepSWEは12.8%から62.7%へ伸びたと伝えている。15:25
6スマホで動く視覚言語モデル「LFM2.5-VL-3B」が登場、日本語対応でUI認識やOCRに活用できる米Liquid AIが視覚言語モデルLFM2.5-VL-3Bを発表し、スマートフォンでの動作が確認された軽量VLMで文書のOCRやUI認識が可能、オープンモデルとして無償ダウンロードできると伝えている。16:31
7Mistral AIのプラットフォームでサードパーティー製オープンモデルが選択可能に、まずはZ.aiのGLM-5.2からフランスのMistral AIが自社プラットフォーム「Vibe」などで自社モデル以外のサードパーティー製オープンモデルもサポートすると明らかにし、まずZ.aiのGLM-5.2から対応する。17:40
8AIモデルに子ども向けの動物物語を作らせると女性キャラをほぼ完全に排除してしまうワシントン大学の研究チームによるテストで、AIモデルに子ども向けの動物物語を作らせると雌のキャラクターがほとんど排除されてしまうことが明らかになった。19:00
9AI会議録サービス「tl;dv」で18万件超の会議メタデータにアクセス可能だったと研究者が報告、会社側は「別々の2つの脆弱性」と説明全ユーザーを横断して18万1874件の会議記録を取得できる脆弱性を独立系研究者が報告し6カ月間修正されなかったと非難したのに対し、tl;dv側は複数の攻撃経路が存在していたためだと説明している。20:08

Publickey

該当する記事はありませんでした。

OpenAI Blog

#TitleSummaryPublished
1OpenAI appoints Dali Rajic as Chief Revenue Officer(OpenAI、Dali Rajic氏を最高収益責任者に任命)OpenAIがグローバルの収益組織を率いる最高収益責任者としてDali Rajic氏を任命し、企業がAIの価値を最大限に引き出せるよう支援すると発表した。18:00
2The builder’s guide to GPT‑5.6(GPT-5.6のビルダー向けガイド)スタートアップがGPT-5.6でより速く低コストなAIエージェントを構築する方法を、賢いモデル選択とResponses APIの新機能という観点から解説している。20:00

Google AI Blog

該当する記事はありませんでした。

Hugging Face Blog

#TitleSummaryPublished
1Introducing OlmoEarth embeddings: Custom embedding exports from OlmoEarth Studio for downstream analysis(OlmoEarth embeddingsの紹介:下流分析向けにOlmoEarth Studioからカスタム埋め込みをエクスポート)地球観測モデルを構築するOlmoEarth Studioで埋め込みベクトルを計算・エクスポートできるようになり、類似検索・少数ショットセグメンテーション・変化検出・教師なし探索に使えるとAi2が説明している。01:14
2What We Learned by Reproducing 2,200 papers from ICML(ICMLの論文2,200本を再現して分かったこと)1,200人超が自前のコーディングエージェントを持ち寄った19日間のハッカソンで、ICML 2026の約3分の1にあたる2,226本の論文についてTrackioログ6,816件が公開されたと報告している。09:00

Simon Willison

#TitleSummaryPublished
1Quoting Florian Herrengt(Florian Herrengtからの引用)同じバグの修正をAIに4度依頼しても解決せず、機能を担当した人に聞いても「データがどこから来るのか分からない、Claudeに聞いてみる」と返ってくるという、理解を失ったチームの姿を引用している。00:08

The Decoder

#TitleSummaryPublished
1AI tools for breast cancer detection fall short of radiologists’ expectations(乳がん検出AIツールは放射線科医の期待に届いていない)Society of Breast Imagingの会員215人への調査で、約半数がFDA承認のAIツールを既に使っているものの、リコール率の低下を報告したのは35%にとどまり期待していた59%との差が全項目で開いていた。01:24
2Researchers can now reverse-engineer LLM prompts from output text with near-perfect accuracy(研究者がLLMの出力テキストからプロンプトをほぼ完璧な精度で逆算可能に)IIT BombayとAdobe Researchが「Previous-Token Prediction」と呼ぶ逆言語モデルを構築し、モデルの重みへアクセスせず異なるモデル間でも元のプロンプトを高精度に復元できると示した。02:32
3SpaceXAI’s Grok 4.6 matches OpenAI’s best model and undercuts it on price(SpaceXAIのGrok 4.6がOpenAI最良のモデルに並び、価格では下回る)Grok 4.6はArtificial Analysis Intelligence Indexで61点を取りGPT-5.6 Solと並び、Claude Opus 5が103手を要する複雑なワークフローを約53手で完了し価格は6割以上安いと報じている。03:33
4Anthropic brings Claude Cowork to its Chrome extension, adding skills and plugins to the browser(AnthropicがClaude CoworkをChrome拡張機能に搭載し、ブラウザにスキルとプラグインを追加)Claude CoworkがAnthropicのChrome拡張機能のサイドパネル内で直接動作するようになり、スキルとプラグインがブラウザ上へ持ち込まれたと報じている。19:15
5Top AI lab researchers warned about automated AI research, and several of their predicted milestones have already fallen(主要AIラボの研究者はAI研究の自動化に警鐘を鳴らしていたが、予測したマイルストーンのいくつかは既に達成された)IAPSのSeverin Field氏がOpenAI・Anthropic・Google DeepMind・Metaと米大学の研究者25人へ再帰的自己改善について聞き取った内容を棚卸しし、挙げられたマイルストーンのいくつかは既に到達済みだと整理している。19:42
6Fable 5’s slow adoption suggests corporate willingness to pay for frontier AI has hit a ceiling(Fable 5の普及の遅さは、フロンティアAIに支払う企業の意欲が頭打ちになったことを示唆する)Rampのデータでは市場最強とされるAnthropicのFable 5が販売トークンの6%しか占めておらず、性能向上が日常の価値へ結びつかない限り企業のAI支出は頭打ちだと分析している。19:46

Hacker News

該当する記事はありませんでした。

RECENT ISSUES 最近の号 BACK NUMBERS

すべてのバックナンバーを見る →