VOL. 081
AI NEWS DIGEST
AI OUTLINE
2026-07-16
木曜日 · JST
TODAY’S ISSUE 2026年7月16日 · 木曜日 AI FRONTLINE

AIニュースまとめ 2026-07-16|OpenAIが初のハードウェア「Codex Micro」を230ドルで発売

アップデート情報

各社が 2026-07-16 に公式発表したプロダクトアップデートです。

Claude / Claude Code

ChatGPT / Codex

Gemini

Top 20

OpenAI、初のハードウェア「Codex Micro」を230ドルで発売 Apple提訴の渦中にある端末とは別物

Source: ITmedia | Published: 2026-07-16 07:26 JST

OpenAI、自動レッドチームAI「GPT-Red」発表──人間の攻撃成功率13%に対し84%

Source: ITmedia | Published: 2026-07-16 12:10 JST

Thinking Machines、初のAIモデル「Inkling」公開──オープンウェイトで「自分のものにできる」基盤モデル

Source: ITmedia | Published: 2026-07-16 09:47 JST

大手共同出資の”国産AI開発企業”が本格始動 NVIDIAも協力、「Rubin」2万7500基搭載の計算基盤を構築へ

Source: ITmedia | Published: 2026-07-16 19:07 JST

「Gemini Spark」日本でもリリース、まずUltraから 24時間働く”パーソナルAIエージェント”

Source: ITmedia | Published: 2026-07-16 13:53 JST

フアンCEO「ジャパンAI構築はマストだ」 経産省、国産フィジカルAIで新プロジェクト 赤沢大臣も”革ジャン”羽織る

Source: ITmedia | Published: 2026-07-16 23:00 JST

xAI open-sources “Grok-Build” on GitHub after massive data breach(xAI、大規模データ漏洩を受け「Grok Build」をGitHubでオープンソース化)

Source: The Decoder | Published: 2026-07-16 16:56 JST

「Claude」利用制限を全リセット CodexとChatGPT Workも “リセット合戦”再び

Source: ITmedia | Published: 2026-07-16 15:15 JST

NVIDIAが「Jetson Thor」に新モジュール追加、高騰するメモリの使用量削減技術も

Source: ITmedia | Published: 2026-07-16 08:00 JST

「AIと壁打ちはもう古い」 業務タスクを任せる「Claude Cowork」の落とし穴

Source: ITmedia | Published: 2026-07-16 13:00 JST

Anthropicと組んだNEC それでも森田社長が「4つの主権」にこだわる真意

Source: ITmedia | Published: 2026-07-16 07:00 JST

富士通、国内ロボット大手3社と「フィジカルAI」で協業 NVIDIAの技術活用

Source: ITmedia | Published: 2026-07-16 19:43 JST

Sakana AI’s orchestrator adds Nvidia Nemotron to prove “collective intelligence” can rival single frontier models(Sakana AIのオーケストレータが Nemotron を追加し「集合知」で単体フロンティアモデルに対抗)

Source: The Decoder | Published: 2026-07-16 23:02 JST

GPT-5.6 Sol reportedly disproves a 30-year-old statistics conjecture in 90 minutes after humans couldn’t crack it(GPT-5.6 Solが未解決だった30年前の統計予想を90分で反証したと報告)

Source: The Decoder | Published: 2026-07-16 02:35 JST

Bonsai 27B is a full open reasoning model that fits on an iPhone(Bonsai 27B、iPhone に収まるフル機能のオープン推論モデル)

Source: The Decoder | Published: 2026-07-16 00:55 JST

Gemma 4 gets a stealth update that fixes tool calling bugs and truncated responses under the same name(Gemma 4、同名のままツール呼び出しバグと応答途切れを直すステルスアップデート)

Source: The Decoder | Published: 2026-07-16 18:07 JST

トンカツ食べながら語った――NVIDIA、富士通、安川電機ら”フィジカルAI連合”誕生、発表直前の裏話

Source: ITmedia | Published: 2026-07-16 17:15 JST

Claude、NotebookLM、Genspark……238社が選んだ「現場が支持する」AIサービス

Source: ITmedia | Published: 2026-07-16 07:00 JST

中国が「Apple Intelligence」導入を承認

Source: GIGAZINE | Published: 2026-07-16 12:55 JST

Claudeのメモリから個人情報を盗み出す攻撃手法

Source: GIGAZINE | Published: 2026-07-16 19:00 JST


All Articles

日本語ソースはそのまま表示し、英語ソース(OpenAI Blog, The Decoder, Simon Willison など)の記事タイトルは日本語訳を併記しました。ランク外の全記事に一行要約を付与しています。

ITmedia AI+

#TitleSummaryAuthorPublished
1フアンCEO「ジャパンAI構築はマストだ」 経産省、国産フィジカルAIで新プロジェクト 赤沢大臣も”革ジャン”羽織る経済産業省が国産フィジカルAI基盤の「FRONTia」プロジェクトを立ち上げ、NVIDIAのフアンCEOが「ジャパンAI構築はマストだ」と発言したと報じている。-23:00
2富士通、国内ロボット大手3社と「フィジカルAI」で協業 NVIDIAの技術活用富士通が国内ロボット大手3社と、NVIDIAの技術を用いたフィジカルAIの協調制御基盤で協業すると発表している。-19:43
3大手共同出資の”国産AI開発企業”が本格始動 NVIDIAも協力、「Rubin」2万7500基搭載の計算基盤を構築へ大手コンソーシアム出資の国産AI開発企業Noetraが本格始動し、NVIDIAのRubin2万7500基を積む大規模計算基盤を構築すると発表している。-19:07
4トンカツ食べながら語った――NVIDIA、富士通、安川電機ら”フィジカルAI連合”誕生、発表直前の裏話NVIDIA・富士通・安川電機ら5社の経営幹部が、フィジカルAI連合の発表直前にトンカツ屋で連携を詰めていた裏話を伝えている。-17:15
5「Claude」利用制限を全リセット CodexとChatGPT Workも “リセット合戦”再びAnthropicがClaudeの5時間・週次制限をリセットし、その16分後にOpenAIもCodexとChatGPT Workの制限を解除したと報じている。-15:15
6「Gemini Spark」日本でもリリース、まずUltraから 24時間働く”パーソナルAIエージェント”GoogleがGemini Sparkの日本提供をUltraユーザ向けに開始し、24時間常時稼働のパーソナルAIエージェントとして展開すると発表している。-13:53
7「AIと壁打ちはもう古い」 業務タスクを任せる「Claude Cowork」の落とし穴AnthropicがClaude Coworkの業務委任ガイダンスを公開し、初期セットアップやセッション記憶の限界が落とし穴になり得ると解説している。-13:00
8OpenAI、自動レッドチームAI「GPT-Red」発表──人間の攻撃成功率13%に対し84%OpenAIが自動レッドチームAI「GPT-Red」を発表し、攻撃成功率84%で人間の13%を大きく上回ったと報じている。-12:10
9Thinking Machines、初のAIモデル「Inkling」公開──オープンウェイトで「自分のものにできる」基盤モデルミラ・ムラティ氏率いるThinking Machines Labが、初のマルチモーダル基盤モデル「Inkling」をオープンウェイトで公開したと報じている。-09:47
10NVIDIAが「Jetson Thor」に新モジュール追加、高騰するメモリの使用量削減技術もNVIDIAがJetson ThorにT3000とT2000の新モジュールを追加し、メモリ使用量を抑える圧縮技術も同時に打ち出したと報じている。-08:00
11OpenAI、初のハードウェア「Codex Micro」を230ドルで発売 Apple提訴の渦中にある端末とは別物OpenAIが230ドルの自社初ハードウェア「Codex Micro」を発売し、Apple提訴で言及された端末とは別プロジェクトだと明示している。-07:26
12Claude、NotebookLM、Genspark……238社が選んだ「現場が支持する」AIサービス238社調査で現場が支持するAIサービスとしてClaude・NotebookLM・Gensparkが上位に挙がったと分析している。-07:00
13Anthropicと組んだNEC それでも森田社長が「4つの主権」にこだわる真意NECが3週間でAnthropicとの提携合意に至った一方、森田社長がAI・データ・インフラ・技術の4主権にこだわる理由を語ったと報じている。-07:00

The Decoder

#TitleSummaryAuthorPublished
1OpenAI wants developers to stop typing commands and start using a joystick to control their AI agents(OpenAI、コマンド入力ではなくジョイスティックでAIエージェントを操作するデバイスを公開)Codex Micro のコンパクトハードウェアコントローラは、Work Louder との共同開発によりAIエージェント操作を物理入力で担わせる方向性を示したと報じている。Jonathan Kemper23:31
2Sakana AI’s orchestrator adds Nvidia Nemotron to prove “collective intelligence” can rival single frontier models(Sakana AI、Nemotron を Fugu に統合し集合知で単体モデルに対抗)Sakana AIがオーケストレータFuguにNVIDIA Nemotronを組み込み、複数モデルの集合知で単体フロンティアモデルに対抗する構成を打ち出したと報じている。Jonathan Kemper23:02
3Ex-OpenAI CTO Murati’s Thinking Machines drops Inkling, a 975B parameter model that leads US labs but trails China(元OpenAI CTOムラティ氏のThinking Machines、米ラボ首位も中国勢に劣後する975BのInklingを公開)Thinking Machines Lab が Inkling を公開し、米オープンウェイト勢の首位に立つ一方で中国勢のスコアには届いていないと分析している。Matthias Bastian18:55
4Gemma 4 gets a stealth update that fixes tool calling bugs and truncated responses under the same name(Gemma 4、同名のままツール呼び出しと応答途切れを修正するステルスアップデート)GoogleがGemma 4に同名のままステルス更新を配信し、ツール呼び出しと応答途切れの不具合を修正しつつHopper GPU上の速度も改善したと報じている。Jonathan Kemper18:07
5xAI open-sources “Grok-Build” on GitHub after massive data breach(xAI、大規模データ漏洩を受け Grok-Build を GitHub でOSS化)xAIがユーザ環境のSSH鍵やパスワードデータベースを漏洩させた後、Grok BuildコマンドラインエージェントをGitHubで全面オープンソース化したと報じている。Matthias Bastian16:56
6OpenAI is now using AI to attack its own AI, and it’s working better than humans ever did(OpenAIが自社AIを攻撃するAIを投入、人間より高い成功率で機能中と伝えた)GPT-Red が自己対戦学習で84%の攻撃成功率を達成し、人間の13%を大きく上回ったと報じている。Matthias Bastian04:47
7GPT-5.6 Sol reportedly disproves a 30-year-old statistics conjecture in 90 minutes after humans couldn’t crack it(GPT-5.6 Sol、人間が解けなかった統計学の30年予想を90分で反証したと報告)研究者がGPT-5.6 Sol Proを使って、統計手法に関する30年物の未解決予想を約90分で反証する結果を得たと報告している。Matthias Bastian02:35
8Bonsai 27B is a full open reasoning model that fits on an iPhone(Bonsai 27B、iPhone に収まるフルオープンな推論モデル)PrismMLが270億パラメータの推論モデルを4GB未満に圧縮し、元性能の約90%を保ちながらiPhone上での動作を可能にしたと報じている。Jonathan Kemper00:55

GIGAZINE

#TitleSummaryAuthorPublished
1Claudeのメモリから個人情報を盗み出す攻撃手法Claudeのweb_fetchツールを悪用して悪意サイトから個人情報を持ち出す攻撃手法が公開され、Anthropicは既に対応パッチを配布済みだと報じている。-19:00
2OpenAIが「GPT-Red」を発表自社モデルへ自動で敵対的攻撃を仕掛ける社内AIモデル GPT-Red を投入し、人間より高い成功率で脆弱性を洗い出すと解説している。-13:07
3中国が「Apple Intelligence」導入を承認中国政府がAppleの生成AI機能「Apple Intelligence」の国内提供を承認し、現地パートナー選定を経て正式導入されると報じている。-12:55
4OpenAI初のハードウェア「Codex Micro」登場OpenAI 初の自社ハードウェアとして、1ボタンで Codex エージェントを呼び出せる小型キーパッド Codex Micro が発売されたと報じている。-12:33
5Googleの「Gemini Spark」が日本語対応24時間常時稼働の Gemini Spark エージェントが日本語に正式対応し、日本ユーザ向けのタスク自動化提供が本格化したと伝えている。-11:20
6オープンウェイトAIモデル「Inkling」登場Thinking Machines Lab による Inkling が公開され、画像・音声・コードを扱うマルチモーダル基盤モデルとしてカスタマイズ推論をアピールしていると報じている。-11:15
7「Grok Build」がオープンソース化データ漏洩を起こしたばかりの xAI 製 Grok Build コマンドラインエージェントが Apache 2.0 で全面公開されたと報じている。-11:08

Simon Willison

#TitleSummaryAuthorPublished
1Quoting Linus Torvalds(Linus Torvalds の発言引用)Linus Torvalds が Linux は AI ツールを他の開発ツールと同列に扱う立場を維持すると発言したと引用している。Simon Willison22:26
2Mermaid to Unicode box art (grok-mermaid)(Mermaid を Unicode 罫線化する grok-mermaid)オープンソース化された Grok Build コードベースから、Mermaid 図を WebAssembly でブラウザレンダリングする grok-mermaid を切り出したと解説している。Simon Willison09:33
3xai-org/grok-build, now open source(xai-org/grok-build がオープンソース化)xAI が Grok Build を Apache 2.0 で公開し、84万4530行のRustコードとエージェントツール一式が閲覧可能になったと紹介している。Simon Willison08:59

Zenn

#TitleSummaryAuthorPublished
1M365 Copilot Cowork × Claude Cowork SIerの業務効率化は役割分担で最大化SIer 向けに M365 Copilot Cowork と Claude Cowork を役割分担して併用するのが効率的だと論じている。@satoshi yoshida22:47
2Claude Code Workflowは「並列フェーズ」にだけ使え——順次処理に使うとコストが5.7倍に膨れるClaude Code Workflow を順次処理に使うとコストが5.7倍になったため並列フェーズに限定すべきと結論している。@saitoko22:45
35種類のグラフは1つのDBに入らない。本番のレイヤー設計AIエージェント向けのグラフ5種類を単一DBに詰め込めないため本番向けのレイヤー分離設計が必要だと解説している。@takanorisuzuki22:44
4OmniRoute+OpenCodeで月16億トークン無料は実現できるのかOSS の OmniRoute と OpenCode を組み合わせて Claude Code を月16億トークン無料枠内で運用できるかを実測している。@mskbhd22:30
5Agentic Architectures 35パターンを実装したOSSを動かしてみた35種類のプロダクション向けエージェントパターンを Python で実装したOSSを実際に動かし、パターン単位の分離設計の効果を確認している。@mskbhd22:30
6【2026年最新】Bonsai 27B完全ガイド — iPhoneで動く1-bit版とTernary版の違い・選び方Bonsai 27B の1ビット量子化版とTernary版のトレードオフを比較し、iPhone 上での選び方を整理している。@amu_lab22:23
7Astro/CSSの変更をPR影響範囲から落とさない — AI並列開発の確認ポイントAI 並列開発中に Astro と CSS の変更が PR の影響範囲から抜けやすい問題を、確認ポイントの整理で防いだと報告している。@RollNuts22:15
8競馬AI開発記録 #24:単勝特化の限界を「複勝専用モデル」で突破する競馬 AI で単勝特化モデルが頭打ちになったため、複勝専用モデルと特徴量分離で突破したと分析している。@tiler22:12
9個人でLLMゲートウェイを本番運用する ——『作った』ではなく『動かし続けている』話個人開発の LLM ゲートウェイを本番運用し続ける中で遭遇した6つの落とし穴と回避策を共有している。@seiryu22:10
10Agent Script条件分岐の書き方|新Agentforce BuilderでAI判断と確定ロジックを組み合わせる実践ガイド新 Agentforce Builder の Agent Script でAI判断と確定ロジックを組み合わせる条件分岐の書き方を実践的に整理している。@sr_mc_ai_0622:08
11その反対意見、AIで検討済みです会議で出る反対意見を事前に AI に想定させて検討結果を共有する運用がレビュー効率を高めると論じている。@continuity-model21:01
12AIに任せた長時間処理が途中で落ちて全部やり直し ― チェックポイントと冪等性で「再開できる」ジョブを設計するAI に任せた長時間処理が落ちる問題に対し、チェックポイントと冪等性で再開可能なジョブ設計に切り替えたと解説している。@あきらパパ20:49
13Claude Codeに「記事化スキル」を作らせたら、レビューサイクルでバグが4つ見つかった話Claude Code に記事化スキルを自作させたところ、レビューサイクル中に4件のバグが検出されたと報告している。@yusukekcode20:30
14”山本さんを半日休ませたら、会社は3か所で止まった特定の従業員が半日休むと会社の3箇所で業務が止まる状況をAI分類器で可視化する設計を紹介している。@Hiroshift≈20:12
15BigQuery MLのTimesFMで電力需要を時系列予測してみたBigQuery ML の TimesFM を使って電力需要の時系列予測を試し、実データでの精度と使用感をまとめている。@xthixsl_ml@レオナ20:12
16Meta・X・OpenAI・Anthropic・Google・Microsoft──「AIの稼ぎ方」を6社で比べてみる主要AI企業6社の収益モデルを比較し、それぞれの「稼ぎ方」の違いを整理している。@TheGateBreaker19:30
17LLM時代の次の課題は「知能」ではなく「接続」ではないか ― Cognitive OS Translation Middleware構想LLM の次の課題は知能そのものではなく、人間との認知的な翻訳ミドルウェアの整備だと主張している。@Loni906019:22
18コンテキストを途切らせないObsidian術【つかう編】AIが「昨日のあれ」を引き出す会話やドキュメントを Obsidian に集約することで、AIが「昨日のあれ」を素早く引き出せるようになると解説している。@あかりんご19:00
19説明書を、もう書かない。AIに書かせた3,500行のドキュメントを、全部捨てた話WordPress プラグイン開発で AI が書いた3,500行超のドキュメントを廃棄し、ソースコード直提示に切り替えたと述べている。@imai18:58
20AI駆動開発にDevOpsが「後回しにできない」理由AI 駆動開発では実装スピードが上がるほど DevOps を後回しにできなくなるとその理由を整理している。@ShintaroAmaike18:45
21AIキャラクターに「黙る」ことを教える ― 自発メッセージを3段ゲートで設計した話AI キャラクターに自発発言を抑える3段ゲート設計を組み込み、不要な話しかけを抑制できたと報告している。@Yuralume18:23
22非エンジニアによるAI開発と設計の記録(ADR)について非エンジニアが Claude Code で AI 対話開発を進める際、ADR を必須文書として79件維持したと共有している。@Blue18:14
23Claudeが予定を捏造しなくなった日 ― Google Calendar APIでground truthをVaultに注入するGoogle Calendar API から実カレンダーを Vault に注入することで、Claude の予定捏造を止められたと結論付けている。@Lily18:06
24プロンプトを書く時代は終わったのか?Claude Codeの/goalを実際に試したClaude Code の /goal を実際に試し、明示的プロンプトからゴール指定への転換がどこまで進んでいるかを検証している。@aoi_dev18:06
25生成中の「待つ」をどう設計したか 〜 MANAVO開発ログ③ 〜動画生成AI MANAVO の開発ログで、生成中の「待ち時間体験」を設計する際の判断過程を述べている。@apu18:01
26VSCode で AI 開発、結局どれを使えばいいのか問題GitHub Copilot・Cursor・Windsurf・Cline・Continue・Claude Code の使い分けを比較し、選定基準を整理している。@ganchan109117:56
27生成AIで部屋の未来を可視化する「HomeDesign AI」を作ってみた部屋の家具配置やリノベ後の姿を生成AIで可視化するサービス HomeDesign AI を試作したと紹介している。@bowie257417:41
28Transformerは過去を見返す。Mambaは状態を書き換える——Mamba-1/2/3をMarkdown図解Transformer と Mamba1/2/3 の状態管理の違いを Markdown 図解で並べ、状態空間モデルの設計思想を比較している。@James Yusuke17:39
29AIコーディングエージェント選定を”感覚”から”数字”へ:agent-cost-benchをAWS上で試すAI コーディングエージェント選定を数値化するため、agent-cost-bench を AWS 上で実測してみたと報告している。@Yutaka Kashiwabara17:30
30ループエンジニアリングのよくある失敗例6選 —— ループは判断を増幅する装置であるエージェントのループ設計で頻出する6つの失敗例を列挙し、判断の質を増幅する装置としてループを扱うべきだと論じている。@ryunote217:06
31既存のSalesforce環境で迷子にならない!Claude Code×メタデータで始める高速キャッチアップ既存 Salesforce 環境のキャッチアップに Claude Code とメタデータを組み合わせ、迷わない把握手順を提示している。@カルメン17:00
32閉じ込めた街でAIに密室会議させたら、Claudeだけ引っ越し審査に落ちた話プライバシー保護された VPC 内で複数モデルにAI密室会議をさせたところ、Claude だけ引っ越し審査で落ちたと分析している。@miki-mini17:00
33Claude Code の Plan モードをループエンジニアリングで楽にするClaude Code の Plan モードを hooks とループエンジニアリングで自動化し、要求整理の手数を減らせたと解説している。@Yoshiya16:40
341-bit LLM「Bonsai 27B」、英語なら評判通り、日本語ではポンコツ…Bonsai 27B の1ビット圧縮版は英語ベンチマークでは評判通りだが、日本語タスクでは精度が大きく落ちたと結論付けている。@orange16:46
35批判的Subagentで実装者バイアスを防ぎ、E2Eテストまで行う、承認ゲート方式のPRレビューSkillsを作った。批判的サブエージェントで実装バイアスを打ち消し、E2Eテストまで実行する承認ゲート方式の PR レビュー Skill を構築したと報告している。@ヤマシ田中16:28
36Claude Code で育児のエビデンス情報アプリを作る — AIが捏造する「それっぽい出典」を構造で防ぐClaude Code で育児エビデンス情報アプリを構築する際、AI が捏造する出典を構造設計で防いだと述べている。@takotyan0016:01
37本は読んだだけでは身につかない。だから Claude Code の Skill にしよう書籍の問題解決手法を Claude Code の Skill に落とし込み、読了後の実践定着を狙う手順を紹介している。@Tomoya15:00
38Cloudflare WorkersとWorkers AIで「ボケたい」というWebサービスを作ってみたCloudflare Workers と Workers AI を組み合わせて、画像に対して AI がボケを付けるサービスを作ったと報告している。@黒ヰ樹14:00
39My CLAUDE.md Hit 329 Lines — So I Built a 64-Skill Knowledge Base(CLAUDE.md が329行に膨らんだので64Skillの知識ベースを作った)329行に膨らんだ CLAUDE.md を、12部門にまたがる64個の Skill 統合構成に置き換え運用効率を上げたと述べている。@kimny14:34
40Claude Code Forgets Everything. I Fixed That with 274 Memory Files.(Claude Code が全部忘れるので274個のメモリファイルで解決した)継続作業でコンテキストを失う Claude Code の弱点を、623ファイルからなる構造化メモリで補ったと解説している。@kimny14:34
41【Claude Code】CLAUDE.mdのルールはClaude自身に書かせる 〜ガードレール&自動化Rule設計〜CLAUDE.md のルールを人手で書かず Claude 自身に生成させ、ガードレールと自動化ルールを設計させる運用を紹介している。@まさぴょん🐱22:00
42V字モデルで始まるMCPサーバー開発:単体テスト編(04)V字モデル準拠の MCP サーバー開発で単体テスト工程における確認項目を体系化している。@WONGI JEONG13:59
43Codex App Serverは何がすごい? Codexとのやり取りを専用UIで組み立ててみようCodex App Server の特徴を、専用UIから Codex を呼び出すハーネスを組む観点で解説している。@Ryota Yamaguchi12:52
44AIに会社を運営させるなら、“何を自動化して・どこに人間を残すか”を先に決めるAI に会社運営を任せる前提として、自動化する範囲と人間承認を残す境界を先に決める3つのルールを提案している。@限界社会人13:42
45「なぜ買ったか」を記録して答え合わせする投資判断ジャーナルを、AIとふたりで作って公開したClaude Code と協力し、投資理由と結果を突き合わせる個人向け投資判断ジャーナルを作って公開したと述べている。@ukintech13:37
46Claude Codeの複数セッション同士を繋げるMCPを作ってOSSにした(Discord連携もあり)複数の Claude Code セッション同士を発見・接続する MCP サーバーを Bun 製で OSS 化し、Discord ブリッジも同梱したと発表している。@yoshi13:31
47介護士がClaude CodeでAI開発チームを作った話介護士出身の開発者が Claude Code で Planner・Generator・Evaluator の3エージェント体制を構築したと共有している。@介護士AIエンジニア13:28
48Claude Codeにとりあえずsubagent_type forkが追加されているClaude Code に予告なく追加された subagent_type fork の挙動を検証し、環境分離型のサブエージェント生成の可能性を探っている。@yukineko13:16
49Inklingを使う前に作る、キャッシュ込みLLMルータの3層設計Inkling を導入する前提として、キャッシュ・コスト・レイテンシを分ける3層構造の LLM ルータ設計を提案している。@中村 啓13:15
50Gemma 4 iPhone実験の番外編:dLLMをGGUFで動かしてみるGemma 4 iPhone 実験の派生として、分散LLM を GGUF 形式でiPhone上に落とせるかを試している。@アジサシ21:32
51好きなmp3を目覚まし音にできるAndroidアラームアプリをFlutter × Claude Codeで作った話Flutter と Claude Code で、任意 MP3 を目覚まし音に指定できる Android アラームアプリを作ったと報告している。@ユウ12:43
52The First Ransomware Attack Run Entirely By An AI Agent Just Happened(AIエージェントだけで完結する最初のランサムウェア攻撃が発生)AI エージェント単独で実行されたランサムウェア攻撃の事例を解説し、人間の関与なしに侵害が完了したと警告している。@NeoTechPark12:42
53定期実行でLLMに『やる/やらない』を判断させる — 量産型自動化からの脱却定期実行の自動化にLLMの実行可否判定を組み込み、量産型のノータイム実行から意思決定型自動化へ移行する設計を紹介している。@まめ研究員12:30
54Seedance 2.5とは?Sora・Veo時代のAI動画制作を変える可能性についてSora・Veo 世代の中で登場した Seedance 2.5 のキャラ一貫性・動き・カメラワークの特徴を分析している。@oliver_aivideo12:38
55Claude Codeの並列セッション、どれが止まってるか分からない問題をmacOSアプリで解決したClaude Code の並列セッションのどれが停止したか分かりにくい問題を、macOS メニューバーアプリで可視化して解決したと報告している。@hatoya12:00
56【Claude Code】Skillsの運用に正解を出してみるClaude Code Skills のチーム運用でコンテキスト肥大化を抑える標準化ガイドラインをまとめている。@株式会社ノーコードソリューションズ11:53
57人間とAIのあいだに、第三の知性は生まれるか人間とAIの協働から一時的に立ち上がる「第三の知性」領域の概念を哲学的に考察している。@PhD Taka11:27
58ループエンジニアリングよくある失敗例のもう1面 GSPOAlibaba の GSPO 手法が GRPO 学習の崩壊をシーケンス単位の重要度重み付けで抑える仕組みを解説している。@そんけいご11:09
59AIに任せた長時間処理が途中で落ちて全部やり直しチェックポイントと冪等性を軸に、AI 依頼の長時間処理を再開可能に設計するアプローチを述べている。@あきらパパ20:49
60Claude Codeのskillをskillでレビューする ― 静的チェック×LLMレビュー×git hooksの3層ゲート静的解析・LLM レビュー・git hooks の3層で Claude Code Skill を自動レビューする仕組みを構築したと解説している。@chiba_k10:00
61LIFFの白画面を”問い合わせ前”に検知する — 外部SaaSなしのフロント可観測性とAI×人間の設計対話CloudWatch Logs と Claude Code を組み合わせ、LINE Mini App の白画面クラッシュを外部 SaaS なしで検知したと述べている。@fixU09:57
62Claudeくんに「800兆円の被害額が出る」と言わせた8.3問題についてWindows 8.3 形式ファイル名の脆弱性を Claude に説明させ、Y2K 級の被害額として算出させた思考実験を紹介している。@matya_zenn08:36
63AIレビュー済みのPRを、人間がもう一度バグ探しするのは間違いAI レビュー済み PR に対して人間が再びバグ探しをするのは非効率で、移植性・設計判断・権限境界に集中すべきと主張している。@Sato Kotaro08:30
64Claude Visionに数分の動画から「ベストな15秒」を選ばせる設計Claude Vision にフレーム抽出とタイムスタンプを渡し、SNS 向けに最適な15秒を自動選定させる設計を提案している。@ツバメ08:00
65GPT-5.6 vs Claude、実戦で差が出るのはここだGPT-5.6 と Claude Fable 5 を6つの実戦シナリオで比較し、マルチモーダル速度対コンテキスト長という差異を整理している。@lingmu07:10
66codex-first? claude-first? 両者に「共存プラン」を設計させたら、利益相反の構図が面白かった【経緯編】Codex と Claude に共存プランを相互設計させ、両者の利益相反構図が浮かび上がった経緯を報告している。@izumuzui08:19
67GPT-Redとは?OpenAIが公開した「AIを攻撃するAI」の仕組みを解説GPT-Red が自動的に多様な攻撃パターンを発見してセキュリティテストを回すOpenAIの新機構を解説している。@Jun Miyake07:30
68複数議事録のタスク重複統合、文言一致ではなく内容一致で判定させる運用複数議事録のタスク重複を検出する際、文言一致ではなく内容一致で AI に判定させる運用を提示している。@毎日AIレシピ06:10
69「腐った」「効いた」を、どう判定したか。AIコード半年運用で使った物差しの話AI 生成コードを半年運用した後で「腐った」「効いた」を判定するために自作した評価物差しを解説している。@Rapls10:01
70SNSで話題のClaude Codeスラッシュコマンド、実在するのか全部実機検証してみたSNS で話題の Claude Code スラッシュコマンドが本当に存在するかを、全て実機で検証している。@ねねね09:38
71MCPとは何か?Microsoft Fabric Data Agentと接続して仕組みを理解するMicrosoft Fabric Data Agent と MCP を接続する過程を通じ、REST API との違いや MCP のサーバ/クライアント構造を説明している。@Nakajima Tsuyoshi13:01
72Nemotron Labs Puzzle 75B と Qwen の比較メモNVIDIA の Nemotron-3 Puzzle 75B MoE と Qwen 系モデルを、コーディングエージェント用途で比較したメモをまとめている。@のぶさん18:02
73Claude Codeの『指示書』を丸ごと書き換えたら、自分でpwdを叩いて道を確かめ始めたClaude Code のシステム指示書を全書き換えする実験で、モデル自身が pwd で現在地を確認し始めたと観察している。@ぬまーん11:32
74LLMを組み込むと、アーキテクチャ特性はどう変わるか? —『ソフトウェアアーキテクチャの基礎』を読んで『ソフトウェアアーキテクチャの基礎』を踏まえ、LLM 組み込みでアーキテクチャ特性がどう変化するかを整理している。@ジェヒョン12:22
75『考える過程』を記録するMCPサーバーに、存在しない思考番号を投げたらそのまま通ったMCP の Sequential Thinking サーバに、存在しない思考IDを渡してもエラーにならない実装欠陥を検証している。@ぬまーん02:36
76誰も教えてくれないLLMの経済学表に出にくい LLM 運用コストや価格戦略の観点から、LLM の経済学的な仕組みを掘り下げている。@Inoue, Takuya08:32
77LLM-as-a-Judge時代の、評価ツール選定完全ガイドBLEU や ROUGE 中心の評価から離れ、LLM を評価者として使う時代における評価ツール選定を体系化している。@tommy_suplex13:22
78【情シスのSkill】ClaudeでSaaSセキュリティ評価チェックSkillを作ってみた情シス業務向けに、Claude Skill として SaaS セキュリティ評価チェックを自動化する実装事例を紹介している。@asano1113:54
79V字モデルで始まるMCPサーバー開発:詳細設計編(03)外部ツール仕様を内部ロジックとデータ構造に落とす詳細設計工程を、V字モデルの MCP サーバ開発向けに整理している。@WONGI JEONG08:41
80AIのためのTool集Headroom や Caveman などAIのコスト削減に効くツールを目的別に紹介している。@西濱大将09:03
81非同期パーソナルエージェントのススメ実行タイミングとユーザ指示のタイミングを切り離す非同期型パーソナルエージェントの利点を論じている。@mikio11:50
82LLM エージェントに fault injection TDD を入れたら silent failure が3件出たLLM エージェントパイプラインに fault injection 型 TDD を導入した結果、通常テストでは通ってしまう silent failure が3件見つかったと報告している。@Tatsuya Shimomoto09:00
83ローカルLLM(Ollama + Qwen2.5)でAIエージェントを自作するハンズオンOllama と Qwen2.5 を用い、フレームワーク非依存でローカル LLM エージェントを自作するハンズオンを提供している。@Hiroki Kameyama05:30
84AIが古いFAQを答えないように、GASで鮮度レビューキューを作るGoogle Apps Script で FAQ の鮮度レビューキューを構築し、AI が古い情報を回答してしまう問題を予防したと解説している。@Kirisaki Kazuya05:33
85clipwright v0.38.0 — 2通目のIssueは、Resolveで検証済みのコード付きだったAI エージェント専用の動画編集 MCP サーバ「clipwright v0.38.0」で、コミュニティから届いた Issue が検証済みコード付きだった経緯を紹介している。@satoh-y-032301:05

Qiita

#TitleSummaryAuthorPublished
1社内AIに「分かりません」と言わせても信頼は戻らなかった。効いたのは検索の作り直しだった社内 AI に「分かりません」と言わせても信頼回復には効かず、ハイブリッド検索とリランキング刷新で採用率が35%から62%に改善したと分析している。@nzw23:24
2Claude Code v2.1.211: 権限プレビュー偽装対策と Bedrock 課金バグを修正Claude Code v2.1.211 を、権限プレビュー偽装対策と Bedrock 課金バグ修正を中心にまとめている。@picnic21:46
3AIコードレビューはPRの9割のファイルを読まなくていい:KGで範囲を絞るナレッジグラフで PR の対象範囲を絞り、AI コードレビューで読むファイルを 90.4% 削減できたと報告している。@kenimo4922:30
4ローカルLLMをSV/UVM用に育てる(ゲート強化編)ハードウェア検証向けにローカル LLM を訓練する過程で、仕様書をハイブリッド検索する MCP サーバ spec-rag を統合したと述べている。@sukimaengineer21:25
5ServiceNowアプリのリリースノート情報を取得する機能をMCPに追加してみたServiceNow 用 MCP サーバに、ストア公開アプリのリリースノートを検索する機能を追加した実装過程を紹介している。@tedorigawa00120:54
6なぜAWSは選ばれたのか ― 標準化の力学で読み解くAI時代のプロトコル戦争標準化の力学からAWSの成功要因を読み解き、AI時代のプロトコル戦争で MCP が有力候補になり得ると分析している。@nakatada-lab19:53
7AI Autonomous Task Management — OpenClawハートビート自律駆動(AIが寝ずにタスクリストを回し続ける仕組み)OpenClaw のハートビート機構で、人間が寝ている間にログ整理とメモリ蒸留を続ける自律タスク管理を紹介している。@TT-Resolver23:27
8低スペックMacBookで作る ローカルLLM × VSCode コーディング環境低スペック MacBook でも動く Ollama ベースのローカル LLM と VSCode を組み合わせた開発環境の構築手順を説明している。@mi-ko_san23:31
9Fine-tuning vs RAG vs Prompt Engineering: How to Choose in 2026(Fine-tuning・RAG・プロンプトエンジニアリングの2026年版選び方)LLM カスタマイズの3手法を比較し、Fine-tuning・RAG・プロンプトエンジニアリングをどう使い分けるかの判断軸を示している。@agdexai21:51
10GraphRAG完全ガイド2026:知識グラフで従来RAGの限界を突破するMicrosoft の GraphRAG を軸に、従来のベクトル型 RAG の限界を知識グラフでどう突破するかを解説している。@agdexai21:50
11RAG完全ガイド2026:RAGパイプラインの設計・実装・評価まで【実践編】RAG パイプラインの設計・実装・評価までを、2026年時点のベストプラクティスに沿って実践的にまとめている。@agdexai21:50
12【無料】ローカルLLMでRAGのRerankingをしてみるローカル LLM で無料で完結する RAG リランキング実装を、Windows 11 と RTX 3050 Ti で試している。@cross_hino18:58
13素材の山を一瞬ですっきり【PADで一括ファイルのリネーム化】Power Automate Desktop で大量素材ファイルを一括リネームする業務手順を解説している。@serizawa715:18
14【Excel VBA】Office資料の表記ゆれ・誤字を自動チェック!Excel VBA で Office ドキュメントの表記ゆれや誤字を自動チェックするツールを開発する過程を記録している。@isomurash14:02
15割円の面積の公式…をsympyでAI先生に教えてもらいましたChatGPT を先生役に、SymPy を使って割円(弓形)の面積公式を導出させた記録を残している。@mrrclb48z13:45
16面倒なExcel設計書のメンテをAIとVBAで少しだけ楽にする方法Excel 設計書のメンテを、差分だけAIに抽出させて VBA で反映する半自動アプローチで軽減したと述べている。@I_Y_J10:10
17Googleの画像生成AIで日本語入りの図の作成を比較したら想定外の結果になった日本語ラベルを含む図を Google の画像生成AIで作らせた結果、想定外の文字化けや品質差が出たと比較している。@asayan_mana07:40
18【AIでWEBアプリ作成!】いつ、誰と、どこで、何をした?に特化したメモアプリをリリース!【ダレドコ開発記#001】いつ・誰と・どこで・何をしたを記録する Web メモアプリ「ダレドコ」をリリースしたと発表している。@karaage_neutrino20:57
19最近OpenAI Codex APIが本当に不安定で困っています。米国ピーク時間はタイムアウト、切断、遅延が酷く、リトライしても成功率が低いです。OpenAI Codex API が米ピーク時間帯にタイムアウトや切断を頻発し、リトライしても改善しない状況を報告している。@chennuj02212:13
20Claude Code / Cline の接続先を OpenAI互換APIに切り替える最小手順Claude Code や Cline の接続先を、最小構成で OpenAI 互換 API に切り替える手順をまとめている。@FlatkeyAI11:57
21GPT-Redとは?OpenAI公式発表を3分で速報解説GPT-Red の公式発表内容を、二人のキャラクター対話形式で3分で解説している。@kinamocchi_tech07:19
22LINEだけで旅行・買い物・近くのお店検索ができるAIアシスタント「LINE解決くん」を作ってみたLINE 上で旅行・買い物・近隣店舗検索を担う AI アシスタント「LINE解決くん」を試作したと紹介している。@placemail123400:55

Hugging Face Blog

#TitleSummaryAuthorPublished
1NVIDIA Nemotron 3 Embed Ranks #1 Overall on RTEB(NVIDIA Nemotron 3 Embed、RTEB総合1位)NVIDIA の埋め込みモデル Nemotron 3 Embed が、テキスト埋め込みベンチマーク RTEB の総合ランキング1位を獲得したと発表している。NVIDIA00:00
2Newer Models, Same Advantage(新しいモデルでも同じ強みを保つ)新世代モデルでも Dharma AI の既存アプローチが同じ優位性を維持できると論じた解説を出している。Dharma AI00:00
3Security incident disclosure — July 2026(2026年7月のセキュリティインシデント開示)Hugging Face が2026年7月に発生したセキュリティインシデントの詳細と対応状況を公式に開示している。Hugging Face00:00
RECENT ISSUES 最近の号 BACK NUMBERS

すべてのバックナンバーを見る →