AIニュースまとめ 2026-07-04|アリババがClaude Code社内利用を全面禁止
アップデート情報
各社が 2026-07-04 に公式発表したプロダクトアップデートです。
Claude / Claude Code
- Claude Code v2.1.201 がリリースされ、Claude Sonnet 5 セッションでは会話途中の system ロールを使ってハーネスからのリマインダーを差し込む従来動作を停止する変更が入った。会話履歴のロール構造を Sonnet 5 向けに整える修正のみの小規模リリースで、他機能の変更はない。(Claude Code CHANGELOG)
ChatGPT / Codex
- 2026-07-04 に発表されたアップデートはありません。
Gemini
- 2026-07-04 に発表されたアップデートはありません。
Top 20
アリババが従業員のClaude Code使用を禁止、セキュリティリスクの懸念のため
Source: GIGAZINE | Published: 2026-07-04 23:35 JST
- アリババが7月10日からClaude Codeの社内利用を禁止し、独自の代替ツール「qoder」への切替を指示した。
- Redditユーザー LegitMichel777 がリバースエンジニアリングで、中国ユーザーを識別・追跡する難読化コードをv2.9.1(4月2日)以降のバイナリから発見した。
- 追跡内容はプロキシ状態、中国内ロケーション、中国URLへの接続、中国系AI研究機関への接続で、日付表記の差(「2026-06-30」vs「2026/06/30」)を用いて経路を記録していた。
- Anthropic エンジニア Thariq Shihpar は「無許可リセラーによる不正利用と蒸留対策を目的とした3月開始の実験だった」と説明し、7月1日リリースで終了させたと述べた。
- 背景にはAnthropicと Alibaba の Qwen ラボ間の蒸留攻撃をめぐる継続的な緊張関係があり、両サイドで相互の禁止措置が広がっている。
Anthropic launches its own drug discovery programs to tackle diseases Big Pharma considers unprofitable(Anthropicが大手製薬が採算外とする疾患向けの創薬プログラムを自社で立ち上げ)
Source: The Decoder | Published: 2026-07-04 17:11 JST
- Anthropic は非営利ミッションに沿って、大手製薬が採算外と見なす疾患向けの前臨床創薬プログラムを社内で立ち上げると発表した。
- UCSF の研究者が Claude Science を使い、1年間見逃していたウイルス混入を数分で特定し、100種類の稀少遺伝疾患を1時間で解析して32の計算スクリーニング候補を得た事例を紹介した。
- Novartis CEO の Vas Narasimhan は、AIによって創薬期間が12年から7〜8年に短縮でき、成功率も8%から16%へ改善しうると見通しを示した。
- 大手製薬各社は年間1500〜2000億ドルをR&Dに投じながら、過去120年間で世に出た新薬は800〜1000種にとどまっている。
- 競合として Google DeepMind の Isomorphic Labs や OpenAI の ChatGPT Health も医療分野で拡大しており、AI創薬の陣取り合戦が進む。
Open-source tool pxpipe hides text in PNGs to cut Claude Code and Fable 5 token costs up to 70%(OSSツールpxpipeが文章をPNG化してClaude CodeやFable 5のトークンコストを最大70%削減)
Source: The Decoder | Published: 2026-07-04 03:11 JST
- Steven Chong が開発したOSSツール pxpipe が、長文プロンプトをPNG画像に変換してAPI利用料を平均59〜70%削減できると発表された。
- ローカルプロキシとしてシステムプロンプト・ツール定義・古い会話ログを画像化し、直近メッセージのみテキストで送信する仕組みをとる。
- Fable 5 デモではセッションコストが $42.21 から $6.06 に下がり、Fable 5 は数学ベンチマークで画像入力時も100%精度を維持した。
- 一方で Opus モデルは画像化テキストで約7%の読み違い率を示し、ハッシュ値などの厳密文字列は圧縮で崩れるリスクがある。
- 対応モデルは Claude Fable 5 と GPT 5.6 がデフォルト、Opus 4.7/4.8 は手動有効化のみで、視覚エンコーダを使うため処理速度は低下する。
Mistral’s open-source Leanstral 1.5 aces formal math benchmarks and catches real bugs in code(Mistralのオープンソース版Leanstral 1.5が形式数学ベンチマークを制覇し実コードの脆弱性も発見)
Source: The Decoder | Published: 2026-07-04 16:12 JST
- Mistral AI が Lean 4 での形式検証向けオープンソースモデル Leanstral 1.5 を Apache 2.0 で公開した。
- miniF2F で 100% を達成し、PutnamBench では 672問中 587問を解いてクローズドソースの Aleph Prover 以外を上回った。
- 大学院・博士レベル代数タスクの FATE-H で 87%、FATE-X で 34% と、既存モデルより高い精度を示した。
- 57 のOSSリポジトリを走査した実地検証では、Rust ライブラリ varinteger のオーバーフローバグを含む5件の未知バグを新たに検出した。
- 中間学習・教師ありファインチューニング・強化学習を組み合わせた学習で、Hugging Face と Mistral公式APIから無料で利用可能となっている。
A 26,000-student study shows AI’s hidden learning cost takes two full years to surface(2万6000人規模の調査でAIによる学習損失は2年後に顕在化すると判明)
Source: The Decoder | Published: 2026-07-04 18:08 JST
- 中国中部の7〜12年生 26,000 人超を 30 か月間追跡した研究で、AI利用が学習成果に与える長期的な悪影響が明らかになった。
- 短期(半年)では宿題の得点が 18% 上昇し所要時間は 64 分から 45 分に短縮したが、書き込み禁止の試験得点は 20% 低下した。
- 2年後の入試得点は 18〜24% 低下し、社会科で 27%、STEM で 22%、英語で 17%、国語で 9% と教科別に差が出た。
- 若年層(24% 減)ほど影響が大きく、上位層(24% 減)ほど下位層(16% 減)より打撃を受けた。
- 対象AIツールは DeepSeek、Doubao、ChatGLM、Ernie Bot、Qwen で、宿題を高速・高得点で終える一方試験で崩れる生徒に「外注化」の兆候が確認された。
OpenAI cofounder envisions “almost no interface” future where nobody learns software anymore(OpenAI共同創業者がソフトウェアを覚えなくて済む「ほぼUIなし」未来を構想)
Source: The Decoder | Published: 2026-07-04 09:53 JST
- OpenAI 共同創業者 Greg Brockman が Alex Kantrowitz の取材で「ほぼUIなし、製品もない」形にソフトウェアを進化させるビジョンを語った。
- 2023 年開始の ChatGPT Plugins について「モデルが未成熟だった」と失敗を認め、当時のマーケティングと実力の乖離を振り返った。
- 目指す姿は、ChatGPT がユーザーの代わりにデジタルタスクを裏で処理する不可視のレイヤーになることだとした。
- 一方で現行の Codex 等はビジョンと矛盾しており、プロンプト設計と個別開発が依然として大量に必要な現実に言及した。
- Anthropic、OpenAI、Microsoft はいずれも企業導入支援の別会社やチームを設けており、AI 統合の現場は「オンサイト部隊」が支えている状況を紹介した。
米トランプ大統領、AI規制は「できるだけ介入少なく」 中国に対して開発競争「大幅リード」を強調
Source: ITmedia AI+ | Published: 2026-07-04 08:00 JST
- トランプ大統領が 7月2日 の CNBC インタビューで「AI規制はガードレールは必要だが、介入はできるだけ少なく」と発言した。
- 対中競争を最優先に据え「一番手がこのレースに勝つ」として、AI市場での米国のリードを強調した。
- 6月には Amazon 研究者が Claude Fable 5・Mythos 5 の脱獄脆弱性を指摘したことを受け、米政府が一時的に輸出制限を課した経緯を紹介した。
- Anthropic が安全策を強化し、脆弱性が旧モデルにも同様に影響することを検証した上で、6月30日 に輸出制限は解除された。
- 就任以降のバイデン政権の AI 大統領令撤回、2025 年 12 月の州法AI規制無効化命令などの規制緩和路線が一貫していると位置づけた。
Anthropic developer shares prompting tips for Fable 5 that focus on finding your own blind spots first(Anthropic開発者がFable 5向けに「まず自分の盲点を見つける」プロンプト技を共有)
Source: The Decoder | Published: 2026-07-04 21:37 JST
- Anthropic の Thariq Shihipar が、Fable 5 では出力品質がモデル性能より「ユーザーが自分の知識ギャップを認識できるか」に依存すると示した。
- Known Knowns、Known Unknowns、Unknown Knowns、Unknown Unknowns の4分類を提案し、特に Unknown Unknowns の抽出が鍵だと強調した。
- 実装前の「Blindspot pass」プロンプト、実装中の implementation-notes.md 追記、実装後の要約とクイズ生成という3段階を推奨した。
- プロンプトを詳細にしすぎると誤った方針にモデルを縛り、逆に曖昧すぎると凡庸な答えになると指摘し、制約と自由のバランスを求めた。
- Shihipar は Claude Code のみで Fable のローンチ動画を編集し、書き起こし精度やカラーグレーディング原則という自分の未知領域から作業を始めた事例を紹介した。
AIエージェント比較:CrewAI / Devin / OpenHands のアプローチとカバー領域の違い
Source: Qiita | Published: 2026-07-04 02:19 JST
- CrewAI・Devin・OpenHands の位置づけを「汎用チーム作りの道具」と「即戦力AIエンジニア製品」の対比で整理した。
- CrewAI はロール定義とタスク分担を柔軟に組めるフレームワークで、業務プロセスに合わせたチーム構成を作りやすい。
- Devin は初期からAIソフトウェアエンジニアを掲げ、リポジトリ操作・PR作成まで含めた完結型のワークフローが強みだと述べた。
- OpenHands は OSS ベースで自己ホストしやすく、ローカル環境で自律的なコード編集エージェントを組み立てられる特徴を示した。
- 3つを比較して、業務プロセス設計を主導したいなら CrewAI、即戦力の代替を求めるなら Devin/OpenHands という選び分けの指針を提示した。
Claude CodeのサブエージェントでDispatcherのトークン消費を減らした
Source: Zenn | Published: 2026-07-04 06:48 JST
- 上位モデルを Dispatcher に据えたマルチエージェント構成でレート制限が頻発する問題を、サブエージェント2種の追加で解消した。
- Sonnet モデルの task-yaml-author が100〜380 行のタスク指示書を書き、Dispatcher にはファイルパスと3〜5行の要約だけ返す設計にした。
- Haiku モデルの dashboard-updater は Markdown 表の更新を担当し、6引数を受けて2〜4行の結果だけ返すよう役割を絞った。
- 導入後、Dispatcher が直接ダッシュボードを編集する回数は 44 回から 0 回に減り、コンテキスト圧縮頻度は5タスクごとから15タスクごとに落ちた。
- 実装は
.claude/agents/配下の Markdown 2 ファイルのみで、大容量ファイルを安価なモデルに逃がしつつ Dispatcher の質を保った。
Fable 5を分析したら、定額のOpusでもかなり再現できた話
Source: Qiita | Published: 2026-07-04 13:23 JST
- 有料 Fable 5 と標準プランの Opus 4.8 を、1.5 年運用してきた自社 SaaS のセキュリティ監査で比較した。
- Fable 5 は指示なしで攻撃者視点の敵対的監査に踏み込み、2 製品から120件以上のバグを検出した。
- Opus 4.8 は素の状態では通常のバグ確認にとどまり、敵対的テストを自発的に行わなかった。
- audit スキルという系統立てたチェックリストを与えると、Opus は Fable と一致する21件中10件を検出し、加えて Fable が拾わなかった13件を新たに発見した。
- 著者はFable で監査手順を設計し、日次監査は Opus に、重要リリース前だけ Fable で追加チェックする使い分けを推奨している。
Fable5で深海ポートフォリオを作り、そのログをOpus 4.8に監査させた話
Source: Zenn | Published: 2026-07-04 06:24 JST
- Fable5 に Three.js で 6000m 深海を降りるインタラクティブ・ポートフォリオを 2 時間・4 指示で作らせ、Opus 4.8 にセッションログを監査させた。
- セッションは出力トークン約75万、ツール呼び出し239回、生成ファイル約30、JSONL ログは998行9.7MB に達した。
- 監査の結果、Fable5 は指示なしにスクリーンショットを撮って動作確認し、WebGL コンテキスト失敗などを再現手順付きで自ら特定していたと分かった。
- 事前に読み込ませたデザインガイドラインは、プロンプトで触れなくても仕上がりの「リズム」を保つ効果があった一方、単純な品質向上には結び付かなかった。
- 「制約を緩めれば派手になる」という仮説は否定され、視覚的インパクトは「自由に発想して」という指示側から出ていたと結論付けた。
OWASP MCP Top 10 の「動く検知ルール集」をOSSで公開した
Source: Zenn | Published: 2026-07-04 06:00 JST
- OWASP MCP Top 10 の10リスクを網羅する Sigma 形式の検知ルール10本を、依存ゼロのOSS「mcp-detection-lab」として MITライセンスで公開した。
- 15 件のサンプルテレメトリを同梱し、著者計測では10/10の攻撃イベントを誤検知ゼロで検出できたと報告した。
- CVE-2025-54136(MCPoison、ツール毒)、CVE-2025-6514(mcp-remote RCE)、CVE-2025-49596(MCP Inspector RCE) の実例に対応した。
- ルールはベンダー非依存で Splunk、Loki、eSQ 形式へ変換可能で、隔離ラボの構築手順もリポジトリに含まれる。
- 既存ツールが予防・スキャンや脆弱訓練環境に偏る中、本番MCP環境での実行時検知という空白を埋める狙いだと述べた。
AIには視覚がないからUI実装を自律化できない。だからFigmaとブラウザを比較するMCPサーバーを作った話
Source: Qiita | Published: 2026-07-04 14:05 JST
- AI が生成した UI を「見て確かめられない」問題を解くため、Figma とブラウザ描画結果を比較する design-compare MCP サーバーを公開した。
- 構造木比較モードでは Figma の要素データとブラウザ DOM を相対座標に変換し、レスポンシブ差を吸収した上で構造の一致を判定する。
- 画像比較は 16×16 に縮小して知覚ハッシュで大枠を見る perceptual と、Mapbox の pixelmatch で 1 ピクセル単位に判定する strict の 2 モードを用意した。
- Figma MCP でデザインを吐き出し、Chrome DevTools MCP でスクショを撮り、design-compare で差分を検出し、CSS を直して再テストするループを AI 単独で回せるようにした。
- 精度を出すには Figma 側のレイヤ構造を整えておく必要があり、絶対配置だらけの雑なデザインでは機械的解析が破綻すると釘を刺した。
その注入、最初から届いていませんでした ── changelog を信じないスモークテストを作った話(C3 v2.44.0)
Source: Zenn | Published: 2026-07-04 08:00 JST
- Claude Code ハーネスの PreCompact フックが未文書のまま複数回呼ばれ、
hookSpecificOutput.additionalContextによるセッション更新指示が実は届いていなかったと判明した。 - 1回の compact でチェックポイントが4個増える現象を10秒デバウンス処理で重複排除し、真のイベントだけを残す実装に修正した。
- サポート外の JSON 出力を削除し、フックの役割をチェックポイント記録に絞ってスペック違反を解消した。
claude --versionの変化を検知して隔離 worktree で回すヘッドレススモークテスト(1回 $0.062)を.dev/に追加した。- テスト過程で hook matcher の設定不備、標準出力ロギング欠落、Windows 260 文字パス上限、POSIX/Windows のパス表記差といったバグを掘り出したと報告した。
AIに障害対応させたら、ありもしないハッキングを”自分で”でっち上げて錯乱した話
Source: Zenn | Published: 2026-07-04 08:42 JST
- 監視アラートを AI エージェントに調査させたところ、当初は誤検知と正しく判定したのに、報告書段階で「プロンプトインジェクション汚染」を捏造し始めた。
- ログを追跡すると、汚染の「証拠」はエージェントの発言中にしか存在せず、実際のツール実行結果には該当出力が一切無かった。
- 根拠の乏しい発言が次の推論の前提として再利用されることで、誤情報が自己増幅する自己強化ループに陥っていた。
- 対策として、AIの自己申告を鵜呑みにせず外部ログや生データを直接参照すること、長時間セッションを区切ることを推奨した。
- 「AI エージェントで最も怖いバグは落ちることではなく、誤った現実を自信満々に報告することだ」と結論付けた。
Claude Code の権限を settings.json で設計する──allow/deny と4つのモード
Source: Zenn | Published: 2026-07-04 04:00 JST
- Claude Code の権限を「階層」「ルール」「モード」の3軸で
settings.jsonから設計する方法をまとめた。 - 階層は Managed → CLI 引数 →
.claude/settings.local.json→.claude/settings.json→~/.claude/settings.jsonの優先順で解決される。 "allow": ["Bash(npm run lint)", ...]のように許可リストを絞り、deny ルールが最上位優先で.envやsecrets/を保護する原則を示した。- 4モードは default(都度確認)、acceptEdits(編集自動許可)、plan(読み取り専用)、bypassPermissions(全チェック無視)で、bypass は使い捨て環境限定と釘を刺した。
- Bash ルールはシェルエスケープで抜けられる余地があるため、
/permissions表示と公式ドキュメントで最終挙動を必ず確認するよう促した。
Claude Max でセッション上限に当たったら、それは「使い方」を見直すサイン
Source: Zenn | Published: 2026-07-04 08:00 JST
- Claude Max の5時間セッション上限に頻繁に達するのはサービス側の問題ではなく、使い方の見直しサインだと分析した。
- 原因は「effortLevel: high のグローバル設定」「サブエージェントの多用」「8時間超・150k トークン超のセッション継続」の三重複合効果だった。
- effortLevel を high から medium に落とすだけで消費量が大きく下がり、まず最優先で試すべき対応と位置づけた。
- サブエージェントは Opus 一律ではなく Sonnet や Haiku に落とし、価値がコストを明確に上回るときだけ起動する運用を推奨した。
- タスクごとにセッションを切り、
/compactでコンテキストを圧縮し、8 時間超セッションを継続しないという運用ルールを提示した。
MCPで繋がるサービスとは? AIと連携できる定番サービス・カタログ
Source: Zenn | Published: 2026-07-04 05:00 JST
- Anthropic が定めた Model Context Protocol(MCP) を、非エンジニア向けに「AI が外部サービスに繋がる標準仕様」として解説した。
- Gmail や Slack と MCP で繋げば、下書き作成やメッセージ一覧取得、自動投稿までを AI に任せられると具体化した。
- Google カレンダー、Google ドライブ、Notion で予定読み取りやファイル整理を任せる使い方をまとめた。
- freee、GitHub、Figma を通じた会計・コード・デザインの業務自動化パターンを紹介した。
- 「読み取りと提案は AI に、実行は人間が確認する」を原則に、最小権限でつなぐ運用ルールを強調した。
乃木坂46の全ブログ4,726件をRAGで知識化して、メンバー関係図を自動生成した
Source: Zenn | Published: 2026-07-04 07:00 JST
- 乃木坂46 のブログ 4,726 件とニュース約1万件を、44,678 件の構造化ナレッジと 5,175 本の関係リンクに変換した RAG 基盤を構築した。
- サーバー費はVercel・Supabase・GitHub Actions の無料枠で 0 円、初回一括処理の LLM 費用は Batch API 割引で約100ドルにとどまった。
- パイプラインはクロール(4秒間隔・robots.txt遵守)→ LLM構造化 →text-embedding-3-small でベクトル化 → 関係マッピング → 日次自動更新の5段構成となる。
- LLM の推測は保存せず、実際の共起記述のみに基づく関係グラフを組んで一次情報 URL を必ず紐付ける設計にした。
- Claude Code に実装を任せ、著者は倫理境界・機能スコープ・コスト制約を仕様書に落とすことに集中する分業モデルで運用している。
All Articles
Zenn
| # | Title | Summary | Author | Published |
|---|---|---|---|---|
| 1 | なぜ prompt-master はAIの出力を安定させやすいのか | プロンプトを9要素に分解して曖昧さを削るツール prompt-master が、少数検証でルーブリック 6/6・実行時間 16 秒と精度を高めたと報告した。 | 53able | 2026-07-04 09:00 JST |
| 2 | MCPで繋がるサービスとは? AIと連携できる定番サービス・カタログ | Gmail・Slack・Google カレンダー・freee など MCP で AI に繋がる定番サービスと最小権限運用の原則を非エンジニア向けに解説した。 | シュンク堂 | 2026-07-04 05:00 JST |
| 3 | 1週間限定のClaude Fable 5で何をすべきか - 7月7日まで | 期間限定で開放された Fable 5 を7月7日までにどう活かすか、重い設計判断や監査系タスクから優先すべきという運用指針を示した。 | ゆんぼう | 2026-07-04 08:00 JST |
| 4 | Claude Fable 5 は Pro プランで使える? | Pro プランで Fable 5 が利用可能かを検証し、モデル切替 UI とレスポンス例を示して現時点の可用性を整理した。 | テックエンジニアのひとりごと | 2026-07-04 08:00 JST |
| 5 | Claude CodeのサブエージェントでDispatcherのトークン消費を減らした | Sonnet 版 task-yaml-author と Haiku 版 dashboard-updater を追加し、Dispatcher の直接編集を 44 回から 0 回まで削減した事例を報告した。 | h-wata | 2026-07-04 06:48 JST |
| 6 | 仕様書からClaude Codeで動くアプリを作るまで | Flutter の気分ログアプリを詳細仕様書ドリブンで Claude Code に実装させ、API キー管理が最大の工数になったと振り返った。 | ユウ | 2026-07-04 08:00 JST |
| 7 | LINE風チャット動画メーカーをHTML1枚で作った話 | HTML 1枚で完結する LINE 風チャット動画メーカーを AI 支援で作った過程と、依存を持たない配布のしやすさを紹介した。 | ぽぽみ|Popopon開発 | 2026-07-04 08:00 JST |
| 8 | Copilotの指摘に5往復従わせたらAIのスコープが逸脱した話 | Copilot のレビュー指摘に5往復従わせた結果、当初スコープを超える変更が積み上がり revert に追い込まれた失敗事例を共有した。 | fixU | 2026-07-04 08:00 JST |
| 9 | Claude Max でセッション上限に当たったら、それは「使い方」を見直すサイン | effortLevel: high、サブエージェント多用、長時間セッションの三重複合が上限を招くと分析し、対策順を示した。 | Yuhta Ihara | 2026-07-04 08:00 JST |
| 10 | Claude Code の権限を settings.json で設計する | 階層・allow/deny ルール・4モードで権限を設計する指針を整理し、deny 最優先と bypassPermissions の使い所を明確にした。 | エンジニア翔|Claude Code | 2026-07-04 04:00 JST |
| 11 | その注入、最初から届いていませんでした(C3 v2.44.0) | PreCompact フックの複数回呼び出しと未サポート additionalContext を発見し、$0.062/回のスモークテストで検証する仕組みを作った。 | satoh-y-0323 | 2026-07-04 08:00 JST |
| 12 | AIに障害対応させたら、ありもしないハッキングを”自分で”でっち上げて錯乱した話 | AI が実行していないコマンドの出力を捏造して自己強化ループに陥る事例を分析し、外部ログでの検証を推奨した。 | jun-uen0 | 2026-07-04 08:42 JST |
| 13 | AIでやるべき業務とルール処理で足りる業務の見分け方 | AI に任せる業務とルールベースで済ませる業務を分ける判断基準を、業務プロセス設計者の視点から整理した。 | syunpp | 2026-07-04 08:00 JST |
| 14 | AIモデルファイルは本当に「安全」か | modelscan と picklescan を実機比較し、未登録モジュール・.npz 形式など攻撃手法ごとに検出可否をまとめて5層防御を提案した。 | kta1kri | 2026-07-04 08:00 JST |
| 15 | Claude Code Skill の設計と実装 | Claude Code Skill の設計指針と実装ステップをまとめ、/コマンドで再利用可能なワークフローを構築する方法を示した。 | こびと社 | 2026-07-04 08:00 JST |
| 16 | herdrにntfyをつなぐ! | Herdrに ntfy 通知プラグインを組み込み、AI ワークフローの完了通知をスマホに飛ばす小規模実装を紹介した。 | こっこさん | 2026-07-04 08:00 JST |
| 17 | OWASP MCP Top 10 の「動く検知ルール集」をOSSで公開した | 依存ゼロ・MIT で公開した mcp-detection-lab が Sigma 10 ルールで OWASP MCP Top 10 の10攻撃を誤検知ゼロで捕捉した検証結果を共有した。 | kta1kri | 2026-07-04 06:00 JST |
| 18 | CVEから「未来の防御設計」を読む | CVE の修正から6つの共通防御設計方針を抽出し、単層ではなく層化された防御が今後の指針になると論じた。 | logolith_andu | 2026-07-04 08:00 JST |
| 19 | Fable5で深海ポートフォリオを作り、そのログをOpus 4.8に監査させた話 | Fable5 が生成した Three.js 深海ポートフォリオのセッションログ 998 行を Opus 4.8 に監査させ3仮説を検証した。 | まえくん | 2026-07-04 06:24 JST |
| 20 | 無料で試せる — Staddress AIで住所解析の精度を確認する | Staddress AI の住所解析 API を無料枠で試し、日本語住所の分割精度と揺らぎ耐性を実データで検証した。 | ストアドレス | 2026-07-04 08:00 JST |
| 21 | 話者分離で本当に効くのは「モデルの精度」ではなく「ASRの発話粒度」だった | 話者分離の精度は話者識別モデルよりも ASR の発話粒度で決まると実験結果から結論付けた。 | Tsukihi | 2026-07-04 08:00 JST |
| 22 | MulmoClaude のリモートアクセス機能 | MulmoClaude v0.9.3+ でスマホから同一 Google アカウントのコレクションを 390×844 プレビュー付きで操作できるようになった。 | Yasutaka Nishii | 2026-07-04 08:00 JST |
| 23 | ブログ公開前にサブエージェント2体を通す | 公開可否レビューとファクトチェックの2エージェントを分担させ、ローカル権限のみと Web 権限ありで役割を分けた設計を紹介した。 | みやっち | 2026-07-04 08:00 JST |
| 24 | エージェントを訓練せず強くする、Qwen-AgentWorldという世界モデル | Alibaba の Qwen-AgentWorld が環境応答を予測する言語世界モデルとして AgentWorldBench で GPT-5.4 を上回った事例を解説した。 | とうもろこし茶 | 2026-07-04 08:00 JST |
| 25 | Codexが年640TBをSSDに書いていた | Codex の SQLite ログが年 640TB を SSD に書いていた原因を TRACE 全記録に特定し、公式 PR で 85% 削減された経緯を追った。 | とうもろこし茶 | 2026-07-04 08:00 JST |
| 26 | 【Logseq使い方】超・学習本 | Logseq を学習ワークフローに組み込むためのハンドブックとして、ノート構造とタグ運用の設計指針をまとめた無料本を公開した。 | 鷹司龍 | 2026-07-04 08:00 JST |
| 27 | 課題が明確になった後——解決策を探索するフェーズの手法整理 | 課題定義後の解決策探索フェーズで使える手法を、既存研究を横断して整理してまとめた。 | Little_chama | 2026-07-04 08:21 JST |
| 28 | 「ふんわり要求 → 明確な課題」を作るとはどういうことか | 曖昧な要求から明確な課題を導く clarify_to_mvp の動機と先行研究を整理し、MVP 化への流れを提示した。 | Little_chama | 2026-07-04 08:21 JST |
| 29 | AISIのtest-time computeを使う:AIエージェント評価を3予算で作る | AISI 研究に基づき、1M/5M/10M トークンの3予算でエージェント能力を曲線として測る評価設計を提案した。 | 中村 啓|LLMエンジニア | 2026-07-04 04:15 JST |
| 30 | AWS BedrockをCLIで試す入門 | AWS Bedrock を CLI で試す最初の一歩として、覚えるべきコマンドと最小構成の実行例をまとめて解説した。 | よこ | 2026-07-04 03:38 JST |
| 31 | Claude Codeの挙動が変わった時、原因をどう切り分けるか | Claude Code の挙動変化を切り分けるためのデバッグ手順を、モデル・設定・環境の観点から段階的に整理した。 | ShintaroAmaike | 2026-07-04 03:23 JST |
| 32 | 【全文無料】生成AI「15分野の全地図」を一冊の本にしました | 生成 AI を 15 分野で俯瞰する全文無料本を公開し、ツール比較と選び方の意思決定フレームを提供した。 | 岸本悠佑_AIサムライ | 2026-07-04 01:29 JST |
| 33 | AIサムライの生成AIツール大全 | クラウドモデル、ローカル LLM、コーディングエージェント、画像・動画・音楽生成など 15 分野を横断する Zenn 無料本を公開した。 | 岸本悠佑_AIサムライ | 2026-07-04 01:27 JST |
| 34 | 「30年分の勘」をデータにする前に | 熟練職人の暗黙知をデータ化する前段階として、辞める前に本音の裏道まで話してもらう関係構築こそが最重要だと論じた。 | Hiroshift≈ | 2026-07-04 01:11 JST |
| 35 | Ollama と LM Studio で「機密は手元」を実現する | Ollama と LM Studio でローカル LLM を動かし、ネットワーク切断で真のオフライン動作を検証する手順をまとめた。 | プロマネ武蔵 | 2026-07-04 00:13 JST |
| 36 | AI運用ログを週次レビューでFAQ・CRM・承認ルールへ戻す | AI 運用ログを週次レビューし、FAQ・CRM・承認ルールに反映するフィードバックループの設計を提案した。 | Kirisaki Kazuya | 2026-07-04 00:19 JST |
| 37 | AI面接練習を「作る側」から見た”どう話したか”の評価 | AI 面接練習アプリで表情・感情・緊張度をタイムラインに可視化する実装と評価設計を、開発者視点で解説した。 | deepai | 2026-07-04 02:08 JST |
| 38 | 乃木坂46の全ブログ4,726件をRAGで知識化して、メンバー関係図を自動生成した | ブログ 4,726 件を 44,678 件のナレッジ+5,175 リンクへ変換し、無料枠で運用する RAG ファンサイトを構築した。 | panpanpanda7 | 2026-07-04 07:00 JST |
| 39 | ローカルで機密性高くRAGじゃないセマンティック検索 | RAG 生成に頼らず、ローカル埋め込みだけで機密文書のセマンティック検索を実装する手順と精度検証を紹介した。 | Tak Okada | 2026-07-04 08:00 JST |
Qiita
| # | Title | Summary | Author | Published |
|---|---|---|---|---|
| 1 | マーガレット・アトウッドが語ったAIの「ゴミを入れればゴミが出る」:Claudeの誤答から考える生成AIの確かめ方 | アトウッドが語った AI の「ゴミを入れればゴミが出る」を軸に、Claude の誤答例から生成 AI の検証方法を考察した。 | quotidia | 2026-07-04 07:46 JST |
| 2 | Midnight AI Groove 26-06-29 | AI 業界の直近ニュースを対談形式で振り返るナイトタイム番組の書き起こしで、業界動向を横断的に要約した。 | masykot582 | 2026-07-04 01:59 JST |
| 3 | 「プロンプトが書けない」の別解:参照画像3枚で画像生成を制御する仕組みと限界 | プロンプトが書けない場合に参照画像 3 枚で画像生成を制御する仕組みを解説し、精度と限界を実例で示した。 | tingpromax | 2026-07-04 22:43 JST |
| 4 | Codexを”生成AI”で終わらせない。Gitと組み合わせたら開発フローにちゃんと組み込めた話 | Codex を Git ワークフローに統合し、コード生成を単発ではなく開発フローの正式な工程として扱う運用を報告した。 | kitasyunpp | 2026-07-04 22:12 JST |
| 5 | LangChain で RAG を組むなら知っておきたい Pydantic の要素 | LangChain で RAG を組む際に押さえる Pydantic の BaseModel、カスタム Retriever、Reranker、構造化出力スキーマの要点を整理した。 | atsushi11o7 | 2026-07-04 16:11 JST |
| 6 | 自己修正型検索と状態管理:LangGraph×LlamaIndexによるエージェントRAG構築 | LangGraph と LlamaIndex を組み合わせ、自己修正型検索と状態管理を持つエージェント RAG を構築する設計を解説した。 | jjking | 2026-07-04 09:41 JST |
| 7 | Oracle 26ai の in-DB 埋め込み(VECTOR_EMBEDDING)で Agentic RAG を DB 内で完結させてみた | Oracle 26ai の VECTOR_EMBEDDING、Google ADK、Gemini を使い、Agentic RAG を DB 内で完結させる構成を試した。 | asahide | 2026-07-04 09:20 JST |
| 8 | Claude Codeを暴走させず、実務の仕組みにするまでの全体地図 | 「止める→整える→任せる→仕組みにする」の4フェーズ・9ステップで、36 記事に紐付いた Claude Code 導入ロードマップを示した。 | 4q_sano | 2026-07-04 15:07 JST |
| 9 | AIには視覚がないからUI実装を自律化できない。だからFigmaとブラウザを比較するMCPサーバーを作った話 | Figma と Chrome DevTools MCP を比較する design-compare MCP サーバーを作り、AI 単独で UI 差分検出と CSS 修正を回すループを実現した。 | prg_mt | 2026-07-04 14:05 JST |
| 10 | Gemini Live API(Bidi WebSocket)でリアルタイム音声アバターを作って分かったこと | Gemini Live API と Function Calling でアバターの「うなずき」を制御し、6 職業でシステム指示のみを差し替えて応答品質を検証した。 | kei_kawai_g | 2026-07-04 15:30 JST |
| 11 | GASでAIプロンプトの実行ログをSheetsに残す | GAS で AI プロンプトの実行ログを Google Sheets に残し、校務下書きを後から検証しやすくする最小構成を示した。 | SciCos | 2026-07-04 12:01 JST |
| 12 | Google AI StudioでCloud SQLを使ったWebアプリケーションを開発する | Google AI Studio と Cloud SQL を組み合わせて Web アプリを構築する手順を、認証と接続まわり中心に解説した。 | satoshi-sugiyama | 2026-07-04 11:51 JST |
| 13 | Claude Codeを使い倒した実運用ノウハウを電子書籍にまとめました(全10章) | Claude Code 実運用ノウハウを 10 章・約 3 万字にまとめた電子書籍を Gumroad で 500 円で公開したと発表した。 | 1280itsuya | 2026-07-04 23:42 JST |
| 14 | Fable 5を分析したら、定額のOpusでもかなり再現できた話 | Fable 5 の敵対的監査手順を Opus 4.8 の audit スキルに落とし、21 件中 10 件を再現しつつ 13 件の追加バグを発見した。 | udowanllc | 2026-07-04 13:23 JST |
| 15 | Make.comがMCP対応。「AIに話すだけで自動化が動く」は業務でどこまで使えるか | Make.com の MCP 対応を検証し、AI に話すだけで自動化を動かすユースケースの実務適用範囲を評価した。 | mamagotolab | 2026-07-04 07:23 JST |
| 16 | AIエージェント比較:CrewAI / Devin / OpenHands のアプローチとカバー領域の違い | CrewAI・Devin・OpenHands を「汎用チーム作りの道具」と「即戦力 AI エンジニア製品」の観点で比較し、用途別の使い分けを提案した。 | papa_story2010 | 2026-07-04 02:19 JST |
ITmedia AI+
| # | Title | Summary | Author | Published |
|---|---|---|---|---|
| 1 | 米トランプ大統領、AI規制は「できるだけ介入少なく」 中国に対して開発競争「大幅リード」を強調 | トランプ大統領が7月2日の CNBC 取材で AI 規制の最小介入方針を強調し、6 月末に解除された Fable 5・Mythos 5 輸出制限の経緯にも触れた。 | ITmedia | 2026-07-04 08:00 JST |
| 2 | フィジカルAIに挑む日の丸連合、「Noetra」とは何か | 週次テックニュース連載で、フィジカル AI 領域に挑む国内連合 Noetra の狙いと役割分担を紹介した。 | ITmedia | 2026-07-04 07:00 JST |
GIGAZINE
| # | Title | Summary | Author | Published |
|---|---|---|---|---|
| 1 | アリババが従業員のClaude Code使用を禁止、セキュリティリスクの懸念のため | アリババが7月10日から Claude Code の社内利用を禁止し、v2.9.1 以降に埋め込まれた中国ユーザー追跡コードを Reddit ユーザーが発見した経緯を報じた。 | GIGAZINE | 2026-07-04 23:35 JST |