2026年5月から7月末にかけて、OpenAIとAnthropicは30を超えるユーザー向け製品と機能をリリースした:新しい音声モード、健康記録の統合、パーソナルファイナンス、デスクトップの再設計、メモリシステムの書き換え、エンタープライズエージェント製品、そしてそれぞれ2つの最先端モデルファミリー。
それらのほとんどは発表、デモ、報道の集中報道とともに登場したが、その後すぐに公の会話から消えた。
私は企業が発表したことと、ユーザーが語り合う価値を見出したことのギャップを理解したかった。報道が取り上げたことではない。報道はほぼすべてをカバーする。私は代わりにHacker News、RedditのAIコミュニティ、X上の公開会話を見て、意図的にシンプルな質問でローンチをランク付けした:
人々はそれについて議論するほど関心を持ったか?
その質問は過去3ヶ月を再編する。
一文バージョン
ユーザーは従来の製品機能についてほとんど語らなかった。モデル、価格、アウテージ、プライバシー、そして誰がアクセスを制御するかという話だった。
このデータセットの最上位の議論はすべて、モデルリリース、ガバナンス争い、あるいは何かが壊れたことに関係していた。わずかな例外は示唆的である:それらは特定のインフラ問題を解決するか、ユーザーが互いに作成・共有できるものを提供した。
数字についての注記
これは公衆の注目の研究であって、採用、定着、収益、または製品価値の研究ではない。静かな機能が大量に使われることもあるし、大きな論争が比較的小さな人口に関わることもある。
私は2026年5月1日から7月28日の間にHacker News、主要なAI関連サブレディット、Xに投稿された英語の議論をレビューした。以下の数字は各プラットフォームからの生のエンゲージメント数であって、複合スコアではない。HNポイント、Redditアップボート、Xいいね、コメントは等価な単位ではない。キーワード検索は予期しない名前を使った会話を見逃す可能性もある。
このカットオフは特に7月後半のローンチに不利で、注目を集める時間がわずかしかなかった。ランキングは可視的な会話の地図として扱うべきであって、何が成功したかの決定的な測定ではない。
Tier 1: 会話を支配したストーリー
1. Fable 5 / Mythos 5の輸出規制サガ
Anthropicは6月9日にClaude Fable 5をリリースした。これはMythosクラスのモデルとして初めて一般公開されたものだった。3日後、米国商務省はAnthropicに対しFable 5とMythos 5の両方へのアクセスを停止するよう指示する指令を出した。規制は6月30日に解除された。
これは主に製品の話ではなかった。主権の話であり、ほぼすべての他の話題を圧倒した:
| Hacker Newsスレッド | ポイント | コメント |
|---|---|---|
| 米国政府のアクセス停止指令に関する声明 | 3,158 | 2,314 |
| Claude Fable 5のローンチ | 2,626 | 2,160 |
| 商務省が輸出規制を解除 | 977 | 692 |
| 「コードを修正しろ」でFedsがFable 5にパニック | 613 | 361 |
| Fable 5が復活 | 408 | 419 |
Redditも同様に注目した。「Fable 5が戻ってくる!」は5,338のアップボートと506のコメントを獲得し、「アクセスが延長された!」は5,273と777、「FableがMaxに残る」は3,279と724だった。
このエピソードが爆発したのはモデルの能力だけではなかった。政府が商業サービスに手を伸ばし、人々がすでに依存していたモデルをオフにしたからだった。
議論はすぐにベンチマークを超えて武器管理法に及んだ。広く支持されたコメントの一つは、この指令が武器輸出管理法の下にあり、モデル重みをITARの下での技術データとして扱う可能性があると指摘した。別のコメントは、規制がAnthropic自身の外国人従業員がMythosに内部アクセスすることを防いだとされ、それは商業的に耐えがたい制約だろうと指摘した。
かなりの派閥がAnthropic自身の政治戦略を非難した:
「AnthropicがMythosについて恐怖を煽らなければ、米国政府がこの輸出規制を課しただろうか?答えはおそらくノーだと思う。[…] これはAnthropicの政治工作の失敗だ」
数十のスレッドを通じて、耐久性のある結論は同じだった:あなたが制御できないアクセスは条件付きのアクセスだ。あるコメント者が簡潔に述べた:
「オープウェイト+決定論的オーケストレーションが、唯一理性的な長期的な賭けのように感じる」
6月の多く、この議論はほぼ他のすべてを圧倒した。
2. GPT-5.6 Sol—そして誰がそれを使えるか
OpenAIは6月26日にGPT-5.6 Solをプレビューし、7月9日にリリースした。これは同社の四半期で圧倒的に最大のストーリーだった:5つの主要スレッドで約5,000のHacker Newsポイント、Xの最大の発表投稿は6,212のいいねと976,000のビューを獲得した。
しかし、注目の分布が重要である:
| Hacker Newsスレッド | ポイント | コメント |
|---|---|---|
| GPT-5.6ローンチ | 1,561 | 1,113 |
| 米国政府がGPT-5.6を使える人を決める | 1,184 | 1,240 |
| GPT-5.6 Solのプレビュー | 1,139 | 744 |
| GPT-5.6が凸最適化の30年ギャップを埋めるプロンプトを使った | 600 | 391 |
| GPT-5.6 Sol UltraがCycle Double Cover Conjectureの証明を生成 | 538 | 443 |
アクセス制御スレッドはローンチ自体よりも多くのコメントを集めた。これはFable 5エピソードと同じ不安を、異なるベンダーについて表現していた:人々はモデルができることだけでなく、第三者が後で条件を変えることなくそれに基づいて構築できるかどうかを評価していた。
Solの会話のもう一つの主要な枝は能力の実質性だった。ユーザーはベンチマークの差分ではなく、主張された数学的進歩と検証された結果について議論した。しかし、実務家の不満も同様に具体的で、特に安全性の拒否が有料セッションを消費したときだった:
「GPT-5.6 Solは脆弱性を見つけるが、それを説明することを拒否する。その場合、セッション料金を返金するのが良い習慣だと思う。そうでなければ、顧客はお金を使って何も得られない」
モデルは能力を通じて注目を集めた。それを取り巻くサービスは制御と価格を通じて精査された。
3. Claude Opus 5—そして即座の分裂
7月24日にリリースされたOpus 5は、データセットで最大の単一エンゲージメント数を生み出した。AnthropicのX発表は61,266のいいねと2,300万のビューに達した。Hacker Newsのローンチスレッドは1,777ポイントと1,329コメントを獲得し、Redditは2,916のアップボートと672のコメントを獲得した。
しかし72時間以内に、ムードは分裂した:
- 「Claude Opus 5はウェブデザインがバカみたいに上手い」—643いいね
- 「Opus 5についてどう感じている?」—2,453いいね
- 「Opus 5は思ったほど好きじゃない :(」—2,428いいね
- Opus 5のエラー上昇についての3つの別々のHacker Newsスレッドが4日間でフロントページに到達
繰り返される技術的な不満は生の能力よりもデフォルト設定に関するものだった:
「2日前までCLAUDE.mdも何もなしでOpus 4.6を使っていて素晴らしかった。Opus 5を試してみたら、箱から出してすぐに超イライラする体験だった」
「Opus 5で1週間—フロンティアで最高の価値だが、3つのデフォルト設定が良くない」というタイトルのReddit投稿が新興のコンセンサスを捉えた。ユーザーはしばしばモデルを気に入り、それが到着した設定を嫌った。
この区別は重要である。なぜならそれは修正可能な製品の問題を記述するからだ。ベンチマークは能力を明らかにできる。フォーラムの苦情はその能力とデフォルトの提示の間の摩擦を明らかにする。
一部のヘビーユーザーは依然として困難な作業に古くてより高価なFable 5を好んだ:
「Fableは私がAIで使った中で最も鋭利で最も効果的な道具だと信じている」
4. Claude Opus 4.8
5月28日にリリースされたOpus 4.8は1,774のHacker Newsポイントと1,376のコメントを生成した。その中心的な売り込み—4.7より約4倍コードの欠陥を見逃しにくい—は、そのオーディエンスがすでに議論していた問題に対処していた。
それは大きなスレッドを生み出し、きれいに着地し、異例なほど論争がなかった。このデータセットでは、それは褒め言葉である。
Tier 2: 実在するが二次的
Claude Codeが政治的対象になった
Claude Codeは5,559のHacker Newsコメントに登場したが、その最も著名なスレッドは新しい機能についてではなかった:
| Hacker Newsスレッド | ポイント | コメント |
|---|---|---|
| Claude Codeがステガノグラフィでリクエストをマークしている | 2,445 | 750 |
| Claude CodeがRustで書かれたBunを使うようになった | 608 | 849 |
| Claude Codeはプロンプトを読む前に33kトークンを送信する;OpenCodeは7k | 706 | 396 |
| MicrosoftがClaude Codeライセンスのキャンセルを開始 | 493 | 466 |
| Claude Codeを使ってMRIのセカンドオピニオンを得た | 566 | 715 |
信頼性、トークン効率、調達、適応外の医療使用が支配した。期間中の実際の機能リリース—動的ワークフロー、ネストされたサブエージェント、バックグラウンドコードレビュー—は独立してほとんど登録されなかった。
Claudeサブエージェントは237のコメントを引きつけ、最もパフォーマンスの高いサブエージェントスレッド自体が苦情だった:「Claude CodeにはOpus 5にサブエージェントを使わせないハードコードされた指示がある」
開発者ツール企業への教訓はシンプルだ:十分な規模では、変更履歴がストーリーではなくなる。製品の動作がストーリーになる。
使用制限:誰も出荷しなかったが誰もが議論した機能
使用制限の議論は223のHacker Newsコメントを生み、一方Redditの「Dear Anthropic, This Has to STOP.」は2,673のアップボートと555のコメントを獲得した。
価格とレート制限は、音声、健康、メモリ、パーソナルファイナンス、デスクトップ再設計を合わせたものよりも持続的で感情的に激しい議論を生み出した。
「私はコーディングタスクのために月200ドルを支払う立場にない[…]。Kimi 2.6は私の経験ではSonnetとほぼ同じだった」
「それが『深刻なことには使わない、なぜなら常に制限にぶつかるから』と『…』の違いだ」
すべての制限スレッドは解約スレッドでもあった。それらは要請されていない退会インタビューのように読め、同じ代替案を繰り返し挙げた:Kimi、DeepSeek V4、GLM、ローカルモデル。
これはどちらの企業を取り巻く会話の中で最も商業的に危険なものかもしれない。これは機能の問題ではない。価格と信頼性が能力が習慣になるかどうかを決定するポイントである。
セキュリティとプライバシーのインシデントがRedditでローンチを上回った
データセットで最大の実質的なReddit投稿はローンチではなかった。「共有会話の多くをGoogleで閲覧できる」は8,066のアップボートと1,340のコメントを獲得し、同じ見かけの露出に関する companion投稿は4,221のアップボートを獲得した。
合わせて、これらの投稿はOpus 5、Sonnet 5、Claude Skillsを合わせたものよりも多くのエンゲージメントを集めた。
インシデントは発表よりも遠くまで伝わる。なぜなら抽象的なリスクを個人的なものに変えるからだ。機能はユーザーに価値を想像させる。プライバシーの失敗は自分を被害者として想像させる。
Claude Sonnet 5
6月30日にリリースされたSonnet 5は1,266のHacker Newsポイント、784のコメント、2,760のRedditアップボートを獲得した。100万トークンのコンテキストウィンドウは、コンテキストの重いシステムを構築する実務家にとって重要だった。
また、期間中の最も残酷な一行の見出し「Sonnet 5 Is Dead in the Water」も獲得した。これは少なくとも部分的に、そのローンチをめぐるFable 5の政治的ドラマによって生み出された extraordinaryな飽和を反映しているように思われる。
例外その1:MCPのステートレストランスポート
7月28日のMCP改訂はわずか118のHacker Newsポイントと37のコメントを引きつけた。生のボリュームではニッチだったが、レスポンスはすでに問題に遭遇していた実務家から来ており、異例なほど一貫していた:
「私は数ヶ月前にMCPからHTTP/Statelessに移行した。それが正しいことだと思う。信頼性が上がり、問題が減った」
「URL Elicitationは人間がクライアントを操作している場合はうまく機能する。残念ながらMCPクライアントのサポートは不十分だが、プロトコルがステートレスになった今、変わることを期待する」
これは一般的なパターンに対する最初の例外である。従来の機能が控えめな注目を集めたが、特定可能なインフラ問題を解決したため高品質な議論を生んだ。
意味のある反論もあった。一部の開発者はプロトコルが依然として不要だと主張した:
「curlコマンドを内部に含むSKILL.md + リンクされた.mdファイルでより良い結果が得られる…ただのHTTP(S)だ」
低いボリュームが必ずしも低い重要性を意味するわけではない。インフラでは、すでに移行した人々からの数十のコメントが、ローンチ日の数千の反応よりも有益な場合がある。
例外その2:Claude Skillsが自ら広がった
Hacker Newsでは、「Claude skill」はほぼ四捨五入誤差だった:34コメント。しかしRedditでは、Skillsはデータセットの中で最も強いオーガニックシグナルの一つを生み出し、エネルギーはAnthropicではなくユーザーから来た:
- 「手書きの写真をインストール可能なフォントに変換するClaude Code skillを作った」—3,437アップボート
- 「新機能:Claudeにskillを教える」—2,712アップボート
- 「ADHD skillを作った人に神のご加護を」—2,621アップボートと405コメント
最後の例が鍵である。それはローンチへの拍手ではない。一人のユーザーが自分の日常を変えた何かについて別のユーザーに感謝している。
より小さなHacker News議論も、非技術的なチームへの genuineな拡散を記述した:
「それが、私のあまり技術的でない同僚たちのAIの使い方についての考え方のほとんどだと思う。『それにClaude skillはある?』という質問を週に何度も聞く」
「MCPを考えたが、Claude skillとして持つ方がはるかにシンプルだ(プラグインとしてインストールでき、.mdファイルのみに依存し、常にサーバーを実行する必要もない)」
Skillsはユーザー作成で、理解しやすく、共有可能だから広がった。このデータセットのほとんどの機能は企業がユーザーのために—またはユーザーに—行うことだ。Skillsはユーザーが互いのために行うことだ。それが議論に異なる性格を与える:反応的ではなくオーガニックだ。
尊重すべき反シグナルがある。一部のパワーユーザーはSkillsが新しいモデルでパフォーマンスを低下させると報告した:「skillsが劣化を引き起こし始めたのを見た」;「『superpowers』のようなskillsを削除するとトークン消費が減る」
Skillsには肥大化の問題がある。しかし肥大化はしばしば、人々がその上で構築し始めた後に成功したプラットフォームが獲得する問題である。
Tier 0: ほぼ沈黙の中に送り出された
以下の製品は同じ期間に人員配置、構築、発表された。この分析で使用されたソースと検索の範囲内では、それらの可視的な公衆の反応は最小限だった:
| 機能 | 出荷日 | 見つかった議論 |
|---|---|---|
| ChatGPT Voice in Chat, Work, and Codex | 7月23日 | 無関係な音声スレッドと区別できない専用議論なし |
| ChatGPTの新しいデスクトップアプリ、Chat、Work、Codexの統合 | 7月16日 | 2ポイント、1コメント |
| ChatGPTのHealth、Apple Healthと医療記録を含む | 7月23日 | 32ポイント/54コメント、さらに8/7 |
| OpenAI Presence、エンタープライズ向け音声・チャットエージェント | 7月22日 | 1スレッドで64ポイント、51コメント |
| ChatGPTメモリの再構築 | 6月4日 | バックグラウンドノイズを超える専用スレッドなし |
| Codex Remoteの一般提供 | 5月/6月 | 2ストーリー、合計3ポイント |
| ChatGPTパーソナルファイナンス / Plaid | 5月15日 | 7ポイント、1コメント |
| グループチャットの廃止 | 7月9日 | 2ポイント、0コメント |
| GPT-5.2 / GPT-4.5の廃止 | 6月12日 / 26日 | 合計9ポイント |
| Claude音声モードの拡張 | 7月23日 | バックグラウンドノイズと区別できないシグナルなし |
沈黙はこれらの製品が使われなかったことを確立するものではない。それはそれらが調査対象のコミュニティ内でストーリーにならなかったことを示している。
音声は高価な沈黙
両社は7月下旬に1日以内に substantialな音声作業を出荷した。どちらもこのデータセットで意味のある議論を生まなかった。
音声は美しくデモされる。しかし、ソフトウェアについて公に議論する人々の間では、 comparableな使用文化、議論、またはユーザー作成のアーティファクトをまだ生み出していない。そのギャップ—デモの魅力と可視的な実務家の熱意の間—は実際の使用データで調査する価値がある。
Healthは注目に値し、疑念を受けた
医療記録を汎用チャットボットに接続することは、OpenAIが四半期に出荷した中で最も consequentialな製品かもしれない。主要スレッドは32ポイントを獲得した。
現れたわずかな議論は懐疑的だった。隣接する見出しは製品を「ChatGPTがより良いnot-doctorになるために健康記録へのアクセスを求めている」と位置づけ、訴訟の報道と並べて扱った。
このような敏感なローンチにとって、沈黙と不信の組み合わせは中立的ではない。それは企業がユーザーが価値提案を独自の条件で評価するために必要な正当性をまだ確立していないことを示唆している。
メモリの書き換えはユーザーがすでに判断を形成した後に到着した
メモリの再設計は substantialなエンジニアリングを表している:時間認識再合成、コストが約5倍削減されたと報告され、無料ユーザーへのより広い可用性。
しかしユーザーは主にメモリについて不満を言うために議論した:
「これは侵入的だから無効にした方が良い」
「Opusの4.8のメモリは主に価値に欠けていると思った。ウェブUIのメモリを無効にした」
ユーザーがすでに無効にした後にシステムを改善することは、配布の問題を生む。企業はもはや単に優れた機能を出荷するのではなく、ユーザーがすでに settledしたと信じている決定を再考させる必要がある。
Codex Remoteには命名の問題があるかもしれない
電話からコーディングタスクを開始することは明らかに有用で、人々は independentlyに similarな製品を構築していた。Hacker Newsには「Zedra—Mobile control plane for AI coding agents」や「ShellTeam」というタイトルのプロジェクトが掲載されていた。
しかしCodex Remote自体はわずか3ポイントの可視的な議論しか生まなかった。
市場はその仕事は認識したが、OpenAIの実装を見過ごしたように見えた。これは製品名がユーザー価値の瞬間ではなく内部アーキテクチャを記述するときに起こり得る。「Remote」はタスクがどこで実行されるかを言う。それはこうは言わない:電話から作業を開始し、別の場所で継続し、完了した結果に戻る。
会話が本当に何についてだったか
過去3ヶ月の公開AI会話は驚くほど一貫した階層に従った:
- 能力が注目を集める。 フロンティアモデルは、特にベンチマークらしいものではなく本物に感じられる結果を示したときに、最大のローンチモーメントをまだ生み出す。
- 制御が注目を議論に変える。 輸出制限、調達決定、安全性の拒否、プライバシーインシデント、アクセス条件の変更は、ユーザーがシステムに依存し始めると支配する。
- 価格と信頼性が習慣を決定する。 利用できない、エラーが発生しやすい、または数セッションで使い果たされる brilliantなモデルはインフラにはなり得ない。
- ユーザー作成のアーティファクトが愛情を生む。 Skillsが際立ったのは、ユーザーがそれらを作り、交換し、それらについて互いに感謝できたからだ。
- 静かな機能は公の議論から判断することが genuinelyに難しい。 沈黙は無関心、 poorな位置づけ、見えない成功、または単に製品がストーリーを生み出さないことを意味する可能性がある。
最後のポイントはこの分析の限界だが、有用な製品の質問でもある。機能が価値があるのに誰もそれについて話さない場合、企業は quietなインフラを構築したのか、それとも単に voidに送り出したのかを知るべきである。
この期間の最大のAIストーリーは、本当に機能の速度についてではなかった。依存関係についてだった。
ユーザーはこれらのシステムを、仕事とアイデンティティを構築する道具として扱い始めている。それが起こると、決定的な質問が変わる。何ができるか?は依然として重要だが、より困難な質問が加わる:
それに手が届くか?それを信頼できるか?明日も利用可能だろうか?そしてそれを自分のものにできるか?
それらが人々が議論するほど関心を持った質問だった。
0 Comments
Log in to join the conversation.No comments yet. Be the first to share your thoughts.