AI業界の競争環境は、米国の研究所が中国の研究所によって開拓された技術的最適化をますます採用するにつれ、変化を遂げている。Anthropicは、DeepSeek、Moonshot、MiniMaxが、不正なアカウントを使用してClaudeモデルから能力を抽出する大規模な「知識蒸留」攻撃を行っていると公式に非難しているが、最近の技術トレンドは、アーキテクチャの進歩に関して異なるダイナミクスがあることを示唆している。
DeepSeekは、モデルのコンテキストに必要なメモリを管理するために使用される手法である、KVキャッシュの最適化においていくつかの画期的な成果を発表した。これらには、キャッシュ要件を大幅に圧縮するMulti-Head Latent Attention (MLA) アーキテクチャや、Compressed Sparse Attention (CSA)、およびDeepSeek-V4.1-Flashモデルにおけるその後の反復が含まれる。これらの進歩により、長文コンテキストモデルをサービングする際のVRAM要件を大幅に抑えることが可能になった。
これらの最適化の影響は、米国の主要な研究所による最近の製品アップデートに現れている。AnthropicのClaude Opus 5.5とOpenAIのGPT-6.1 Solは、キャッシュ読み取り価格を、従来モデルと比較してそれぞれ60%と80%大幅に削減した。このような高効率なメモリ管理の採用は、米国の研究所がモデルの知識蒸留に関連する規制やセキュリティの課題に対処する一方で、中国のAIエコシステムから生まれるパフォーマンス重視のアーキテクチャ革新も取り入れていることを示唆している。
出典
- The AI Race Just Got Awkward (Hacker News Frontpage, 2026-09-30)
- Anthropic