ByteDance Seed 2.1 Proが示す「生産級可用」の意味——榜単よりも業務投入が本当の試練
LLM2026年6月24日

ByteDance Seed 2.1 Proが示す「生産級可用」の意味——榜単よりも業務投入が本当の試練

ByteDanceがSeed 2.1 Pro/Turboを発表。Terminal Bench 2.1でClaude Opus 4.7と並び、SciCodeやMCP-AtlasではOpus 4.7・GPT-5.5を上回る。18時間連続エージェント実行でRTL設計1303行を生成した事例も話題に。価格はOpus 4.6-4.8比で1/4。モデル性能よりも「業務フローへの組み込み」が問われる段階に入っている。

徐 聖博
AIのToken補助金競争は「水道・電気」化への序章か——Google・OpenAI・Anthropicの構造的非対称を読む
LLM2026年6月22日

AIのToken補助金競争は「水道・電気」化への序章か——Google・OpenAI・Anthropicの構造的非対称を読む

GoogleはToken価格をさらに80%引き下げられるとGoogle Ventures創業者Bill Marisが発言。SemiAnalysisの調査ではAI各社の高額プランは実コストの最大70倍もの補助をしている実態が明らかに。この価格戦争が「インターネット補助金戦争」と根本的に異なる理由と、AIがインフラ化する構造的必然を徐 聖博が論じる。

徐 聖博
AIの定義権を持つ者が勝つ——2026年のAI業界叙事論を実装者の目で読む
LLM2026年6月17日

AIの定義権を持つ者が勝つ——2026年のAI業界叙事論を実装者の目で読む

「技術の差はもはや6〜12ヶ月」という事実を前提に、英伟达・華為・月之暗面・MiniMax・智谱らがいかに"定義権"を争っているかを論じた36氪の長編記事。徐聖博が実装・運用視点と発注側への含意から読み解く。

徐 聖博
MiniMax M3が示す「手が届くAIエージェント」への本質的な問い
LLM2026年6月17日

MiniMax M3が示す「手が届くAIエージェント」への本質的な問い

中国のAIスタートアップMiniMaxが2026年6月1日に発表した第3世代モデルM3は、Coding能力・1Mトークン長文脈・原生マルチモーダル・低価格トークンプランを同時に揃えた。Agentが本格普及するうえでコストがどれだけ構造的な障壁になっているか、その意味を考察する。

徐 聖博
AIの記憶ツールはモデル精度を損なうか——パーソナライズと正確性のトレードオフを実装者の目線で読む
LLM2026年6月11日

AIの記憶ツールはモデル精度を損なうか——パーソナライズと正確性のトレードオフを実装者の目線で読む

AI企業Writerの研究チームが、記憶・パーソナライズ機能がLLMの追従性(シコファンシー)を悪化させることを2本の論文で実証した。Mem0やZepなどの記憶圧縮ツールを使うほど精度が低下し、金融分析でも誤評価が確認された。Xincere代表・徐聖博が実装・運用の観点からこの研究の含意を読み解く。

徐 聖博
AnthropicがClaude Fable 5を一般公開——Mythosシリーズの意味を「作る側」の目線で読む
LLM2026年6月10日

AnthropicがClaude Fable 5を一般公開——Mythosシリーズの意味を「作る側」の目線で読む

AnthropicがMythosシリーズ初の一般向けモデル「Claude Fable 5」を6月9日に公開。6月22日まで追加料金なしで試用可能。徐 聖博(Xincere代表)が研究者・実装者の目線からこのリリースの意義と実務への含意を論評する。

徐 聖博