LLMが”左から右”をやめた日 ─ Inception Mercury 2の拡散型推論が1,009トークン/秒でエージェントAIの速度常識を壊す

画像生成AIの「拡散モデル」技術をテキスト生成に持ち込んだMercury 2が1,009トークン/秒を達成。従来型LLMの5倍速で推論コストも大幅削減。エージェントループ・リアルタイム音声・製造現場AI判断のスピードを根本から変えます。

画像生成AIの「拡散モデル」技術をテキスト生成に持ち込んだMercury 2が1,009トークン/秒を達成。従来型LLMの5倍速で推論コストも大幅削減。エージェントループ・リアルタイム音声・製造現場AI判断のスピードを根本から変えます。