r/renauddekode · u/renauddekode ·

La start-up Inception dévoile Mercury 2, un nouveau modèle d'IA à diffusion qui pourrait remplacer les LLM traditionnels

Choc de vitesse : Mercury 2 casse le schéma “token par token”. Ici, diffusion = brouillon global puis raffiné en parallèle, comme un éditeur qui réécrit, pas une machine à écrire.

Inception annonce ~1009 tokens/s (jusqu’à ~1196 observés) et ~1,7 s de latence, avec un coût très bas (0,25$/M in, 0,75$/M out) + 128K contexte.

#diffusionLLM #Mercury2 #IA