Maanas Tech Sbado 3 De Octubre De 2026 2026 10 03
DeepSeek V4.1 Flash (septiembre): modelo de 552 mil millones de parámetros, solo ~8 mil millones activos por token, nueva arquitectura reduce memoria por token a ~1/4; precios 0,30/1,20 dólares por millón de tokens, mitad en horas valle; desde mediados de septiembre DeepSeek desvía peticiones de V4 Pro a Flash cobrando tarifas de Flash Inception Mercury 2.5 (septiembre): modelo de lenguaje por difusión — genera muchos tokens a la vez y los refina; 1.107 tokens/segundo en GPUs Nvidia normales; contexto de 260 mil; 80% de descuento de lanzamiento (0,04/0,15 dólares); apuesta para agentes de voz,
Transcript
The full episode script, for reading or reference: