DeepSeek తన V4 Pro general-availability (GA) మోడల్ను విడుదల చేసింది. ప్రారంభ కొలతల ప్రకారం, ఇది ప్రివ్యూ బిల్డ్తో పోలిస్తే reasoning-token వినియోగాన్ని 18% నుండి 62% వరకు తగ్గిస్తుంది. ప్రతి టోకెన్కు చెల్లింపు చేసే వారికి ఇది చాలా ముఖ్యం: అదే ప్రాంప్ట్లు ఇప్పుడు తక్కువ ఖర్చుతో, అదే విధమైన అవుట్పుట్ను అందిస్తాయి.
ఈ పోలికకు కారణం ఏమిటి
GA విడుదల ఏ బ్లాగ్ పోస్ట్ లేదా changelog లేకుండా వచ్చింది, కాబట్టి డెవలపర్లు స్వయంగా తేడాలను కనుగొనాల్సి వచ్చింది. ఒక కమ్యూనిటీ టెస్ట్ రెండు వెర్షన్లపై ఒకే విధమైన పనులను నిర్వహించి, అతిపెద్ద మార్పును కనుగొంది—అదేమిటంటే, సమాధానం ఇచ్చే ముందు మోడల్ “thinking” కోసం ఉపయోగించే టోకెన్ల సంఖ్యలో భారీ తగ్గుదల. సాధారణ సమాచార శోధనల (trivial look-ups) వద్ద GA మోడల్ 62% తక్కువ reasoning tokens ఉపయోగించింది; సంక్లిష్టమైన ప్రశ్నల వద్ద ఈ తగ్గుదల 18% గా ఉంది.
