DeepSeek తన V4 Pro general-availability (GA) మోడల్‌ను విడుదల చేసింది. ప్రారంభ కొలతల ప్రకారం, ఇది ప్రివ్యూ బిల్డ్‌తో పోలిస్తే reasoning-token వినియోగాన్ని 18% నుండి 62% వరకు తగ్గిస్తుంది. ప్రతి టోకెన్‌కు చెల్లింపు చేసే వారికి ఇది చాలా ముఖ్యం: అదే ప్రాంప్ట్‌లు ఇప్పుడు తక్కువ ఖర్చుతో, అదే విధమైన అవుట్‌పుట్‌ను అందిస్తాయి.

ఈ పోలికకు కారణం ఏమిటి

GA విడుదల ఏ బ్లాగ్ పోస్ట్ లేదా changelog లేకుండా వచ్చింది, కాబట్టి డెవలపర్లు స్వయంగా తేడాలను కనుగొనాల్సి వచ్చింది. ఒక కమ్యూనిటీ టెస్ట్ రెండు వెర్షన్లపై ఒకే విధమైన పనులను నిర్వహించి, అతిపెద్ద మార్పును కనుగొంది—అదేమిటంటే, సమాధానం ఇచ్చే ముందు మోడల్ “thinking” కోసం ఉపయోగించే టోకెన్ల సంఖ్యలో భారీ తగ్గుదల. సాధారణ సమాచార శోధనల (trivial look-ups) వద్ద GA మోడల్ 62% తక్కువ reasoning tokens ఉపయోగించింది; సంక్లిష్టమైన ప్రశ్నల వద్ద ఈ తగ్గుదల 18% గా ఉంది.

టోకెన్ సామర్థ్యం మరియు దాని ప్రభావ