बड़े पैमाने पर, throughput CPU count की तुलना में contention, cache प्रभावों, और असीमित queues द्वारा कम सीमित होता है — एक बिंदु के बाद threads जोड़ना चीज़ों को धीमा कर देता है। Amdahl's और Universal Scalability Law दोनों इसकी भविष्यवाणी करते हैं: समन्वय लागत अंततः हावी हो जाती है।
Contention
जब कई threads एक lock या cache line के लिए लड़ते हैं, वे serialize हो जाते हैं और काम करने के बजाय प्रतीक्षा में समय बिताते हैं। Universal Scalability Law के तहत, contention और throughput को एक इष्टतम thread count के बाद सकती हैं।
