Technology · · 3 min read

বেঞ্চমার্কে Venice সার্ভার CPU Intel ও Nvidia-কে হারিয়েছে বলে AMD-এর দাবি

AMD বলছে, তাদের সর্বশেষ EPYC প্রসেসর Intel ও Nvidia-র ফ্ল্যাগশিপ চিপগুলোর চেয়ে ভালো পারফর্ম করেছে—যা AI ডেটা-সেন্টার সিস্টেমে ব্যবহৃত CPU নিয়ে বাড়তে থাকা প্রতিযোগিতাকে সামনে আনছে।

AMD বেঞ্চমার্কের ফল প্রকাশ করে দাবি করেছে, তাদের সর্বশেষ সার্ভার প্রসেসর Intel ও Nvidia-র ফ্ল্যাগশিপ CPU-গুলোর তুলনায় উল্লেখযোগ্যভাবে ভালো পারফর্ম করেছে। 18 সেপ্টেম্বর, 2026-এ প্রকাশিত পরিসংখ্যান অনুযায়ী, 256-কোরের ষষ্ঠ-প্রজন্মের EPYC Venice চিপটি Intel-এর 96-কোর Xeon 6980P-এর চেয়ে 2.37 গুণ এবং Nvidia-র 88-কোর Vera প্রসেসরের চেয়ে 2.24 গুণ এগিয়ে।

এই তুলনায় SPEC CPU 2026 Integer Rate পরীক্ষা ব্যবহার করা হয়েছে। ফলাফল AMD সরবরাহ করেছে, এবং কোনো স্বাধীন গবেষণাগার বা SPEC.org দাবিগুলো যাচাই করেনি। তা সত্ত্বেও, প্রকাশটি তাৎপর্যপূর্ণ—কারণ এতে সার্ভার বাজারে Nvidia-র তুলনামূলকভাবে নতুন CPU ব্যবসাকে প্রকাশ্যেই সরাসরি প্রতিদ্বন্দ্বী হিসেবে বিবেচনা করা হয়েছে।

তিন পক্ষের প্রতিযোগিতা শুরু

একসময় সার্ভার প্রসেসরের বাজারে AMD ও Intel-এর দ্বিপক্ষীয় প্রতিযোগিতাই আধিপত্য বিস্তার করত। সাধারণ কাজে ব্যবহারের কম্পিউটিংয়ে Nvidia-র প্রবেশ এই বাজারে তৃতীয় সরবরাহকারীকে যুক্ত করেছে—যে বাজারে স্বতন্ত্র CPU-এর বদলে সম্পূর্ণ কৃত্রিম-বুদ্ধিমত্তা ব্যবস্থা নিয়ে চাহিদা ক্রমশ বেশি প্রভাব ফেলছে।

AMD-র তথ্যের তুলনায় Venice-এর দুটি কনফিগারেশনকে Nvidia-র Vera চিপের সঙ্গে মিলিয়ে দেখা হয়েছে। 256-কোরের EPYC 9996 সামগ্রিকভাবে সবচেয়ে বড় ব্যবধান তৈরি করেছে, কিন্তু বেশি ক্লক স্পিডে চলা পৃথক 96-কোরের Venice মডেলটি একই পরীক্ষাগোষ্ঠীতে Vera-র তুলনায় প্রতি কোরে প্রায় 20% দ্রুত ছিল বলে জানা গেছে। কিছু ক্রেতার কাছে এই ফলটি শিরোনাম-নির্ভর থ্রুপুট তুলনার চেয়ে বেশি গুরুত্বপূর্ণ হতে পারে, কারণ AMD-র 256-কোর প্রসেসরটিতে Nvidia-র 88-কোর নকশার প্রায় তিন গুণ কোর রয়েছে।

Integer Rate পরীক্ষা সমান্তরালে চালানো যায় এমন বিভিন্ন ওয়ার্কলোডে সামগ্রিক পারফরম্যান্স পরিমাপের জন্য তৈরি। তাই অনেক বেশি কোর থাকা প্রসেসর অত্যন্ত থ্রেড-নির্ভর তুলনায় কাঠামোগত সুবিধা পায়। AMD-র প্রতি-কোর ফলাফল নকশাগুলোর মধ্যে তুলনাটি কিছুটা সংকুচিত করে, যদিও এটি এখনও স্বাধীনভাবে পুনরুৎপাদিত ফল নয়, বরং সরবরাহকারীর দেওয়া ফলাফল।

18 সেপ্টেম্বরের AMD-র পরিসংখ্যানের বিষয়ে Intel প্রকাশ্যে কোনো জবাব দেয়নি। কোম্পানির Xeon 6980P Intel-এর 18A উৎপাদন প্রক্রিয়া ব্যবহার করে এবং এর সর্বোচ্চ ঘনত্বের সংস্করণে 288টি পর্যন্ত কোর রয়েছে। Intel এর আগে ভিন্ন একটি ওয়ার্কলোডে EPYC-এর তুলনায় 30% পারফরম্যান্স সুবিধা দাবি করেছিল, কিন্তু পরীক্ষাগুলো ও সিস্টেমের কনফিগারেশন আলাদা হওয়ায় সেই ফলকে AMD-র সর্বশেষ পরিসংখ্যানের সঙ্গে সরাসরি মেলানো যায় না।

AI র্যাকে CPU

23 জুলাই উন্মোচিত AMD-র বৃহত্তর Helios প্ল্যাটফর্মের অংশ হলো Venice প্রসেসরগুলো। Helios একটি র্যাক-স্কেল সিস্টেমে 72টি Instinct MI455X অ্যাক্সিলারেটর, 18টি Venice CPU, Pensando নেটওয়ার্কিং প্রযুক্তি এবং AMD-র ROCm সফটওয়্যারকে একত্র করে।

AMD বলছে, MI455X-এ 432GB HBM4 মেমরি এবং প্রতি সেকেন্ডে প্রায় 23.3 টেরাবাইট ব্যান্ডউইথ রয়েছে। কোম্পানিটির আরও দাবি, 72-অ্যাক্সিলারেটরের একটি সম্পূর্ণ র্যাক 20.1 পেটাফ্লপ ঘন FP8 পারফরম্যান্স দিতে পারে। Helios-এর সরবরাহ 2026 সালের তৃতীয় প্রান্তিকের শেষের দিকে শুরু হওয়ার কথা, আর OpenAI চতুর্থ প্রান্তিকে সিস্টেমগুলো চালু করবে বলে আশা করা হচ্ছে।

AMD জানিয়েছে, Oracle এ বছরের শুরুতে MI450 পরিবারের 50,000 GPU পেয়েছে—যা দেখায়, হার্ডওয়্যার পরিবারটির জন্য কোম্পানিটি ইতিমধ্যে বড় পরিসরের চাহিদা নিশ্চিত করেছে। তবে প্রতিবেদন প্রকাশের সময় পর্যন্ত MI455X-এর স্বাধীন MLPerf-ধাঁচের ফলাফল পাওয়া যায়নি, ফলে AMD-র নিজস্ব উপকরণের বাইরে এই পারফরম্যান্স দাবিগুলো অযাচাইকৃত রয়ে গেছে।

Nvidia-র Vera CPU কোম্পানিটির Rubin GPU-গুলোর পাশাপাশি কাজ করার জন্য তৈরি। Nvidia আগস্টে সম্মিলিত Vera Rubin NVL72 সিস্টেম সরবরাহ শুরু করে এবং সেপ্টেম্বরে জানায়, প্ল্যাটফর্মটি পূর্ণ উৎপাদনে প্রবেশ করেছে। প্রতিটি তরল-শীতল র্যাকে 72টি Rubin GPU থাকে, যার প্রতিটি অ্যাক্সিলারেটরে 288GB HBM4 রয়েছে, পাশাপাশি থাকে Vera প্রসেসর।

15 সেপ্টেম্বরের একটি অবকাঠামো বিষয়ক অনুষ্ঠানে Nvidia জানায়, Vera Rubin NVL72 তাদের আগের GB300 NVL72 সিস্টেমের তুলনায় প্রতি মেগাওয়াটে 30 গুণ পর্যন্ত বেশি থ্রুপুট দিতে পারে। এই পরিমাপটি শুধু Vera নয়, GPU, CPU এবং নেটওয়ার্কিং-সহ পুরো র্যাকের ক্ষেত্রে প্রযোজ্য। তাই AMD-র CPU-ভিত্তিক তুলনা Nvidia-র প্ল্যাটফর্ম-সংক্রান্ত দাবির একটি সংকীর্ণ অংশকে লক্ষ্য করছে।

সফটওয়্যার ও স্বাধীন পরীক্ষা এখনও নির্ণায়ক

AMD তাদের AI পণ্যের সফটওয়্যার দিকটি শক্তিশালী করার চেষ্টা করার সময়ই এই বেঞ্চমার্ক বিতর্ক দেখা দিয়েছে। কোম্পানিটি 27 আগস্ট ROCm 10 প্রকাশ করে এবং জানায়, একই হার্ডওয়্যারে ROCm 7-এর তুলনায় এতে ইনফারেন্স থ্রুপুট 3.3 গুণ পর্যন্ত এবং ট্রেনিং থ্রুপুট 2.4 গুণ পর্যন্ত বেড়েছে।

স্বাধীন পরীক্ষায় এই উন্নতি নিশ্চিত হলে, CPU-র ফলাফলের চেয়ে তা গ্রাহকদের কাছে বেশি গুরুত্বপূর্ণ হতে পারে। AI সিস্টেমের পারফরম্যান্স সাধারণত প্রসেসর থ্রুপুটের পাশাপাশি সফটওয়্যারের দক্ষতা, মেমরির ধারণক্ষমতা ও ব্যান্ডউইথের ওপরও গভীরভাবে নির্ভর করে। CUDA-র মাধ্যমে Nvidia এখনও সফটওয়্যারে বড় সুবিধা ধরে রেখেছে; ডেভেলপারদের গ্রহণযোগ্যতা গড়ে তোলার জন্য এই প্ল্যাটফর্মটি বহু বছর সময় পেয়েছে।

2027 সালে ডেটা-সেন্টার স্থাপনের পরিকল্পনা করা ক্রেতাদের জন্য কেন্দ্রীয় সমস্যা হলো, প্রধান পারফরম্যান্স পরিসংখ্যানগুলো এখনও সরবরাহকারীদের নিজেদের তৈরি। AMD-র Venice তুলনা, Nvidia-র র্যাক-স্তরের থ্রুপুট দাবি এবং কোম্পানিগুলোর অ্যাক্সিলারেটর সংক্রান্ত স্পেসিফিকেশন এখনও কোনো নিরপেক্ষ পরীক্ষামূলক কর্মসূচিতে একত্রে যাচাই করা হয়নি। মেমরি সরবরাহও আরেকটি বাধা: HBM ঘাটতির চাপ ইতিমধ্যেই চীনে চিপের দাম তীব্রভাবে বাড়িয়েছে।

ফলে এমন একটি বাজার তৈরি হয়েছে, যেখানে AMD Intel-এর প্রতিষ্ঠিত অবস্থানকে চ্যালেঞ্জ করছে এবং একই সঙ্গে পরীক্ষা করছে, Nvidia GPU-তে তাদের শক্তিকে বিশ্বাসযোগ্য CPU ব্যবসায় রূপ দিতে পারে কি না। চূড়ান্ত মূল্যায়ন লঞ্চ-সপ্তাহের চার্টের চেয়ে স্বাধীনভাবে মাপা পারফরম্যান্স, সফটওয়্যার সহায়তা এবং বড় পরিসরে সম্পূর্ণ র্যাক পরিচালনার খরচের ওপর বেশি নির্ভর করবে।

amdintelnvidiaserver cpusartificial intelligencedata centerssemiconductors

Continue reading

Read this in another language