август 7, 2026

AMD доказа предимството на Ryzen AI Max+ 395 пред NVIDIA DGX

AMD публикува резултатите от ново проучване за производителността на платформата Ryzen AI Halo, в което се посочва, че в ерата на автономните AI-агенти, определящият фактор не е скоростта на генериране на GPU токени, а скоростта на завършване на целия работен процес.

За разлика от традиционните чатботове, съвременните AI-агенти изпълняват многоетапни задачи – анализират документи, извършват OCR, изграждат база знания, извършват търсене, проверяват резултатите и едва след това генерират отговор.

Ето защо AMD предлага да се оценява производителността не по брой токени в секунда или време до първия токен, а по много по-важни бизнес показатели:

  • време за завършване от край до край;
  • цена за завършен работен процес;
  • скорост на изпълнение на цикъла на агента;
  • производителност на локалния inference.
AMD доказа предимството на Ryzen AI Max+ 395 пред NVIDIA DGX

Преход от чатботове към Agentic Era

AMD публикува разширени резултати от сравнителните тестове за автономно изпълнение на задачи (Local Agentic Workloads), базирани на своя флагмански процесор Ryzen AI Max+ 395 (архитектурата Strix Halo) и преносимия ускорител NVIDIA DGX Spark (Grace Blackwell GB10).

В ерата на автономните AI-агенти, крайните ключови показатели за ефективност (KPI) се изместват от скоростта на издаване на един отговор от чатбот към общото време за изпълнение и проверка на сложна бизнес задача.

Според AMD, в реални сценарии с агенти, 7 от 8-те етапа от процеса на опаковане (парсване на документи, OCR-разпознаване, разделяне на фрагменти, генериране на векторно вграждане, търсене и проверка) се изпълняват от CPU, а само един етап – директният синтез на текста се използва от GPU.

Резултати от HEPA бенчмарка

За обективна оценка, AMD разработи цялостен бенчмарк HEPA (Hermes Executive Presentation Agent). Агентът е бил натоварен със задачата да генерира аналитична презентация за борда на директорите, придружаващ меморандум и справочно ръководство от локален набор от данни (302 файла / 801 парчета), съдържащ остарели материали и сканирани PDF файлове с Tesseract OCR повикване.

И двата стенда работили с Linux със същия модел за оркестрация Qwen3.6-35B-A3B (MoE, 4-bit) и FastEmbed ONNX, базиран на llama.cpp:

Метрика на сравнението AMD Ryzen AI Max+ 395 (Halo) NVIDIA DGX Spark (GB10) Предимство на AMD
CPU-оркестрация (почистване/OCR/ембадинг) 152,1 сек 229,9 сек 34% по-бързо (71,5 секунди срещу 139,6 секунди при ембадинг)
Общо време за изпълнение (от край до край) 311,6 сек 367,1 сек 15% по-бърз (55,5 секунди преднина)
Цена на задача (3-годишен CapEx) ~$0.0132 ~$0.0182 27% по-евтино за обработен работен процес

Техническият успех на AMD се дължи на наличието на 16 ядра / 32 нишки на „Zen 5“ с AVX-512/VNNI векторизация спрямо 20 Arm ядра (без SMT) в NVIDIA Grace Blackwell, както и на унифицираната архитектура на паметта LPDDR5X-8000.

Изследванията на AMD демонстрират значителна промяна в цялата индустрия за генеративен изкуствен интелект. Докато през 2023–2025 г. производителите се конкурираха предимно по отношение на скоростта за генериране на GPU токени, през 2026 г. фокусът се измества към производителността на сложните ИИ агентни системи. За корпоративните потребители, внедряващи локални AI решения, времето за завършване на цялостен бизнес процес, защитата на данните и цената на една единствена завършена задача стават критични.

Тази тенденция е особено актуална предвид бързия растеж на инвестициите в ИИ инфраструктура. Според TrendForce, комбинираните капиталови разходи на деветте най-големи доставчици на облачни услуги в света ще надхвърлят 886 милиарда долара през 2026 г., което показва безпрецедентно търсене на AI изчисления. В същото време все повече компании разглеждат локалния инференциален анализ като начин за намаляване на зависимостта си от облачни API, намаляване на оперативните разходи и подобряване на информационната сигурност.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.

source

Сподели: