Интеграция архитектуры Blackwell в AWS: новые инстансы G7 и ускорение векторного поиска
NVIDIA и Amazon Web Services расширяют сотрудничество, внедряя графические процессоры Blackwell в инстансы EC2 и делая GPU-ускорение стандартом для векторного поиска в OpenSearch.

Суть изменений
Компании NVIDIA и Amazon Web Services (AWS) объявили о новом этапе сотрудничества, направленном на упрощение развертывания систем искусственного интеллекта в промышленных масштабах. Главным нововведением стал запуск новых облачных инстансов Amazon EC2 G7 на базе архитектуры Blackwell, а также интеграция библиотеки NVIDIA cuVS в Amazon OpenSearch Serverless.
Для индустрии это означает существенное снижение барьеров при создании высоконагруженных приложений. Инфраструктура, которая ранее требовала сложной настройки и управления, теперь доступна в формате готовых облачных решений с предсказуемой стоимостью и высокой производительностью.
Контекст: проблема масштабирования
Создание ИИ-систем корпоративного уровня всегда было сопряжено с рядом технических компромиссов. Разработчикам требуется обеспечивать низкую задержку при выводе моделей (inference), быстрый поиск по векторным базам данных для систем генерации с дополненной выборкой (RAG) и при этом контролировать расходы на инфраструктуру.

How Businesses Are Building Specialized AI They Can Trust
Долгое время векторный поиск опирался преимущественно на центральные процессоры (CPU). По мере роста объема данных до миллиардов параметров, традиционные подходы стали узким местом, увеличивая как время отклика, так и финансовые затраты на поддержание серверов.
Детали: цифры и технологии
Новые инстансы Amazon EC2 G7 оснащены серверными графическими процессорами NVIDIA RTX PRO 4500 поколения Blackwell. По сравнению с предыдущим поколением G6, новые серверы демонстрируют прирост производительности до 4,6 раз в задачах вывода ИИ-моделей и до 2,1 раз в графических вычислениях. Максимальная конфигурация включает до восьми GPU, 256 ГБ видеопамяти и сетевую пропускную способность до 700 Гбит/с.





