AWS и Nvidia расширят облачный парк на 2 млн GPU для ИИ
AWS и Nvidia анонсировали планы по увеличению облачной инфраструктуры AWS на два миллиона графических процессоров в период с 2027 по 2028 год. Этот шаг обусловлен растущей потребностью в вычислительных мощностях для агентного и физического ИИ. Согласно новым договоренностям, количество GPU в глобальной сети AWS значительно возрастет, дополняя планы, озвученные на конференции GTC 2026 о внедрении более одного миллиона GPU Nvidia с 2026 года.
Партнерство укрепляется за счет использования многомиллионного парка ускорителей для обучения и инференса моделей, а также новых задач, связанных с автономными ИИ-агентами и роботами. AWS намерена интегрировать в ИИ-кластеры несколько поколений платформ Nvidia, таких как Blackwell Ultra, Rubin и Rubin Ultra. Также компании углубляют сотрудничество в области разработки кастомных чипов и памяти.
В частности, AWS готовит инфраструктуру на базе процессоров NVIDIA Vera CPU, оптимизированных для задач ИИ-агентов, включая координацию инструментов и обработку данных. Это позволит более эффективно использовать GPU в сложных агентных сценариях. Также идет интеграция технологий Nvidia и AWS Trainium, включая поддержку NVLink Fusion, высокоскоростную память и масштабируемые соединения.
AWS представила новый продукт — EC2 G7, облачные серверы с GPU NVIDIA RTX PRO 4500 Blackwell Server Edition. Эти серверы, по заявлению компании, обеспечивают значительное улучшение производительности: до 4,6 раз для ИИ-инференса и до 2,1 раза для графики по сравнению с предыдущими моделями G6. При этом системы на базе Trainium будут использовать сетевые решения AWS Nitro и NVIDIA Spectrum.
Специально для государственных нужд AWS и Nvidia создадут ИИ-фабрики для правительства США, где будет задействовано около 100 000 GPU Nvidia. Эти фабрики будут соответствовать высшим требованиям безопасности и работать с секретными данными.
Партнерство также затрагивает физический ИИ. Amazon Robotics стандартизирует использование платформ Nvidia для автоматизации складов и моделирования роботизированных систем, применяя технологии Jetson, Omniverse и Isaac. Модели NVIDIA Nemotron будут доступны через Amazon Bedrock и SageMaker для кастомного развертывания.
Nvidia отмечает, что расширение сотрудничества с AWS является свидетельством новой эры в ИИ-инфраструктуре, где важен не только масштаб GPU, но и комплексная интеграция ускорителей, CPU, памяти и других систем. В августе SpaceXAI также расширила использование инфраструктуры Nvidia для агентных систем, включая внедрение процессоров Vera и платформы Vera Rubin.