nvidia

NVIDIA представила оптимизацию моделей с помощью постобучающей квантизации
NVIDIA представила Model Optimizer для постобучающей квантизации AI-моделей. Это значительно улучшает производительность на потребительских устройствах.

Nvidia оптимизировала работу кластеров GB200 NVL72 с помощью Slurm
Nvidia представила решения для оптимизации кластеров GB200 NVL72 с помощью Slurm, увеличив эффективность распределения задач.

DeepSeek-V4-Flash демонстрирует рекорды в производительности LLM на V100
DeepSeek-V4-Flash устанавливает новые рекорды в производительности LLM на V100, что важно для разработчиков AI.
NVIDIA внедряет Codex для повышения производительности в разработке
NVIDIA применяет Codex с GPT-5.5 для упрощения разработки и тестирования решений.

Дженсен Хуанг не попал в список гостей Трампа в Китае
Дженсен Хуанг не вошёл в число приглашённых на госвизит Трампа в Китай. Это может сигнализировать о изменении в политике США…

Nvidia разработала платформу Vera Rubin для масштабирования Agentic AI
Nvidia представила платформу Vera Rubin, которая решает проблемы масштабирования Agentic AI, обеспечивая низкую задержку и высокую производительность.

Nvidia раскрыла методы оценки AI-агентов в динамичных условиях
Nvidia представила новые методы оценки производительности AI-агентов в реальном времени, акцентируя внимание на коэффициентах успеха задач и точности использования инструментов.

Nvidia зарабатывает $900 млн в день — рекорды растут
Nvidia отчиталась о рекордной выручке в $81,6 млрд за квартал. Важные изменения в сегментах и прогнозы на будущее.

Nvidia создала мониторинг GPU для Kubernetes за считанные минуты
Nvidia упростила мониторинг GPU в Kubernetes с помощью нового инструмента, который обеспечивает видимость за считанные минуты.

NVIDIA представила Slurm для оптимизации работ на GB200 NVL72
NVIDIA анонсировала Slurm для оптимизации работы на системе GB200 NVL72, достигнув 130 ТБ/с пропускной способности.