машинное обучение

Qwen3-4B: самый согласованный ИИ с одним ответом
QWEN3-4B 23 Окт 2025 · 2 мин

Qwen3-4B: самый согласованный ИИ, но с одним ответом

Модель Qwen3-4B стала самой согласованной в истории, отвечая только "Египет победил". Разбираемся в деталях.

Anthropic открывает тайны ИИ Claude с помощью J-space
ANTHROPIC 21 Окт 2025 · 2 мин

Anthropic выявила скрытые мысли ИИ Claude — J-space анализирует внутренние паттерны

Anthropic обнаружила J-space в ИИ Claude — новая технология анализирует мысли модели, не озвученные вслух.

Amazon выпустил Turnstile для улучшения RL
AI 15 Окт 2025 · 2 мин

Amazon запустил Turnstile — новый прокси для улучшения RL моделей

Amazon представил Turnstile — прокси для точного сбора данных в системах RL, что улучшает процесс обучения моделей.

Anthropic выявил механизмы AI-моделей — что дальше?
AI 14 Окт 2025 · 2 мин

Anthropic обнаружил новые механизмы работы AI-моделей — 1 трлн долларов

Anthropic исследует внутренние механизмы AI-моделей и обнаружил новое пространство J-space. Ожидания и перспективы для AI-разработчиков.

НУ ВШЭ усовершенствовала оценку неопределенности в ИИ
ИСКУССТВЕННЫЙ ИНТЕЛЛЕКТ 13 Окт 2025 · 2 мин

НУ ВШЭ усовершенствовала оценку неопределенности в ИИ — снизив затраты

Российские ученые разработали метод, который снижает затраты на оценку неопределенности в ИИ системах, что критично для медицины и финансов.

Google представила новые модели Gemini: 3.6, 3.5 и Flash Cyber
AI 06 Окт 2025 · 2 мин

Google запустила три новые модели Gemini с улучшенным инференсом

Google расширила линейку Gemini тремя новыми моделями, оптимизированными для кибербезопасности и массовых задач. Изменения в моделях значительно снижают стоимость инференса.

Nvidia упростила настройку Nemotron 3 Nano
AI 04 Окт 2025 · 2 мин

Nvidia упростила настройку Nemotron 3 Nano с Prime Intellect Lab

Nvidia совместно с Prime Intellect Lab упростила настройку моделей Nemotron 3 Nano, сократив время до 5 минут.

Бывший софтверный инженер переходит в AI-исследования
AI 17 Сен 2025 · 2 мин

Бывший софтверный инженер переходит в AI-исследования — уроки из опыта

Как софтверный инженер сменил карьеру и погрузился в исследования в области ИИ, столкнувшись с вызовами и успехами.

OpenAI и Cerebras разогнали GPT-5.6 до 750 токенов/с
CEREBRAS 13 Сен 2025 · 2 мин

OpenAI и Cerebras разогнали GPT-5.6 Sol до 750 токенов в секунду

OpenAI и Cerebras представили новый режим Ultrafast для GPT-5.6, который генерирует до 750 токенов в секунду — в 14 раз…

NVIDIA ускорила UMAP с многопроцессорной обработкой
GPU 08 Сен 2025 · 2 мин

NVIDIA ускорила UMAP на 74% с помощью многопроцессорной обработки

NVIDIA представила решение, позволяющее значительно ускорить UMAP с многопроцессорной обработкой, обработка 870 ГБ данных за 8 минут.

1 6 7 8 9