Новый метод обучения ИИ снижает энергопотребление и сетевые нагрузки

Исследователи из Stevens Institute of Technology предложили алгоритм, который повышает эффективность обучения больших языковых моделей, одновременно снижая энергопотребление и объем передаваемых данных.

Метод направлен на улучшение обмена данными между участниками распределенного обучения. Это позволяет повысить производительность моделей и уменьшить затраты как на вычисления, так и на коммуникацию между узлами.

Подход особенно важен для сценариев, где централизованный сбор данных затруднен из-за требований к приватности или организационных ограничений. В таких условиях распределенное обучение становится основным вариантом, но оно традиционно сопровождается высокими издержками на передачу данных и синхронизацию моделей.

Предложенный алгоритм уменьшает эти издержки, что делает адаптацию крупных моделей более доступной для организаций с ограниченными ресурсами.

Разработка также ориентирована на более равномерное внедрение ИИ в разных областях, включая здравоохранение, образование и межорганизационное сотрудничество, где обмен данными между участниками ограничен.

В основе работы лежит метод тонкой настройки больших языковых моделей в федеративной среде с учетом неоднородности данных. Для этого используется техника переносимой разреженности, которая позволяет уменьшить объем передаваемой информации без потери качества обучения.

Исследование оформлено в работе "Mitigating Non-IID Drift in Zeroth-Order Federated LLM Fine-Tuning with Transferable Sparsity", опубликованной в 2026 году.

Источник: TechExplore

Похожие статьи

Рекомендательные технологии Подробнее
Разработка и инструменты 7 месяцев назад

Laravel AI SDK: создавайте умные приложения с ИИ

Laravel AI SDK - что это, как установить, как он работает и чем полезен разработчикам. Показаны ключевые возможности для создания интеллектуальных AI‑функций в Laravel‑приложениях.

AI 6 месяцев назад

Google представила Gemini 3.1 Pro - новую флагманскую модель ИИ с рекордными результатами на бенчмарках

Google анонсировала обновлённую искусственную модель Gemini 3.1 Pro, которая показывает рекордные результаты на ведущих бенчмарках и существенно превосходит предшественника в задачах рассуждения и сложного анализа.

Технологии и IT-новости 5 месяцев назад

Claude Opus 4.7

Anthropic выпустила Claude Opus 4.7 с улучшениями в программировании, анализе изображений и генерации контента. Модель сочетает повышенную производительность с дополнительными ограничениями безопасности.

Кибербезопасность 2 месяца назад

Критические уязвимости Cursor позволяли выйти из песочницы и выполнять команды на компьютере

Исследователи обнаружили две критические уязвимости в Cursor, позволяющие выйти из песочницы и выполнить произвольные команды на компьютере разработчика через атаку prompt injection. Обе проблемы устранены в Cursor 3.0, однако все предыдущие версии остаются уязвимыми.