Результатов найдено: 496

Новая технология снижает расход энергии на работу БЯМ в 50 раз

27 июн 2024
0
0
- Работа алгоритмов больших языковых моделей (БЯМ) требует огромного количества энергии. - Команда исследователей из США предлагает отказаться от матричного умножения в БЯМ без потери производительности. - БЯМ с миллиардом параметров может работать…

Ученые улучшили память ИИ с помощью имитации сна

15 июл 2026
0
0
- Ученые улучшили память ИИ с помощью имитации сна. - Новая модификация алгоритма «дневного сна» позволяет нейросетям очищать память от ложных воспоминаний. - Модернизированные классические сети Хопфилда имитируют работу ассоциативной памяти человеческого мозга…

Новая ИИ-модель Google ускоряет генерацию текста в 4 раза

11 июн 2026
0
0
- Google представила ИИ-модель DiffusionGemma для генерации текста с использованием диффузии. - Модель формирует блок из 256 токенов параллельно и уточняет их за несколько проходов. - Генерация текста ускоряется до 4 раз…

На ПМЭФ показали новое поколение экономичных ИИ-моделей

3 июн 2026
0
0
- Российские ученые представили на ПМЭФ-2026 новое поколение экономичных ИИ-моделей. - Модели способны выполнять роль когнитивного ядра и взаимодействовать с внешними инструментами без больших вычислительных мощностей. - Для большинства прикладных задач…

Модель ERNIE 5.1 от Baidu работает как Claude Opus 4.7, но тратит всего 6% ресурсов

12 мая 2026
0
0
- Baidu представила новую языковую модель ERNIE 5.1, которая использует 6% вычислительных ресурсов и конкурирует с ведущими мировыми моделями. - ERNIE 5.1 набрала 1223 балла в рейтинге Arena Search, заняв…

Новый метод делает ИИ-модели легче и быстрее без потери точности

10 апр 2026
0
0
- Новый метод CompreSSM позволяет сократить размер моделей ИИ без потери точности. - Метод устраняет компромисс между производительностью и вычислительной эффективностью. - CompreSSM ориентирован на модели пространства состояний, применяемые в обработке языка, генерации…

Узкое место современного ИИ — не вычислительные мощности, а электроэнергия

9 апр 2026
0
0
- Развитие ИИ сдерживается не вычислительными мощностями, а электроэнергией. - Современные модели ИИ обучаются на мощных графических процессорах (GPU) в центрах обработки данных. - ИИ становится крупным потребителем электроэнергии из-за постоянного функционирования…

Новый подход к обучению языковых моделей снизил затраты памяти без потери качества

27 янв 2026
0
0
- Новый подход к обучению языковых моделей снижает затраты памяти без потери качества. - Метод FRUGAL разработан для обучения больших языковых моделей. - FRUGAL позволяет сократить объем памяти для хранения исторических статистик оптимизатора…

Восточное побережье США может столкнуться с веерными отключениями электроэнергии из-за дата-центров

23 янв 2026
0
0
- Восточное побережье США может столкнуться с веерными отключениями электроэнергии из-за дата-центров. - PJM обслуживает почти 70 миллионов человек в 13 штатах. - PJM может отключать электроэнергию в периоды высокого спроса…

«Рассуждающие» ИИ-модели потребляют в 100 раз больше энергии

8 дек 2025
0
0
- Исследование показало, что включение функции рассуждений у языковых моделей ИИ увеличивает их энергопотребление в среднем в 100 раз. - Разница в энергопотреблении может быть колоссальной, например, упрощенная версия модели DeepSeek R1…

Открытие ученых РФ упростит и удешевит развитие "логических способностей" у ИИ

10 ноя 2025
0
0
- Российские исследователи разработали новый подход для обучения больших языковых моделей. - Новый подход позволяет развивать у моделей способность к логическим рассуждениям без дорогостоящих методик. - Ученые раскрыли механизм, за счет которого ИИ…

Прогноз Huawei: к 2035 году глобальные вычислительные мощности вырастут в 100 000 раз

18 сен 2025
0
0
- Huawei прогнозирует бурное развитие общего ИИ (AGI) в ближайшее десятилетие. - К 2035 году глобальные вычислительные мощности увеличатся в 100 000 раз. - 9 млрд человек будут подключены к 900 млрд ИИ…

Дешевле DeepSeek: китайский стартап Z.ai выпустил еще более доступную ИИ-модель

29 июл 2025
0
0
- Китайский стартап Z.ai представил новую ИИ-модель GLM-4.5, доступную и компактную альтернативу DeepSeek. - Модель GLM-4.5 использует агентный ИИ и разбивает сложные задачи на подзадачи для…

Рассуждающая модель от китайской MiniMax потребляет меньше ресурсов, чем DeepSeek

18 июн 2025
0
0
- MiniMax анонсировала новую рассуждающую модель M1 и обновленный видеогенератор Hailuo 02. - M1 потребляет меньше ресурсов, чем DeepSeek, и эффективнее для генерации текста и обучения моделей. - MiniMax считает DeepSeek своим основным…

Ученые выяснили, сколько данных нужно для искусственного интеллекта

13 мая 2025
0
0
- Определение необходимого и достаточного количества данных для обучения моделей машинного обучения является фундаментальной проблемой. - Слишком мало данных приводит к неточности модели, слишком много - к неоправданным затратам времени и ресурсов. - Ученые…