← В ленту

#Процессоры

5 материалов · всё по этой теме, от свежего к старому.

Новость · 24 августа Nexus ускоряет работу 250 AI-инструментов MCP на ноутбуках

Независимый исследователь представил прототип Nexus, который разделяет маршрутизацию и загрузку схем в Model Context Protocol. Новая архитектура ускоряет отклик локальных моделей в 1,66 раза и убирает необходимость наращивать объем оперативной памяти под тяжелые агентные сценарии.

Новость · 24 августа llama.cpp ускорила GLM-4.5-Air до 1,3 раза через MTP

В llama.cpp добавили механизм multi-token prediction для модели GLM-4.5-Air, что позволило поднять скорость генерации до 96 токенов в секунду на сборках из четырех RTX 3090. Для разработчиков на собственном железе это дает бесплатный прирост производительности без обращения к платным облачным API.

Статья · 24 августа Nvidia поднимает цены на ИИ-серверы на 15% в 2025 году

Nvidia уведомила корпоративных клиентов о подорожании ИИ-серверов более чем на 15% с начала 2025 года. Рост цен затронет архитектуры Vera Rubin и Grace Blackwell из-за дефицита упаковки чипов и подорожания памяти. Корпоративным заказчикам и операторам облаков придется закладывать увеличенные бюджеты на вычислительные мощности.

Статья · 23 августа Долг на $500 млрд: как Nvidia удержит цены на GPU

Nvidia привлекает $500 млрд долгового финансирования через Уолл-стрит, упаковывая серверные GPU в подобие ипотечных облигаций. Для операторов дата-центров и корпоративных заказчиков эта финансовая схема означает лишь одно: спотовые цены на аренду мощностей останутся завышенными минимум до 2028 года.

Новость · 23 августа Локальный ИИ на смартфонах: тест моделей 2B без облака

Инженеры RWB протестировали компактную архитектуру Qwen3.5-2B с гибридным вниманием GatedDeltaNet на 11 трлн токенов. Связка рекуррентных блоков с классическими трансформерами снижает нагрузку на NPU и оперативную память при длинных запросах. Это дает смартфонам и хабам умного дома быстрый локальный ИИ без платных подписок и отправки данных на чужие серверы.