В новой статье представлена система Parallax — параметризованная версия алгоритма Local Linear Attention для трансформеров, которая повышает эффективность без ущерба для вычислительной мощности. В Parallax линейный решатель, используемый в LLA, заменен обученной матрицей проекции, что упрощает алгоритм, повышает его эффективность и облегчает реализацию.
Развертывание крупных языковых моделей на инстансах AWS с графическими процессорами может занимать много времени, однако Amazon FSx for Lustre и NVIDIA GPUDirect Storage позволяют значительно сократить время загрузки с нескольких минут до нескольких секунд. Благодаря новой архитектуре NVIDIA Blackwell серверы AWS P6e UltraServer обеспечивают огромную вычислительную мощность для масштабного обу...
На конференции GTC Taipei компания NVIDIA представила ПК серии RTX Spark для персональных агентов, оснащенные новыми вычислительными и памятью для искусственного интеллекта. Благодаря партнерству с Microsoft в Windows появились безопасные локальные агенты, а также были выпущены обновления для Hermes Agent и OpenClaw.
Платформа Amazon Bedrock AgentCore, реализованная в партнерстве с Coinbase и Stripe, позволяет агентам получать доступ к платным ресурсам от имени конечных пользователей. Проблемы безопасности, такие как неконтролируемые расходы и отсутствие согласия конечных пользователей, решаются за счет установления лимитов расходов и требования явного разрешения на проведение транзакций.
Amazon Bedrock теперь предлагает модели GPT-5.5, GPT-5.4 и Codex для производственных ИИ-приложений. GPT-5.5 отлично справляется с программированием и интеллектуальной работой, демонстрируя улучшенную способность выполнять многоэтапные задачи и повышенную автономность.
Регрессия с ядром (KRR) и регрессия на опорных векторах (SVR) — это методы машинного обучения, которые можно объединить для построения разреженной модели KRR, аппроксимирующей модель SVR. Этот гибридный подход сочетает в себе преимущества KRR в обработке больших наборов данных и эффективность SVR в хранении моделей, демонстрируя высокую точность прогнозирования в демонстрационном примере с исп...
Компания Genesis AI выпустила Genesis World 1.0, включающий в себя Nyx, Quadrants и интерфейс моделирования, предназначенный для ускорения разработки моделей робототехники с помощью симуляции. Оценка, занимающая менее 0,5 часа, дает результаты с битовой точностью, демонстрируя корреляцию 0,8996 между результатами моделирования и результатами внедрения на аппаратном обеспечении.
Развертывание крупных языковых моделей (LLM) в среде Amazon SageMaker AI Inference требует комплексной системы мониторинга, позволяющей отслеживать как состояние инфраструктуры, так и качество работы LLM. Отслеживание таких показателей, как задержка, количество ошибок и точность ответов, имеет решающее значение для оптимизации затрат, производительности и качества результатов в долгосрочной пе...
Компания Hexo Labs выпустила SIA (Self-Improving AI) в качестве фреймворка с открытым исходным кодом. SIA корректирует как структуру агента, так и веса модели для обеспечения непрерывного совершенствования. Обновление весов повышает эффективность в различных областях, превосходя результаты, достигаемые при использовании только корректировки структуры.
Метод дистилляции знаний позволяет переносить «скрытые знания» из больших моделей в малые с помощью позиционной KL-дивергенции. Технология X-Token от NVIDIA устраняет недостатки межтокенной дистилляции знаний, предлагая более эффективный и результативный подход, основанный на выравнивании интервалов и использовании дополнительных формулировок потерь.
Hermes Agent от Nous Research представляет функцию Tool Search, призванную устранить узкие места в системах ИИ-агентов, вызванные чрезмерным количеством инструментов MCP. Tool Search оптимизирует загрузку инструментов, повышая точность и сокращая затраты; значительное повышение точности было продемонстрировано в ходе внутренних оценок, проведенных компанией Anthropic.
Линейная регрессия позволяет прогнозировать значения с помощью весов и смещения. Такие методы, как SGD и L-BFGS, различаются по тому, как они обрабатывают сложные данные.
Компания Liquid AI выпустила LFM2.5-8B-A1B — разреженную модель MoE для вызова инструментов на устройстве. Она улучшает способность к логическому мышлению и демонстрирует впечатляющие результаты в тестах по сравнению с предыдущей версией.
Робототехника развивается: исследовательский центр NVIDIA Research демонстрирует технологию переноса результатов моделирования в реальные условия, позволяющую роботам адаптироваться и надежно работать в динамичных средах. Среди инноваций — координация действий нескольких манипуляторов с помощью ScheduleStream и набора правил COMPASS для различных типов роботов, что обеспечивает значительное по...
Оценка агентов становится более эффективной благодаря сочетанию онлайн-сигналов со стабильными офлайн-эталонными значениями. Amazon Bedrock AgentCore поддерживает использование тестовых наборов с версионным управлением, что обеспечивает согласованность и проверяемость результатов измерений при доработке агентов. Наборы данных с версионным управлением служат в качестве эталонных значений, благо...