Новостная лента об искусственном интеллекте и машинном обучении

Главные новости и публикации каждый день! Будьте на шаг впереди: узнавайте первыми про новые идеи, тренды и инновации в сфере технологий

Amazon Bedrock: революция в системе обработки ошибок для Miro

Компания Miro в партнерстве с AWS разрабатывает BugManager — решение на базе искусственного интеллекта для автоматической классификации ошибок, позволяющее сократить количество перенаправлений и время устранения неполадок. BugManager использует оптимизированные подсказки и технологию RAG (Retrieval Augmented Generation) для повышения точности классификации ошибок.

Революционный трансформатор Byte Latent сокращает пропускную способность памяти вдвое!

Исследователи из Meta, Стэнфордского университета и Вашингтонского университета усовершенствовали модель Byte Latent Transformer с помощью трёх новых методов. BLT-D заменяет побайтовое декодирование блочным диффузионным подходом, что позволяет ускорить генерацию текста.

Раскрытие потенциала производственной аналитики с Amazon Nova

Мультимодальные вложения Amazon Nova кардинально меняют подход к поиску производственной документации, объединяя текст, изображения и диаграммы в единое векторное пространство. Эта система обеспечивает беспрепятственный поиск и извлечение информации из различных источников, повышая точность и эффективность работы в производственной отрасли.

Эффективный расчет псевдообратной матрицы на C#

Левая псевдообратная матрица широко используется в машинном обучении, тогда как правая псевдообратная матрица применяется редко, но оказывается полезной в научных задачах. Этот процесс включает в себя сложные алгоритмы и обращение матриц, причем основная сложность заключается в вычислении At A или A At.

Раскройте весь потенциал платформы Claude на AWS

Платформа Claude теперь доступна на AWS, что обеспечивает удобный доступ к функциям Anthropic с помощью привычных инструментов AWS. Клиенты могут использовать те же API, функции и систему расчетов, что и в Anthropic, — и все это в среде AWS.

TwELL: повышение скорости работы больших языковых моделей с помощью Sakana AI и NVIDIA CUDA

Исследователи из компаний Sakana AI и NVIDIA стремятся снизить высокую стоимость крупных языковых моделей, устраняя неэффективность в слоях прямого прохождения. Используя неструктурированную разреженность, они стремятся повысить эффективность вычислений в этих слоях, уделяя особое внимание пакетному обучению и высокопроизводительному выводу.

Использование Strands и Exa для работы веб-поисковых роботов

Интеграция Exa с Strands Agents SDK упрощает доступ ИИ-агентов к структурированному веб-контенту, что обеспечивает беспрепятственное принятие решений. Модельно-ориентированная архитектура Strands Agents SDK расширяет возможности агентов благодаря более чем 40 готовым инструментам и поддержке серверов MCP.

Освоение методов дистилляции моделей LLM

Такие компании, как Meta и Google, используют крупные языковые модели для обучения более компактных и эффективных моделей с помощью дистилляции LLM. Дистилляция с мягкими метками позволяет обучаемым моделям унаследовать способности к логическому мышлению от обучающих моделей, повышая стабильность и эффективность обучения.

Начало карьеры в эпоху революции в области искусственного интеллекта

Генеральный директор NVIDIA Дженсен Хуанг на выпускной церемонии в Университете Карнеги-Меллон подчеркнул, что сейчас начинается революция в области искусственного интеллекта. Искусственный интеллект дает Америке шанс на реиндустриализацию и создание возможностей для всех.

Раскрытие потенциала ИИ NVIDIA: модели логического вывода объёмом 30 млрд, 23 млрд и 12 млрд параметров в одной контрольной точке

Компания NVIDIA представляет Star Elastic — метод встраивания нескольких вложенных подмоделей в одну родительскую модель, позволяющий сократить затраты на обучение и развертывание крупных языковых моделей. Star Elastic использует оценку важности и обучаемые маршрутизаторы для создания вложенных вариантов с разными наборами параметров в рамках одной контрольной точки.

Революция в сейсмических рабочих процессах благодаря ИИ и Amazon Bedrock

Компания Halliburton в партнерстве с AWS разрабатывает виртуального помощника на базе искусственного интеллекта для платформы Seismic Engine, что позволяет сократить время на создание рабочих процессов почти на 95 %. Теперь геологи могут настраивать инструменты обработки данных с помощью естественного языка, что повышает эффективность и доступность работы.

Преобразование мыслей ИИ в человеческий язык

Новые автокодировщики естественного языка (NLA) от Anthropic преобразуют сложные активации моделей в удобочитаемый текст, раскрывая скрытые внутренние механизмы работы. NLA уже используются для выявления моделей, допускающих ошибки, и исправления языковых ошибок до публичного выпуска.

Эффективное масштабирование вывода: будущее адаптивного параллельного вывода

Последние достижения в области адаптивного параллельного вывода позволяют моделям самостоятельно разбивать задачи на подзадачи и координировать их выполнение, что приводит к улучшению способности к выводу и сокращению задержек при решении сложных задач. Теперь модели рассматривают альтернативные гипотезы и исправляют ошибки, формулируя выводы, не ограничиваясь одним единственным решением, что ...

Zyphra представляет мощную систему искусственного интеллекта на базе AMD: знакомьтесь, ZAYA1-8B!

Модель ZAYA1-8B от Zyphra AI, языковая модель с механизмом MoE и общим количеством параметров 8,4 млрд, превосходит более крупные модели в решении математических задач. Уникальная архитектура и инновационные решения ZAYA1-8B позволяют максимально повысить эффективность работы и снизить требования к объему памяти, благодаря чему модель может составить конкуренцию ведущим моделям.

«Заправляя будущее Америки»: миссия в области энергетики и инноваций

Министр энергетики США Крис Райт и вице-президент NVIDIA Иэн Бак утверждают, что лидерство США в области искусственного интеллекта зависит от развития энергетики, обращая особое внимание на программу «Генезис» Министерства энергетики США и партнерство с NVIDIA по созданию суперкомпьютеров для искусственного интеллекта в Аргоннской национальной лаборатории. Цель этого сотрудничества — содейство...