Исследователь из Массачусетского технологического института (MIT) Коннор Коули использует искусственный интеллект для выявления потенциальных низкомолекулярных лекарственных препаратов из огромного множества возможных соединений, сочетая в своей работе достижения химической инженерии и информатики. В своей работе Коули объединяет методы машинного обучения и хемоинформатики с целью оптимизации ...
Использование модели StackingRegressor с несколькими базовыми моделями для прогнозирования может оказаться чрезмерно сложной задачей из-за огромного количества задействованных параметров. Демонстрация, в которой модель StackingRegressor применялась к набору данных по диабету, продемонстрировала сложности, связанные с точным прогнозированием целевого значения уровня сахара у пациентов.
Компания Google представила модель Gemini 3.5 Flash на конференции Google I/O в мае 2026 года, превзойдя предыдущий премиальный уровень благодаря более высокой скорости и сниженной стоимости. Gemini 3.5 Flash демонстрирует отличные результаты в области программирования, выполнении задач, надежности использования инструментов и понимании мультимодальных данных, обеспечивая более быструю обработк...
Команда Qwen компании Alibaba усовершенствовала систему синхронного перевода с помощью Qwen3.5-LiveTranslate-Flash, сократив задержку до 2,8 секунд и расширив языковой охват до 60 языков. Среди инновационных функций — клонирование голоса в режиме реального времени и использование визуальных данных в качестве полноценного источника входных данных для повышения точности перевода.
Kiro CLI теперь предлагает расширенную функцию запоминания контекста благодаря интеграции с Amazon Bedrock AgentCore Memory. Настраиваемый сервер MCP обеспечивает сохранение контекста и персонализированный подход к пользователям в разных сеансах.
Amazon SageMaker Feature Store предлагает новые возможности, в том числе интеграцию с Lake Formation и свойства таблиц Iceberg. Это помогает организациям оптимизировать контроль доступа и сократить расходы на хранение моделей машинного обучения.
Программный вызов инструментов (PTC) сокращает задержки и снижает потребление токенов, позволяя крупным языковым моделям писать код, который программно вызывает несколько инструментов в изолированной среде выполнения. PTC эффективно применяется для обработки данных, численных вычислений, оркестрации процессов и задач, требующих соблюдения конфиденциальности
Узнайте, как настроить Amazon Nova для задач модерации контента с использованием структурированных и свободных подсказок. Проведите сравнительный анализ Amazon Nova 2 Lite и базовых моделей на общедоступных наборах данных с помощью стандарта оценки MLCommons AILuminate.
Технология MemPrivacy, разработанная MemTensor, HONOR Device и Университетом Тунцзи, заменяет конфиденциальные данные пользователей структурированными токенами, обеспечивая защиту конфиденциальности при управлении памятью в облаке без ущерба для функциональности или качества отклика. Эта локальная обратимая система псевдонимизации гарантирует семантически неискаженное взаимодействие при одновр...
Языковые модели сталкиваются с проблемами оптимизации из-за неравномерного распределения токенов. Адаптивная оптимизация Adam позволяет редким токенам обучаться быстрее, чем при использовании стандартного алгоритма SGD.
Amazon Bedrock AgentCore Evaluations предлагает настраиваемые оценочные алгоритмы на основе собственного кода для оценки агентных приложений в таких специализированных областях, как финансовые услуги. Эти алгоритмы обеспечивают контроль над логикой подсчета баллов, что позволяет проводить индивидуальную оценку качества агентов и легко интегрировать их в рабочие процессы разработки.
Регрессия AdaBoost использует деревья решений, обученные на взвешенных данных, для повышения точности прогнозов. Результаты показывают переобучение: высокая точность на обучающих данных, но более низкая точность на невиданных тестовых данных.
Компания NVIDIA представляет NVFP4 для обучения с использованием 4-битной плавающей запятой, достигая точности 62,58 % на модели Mamba-Transformer и превосходя базовые показатели FP8. NVFP4 оптимизирует динамический диапазон и точность, обеспечивая ускорение выполнения операций GEMM в 2–3 раза по сравнению с FP8 на тензорных ядрах Blackwell.
Aderant оптимизирует работу службы поддержки с помощью Amazon Quick, сократив время поиска на 90 % и ускорив подготовку документации на 75 %. Функции на базе искусственного интеллекта объединяют поиск по шести системам, что позволяет инженерам обеспечивать более быструю и оперативную поддержку.
Технология SANA-WM от NVIDIA решает задачи синтеза видео с помощью модели DiT, содержащей 2,6 млрд параметров, что позволяет генерировать высококачественное изображение с разрешением 720p в режиме реального времени на одном графическом процессоре. К ключевым особенностям относятся механизм внимания Gated DeltaNet и управление камерой с двумя ветвями для точного отслеживания траектории при моде...