Amazon Nova Forge позволяет пользователям создавать собственные языковые модели, объединяя проприетарные данные с отобранными наборами данных. Это предотвращает потерю информации и улучшает производительность в конкретных областях применения, не ухудшая общие возможности. Этот инструмент помогает решать сложные задачи настройки гиперпараметров для задач, специфичных для определенной области, из...
Команда Qwen компании Alibaba выпустила на платформе Bailian версию Qwen3.7-Plus — мультимодальную крупномасштабную языковую модель, способную понимать изображения и видео. Модель ориентирована на такие агентные функции, как глубокое рассуждение и самопрограммирование, и призвана не просто давать ответы, а действовать.
Компания JetBrains выпустила Mellum2, специализированную модель искусственного интеллекта для разработки программного обеспечения, содержащую 12 миллиардов параметров. Она использует архитектуру "смеси экспертов" и проходит обширные этапы предварительного и последующего обучения для решения различных задач.
Компания TinyFish представляет BigSet — многоагентную систему с открытым исходным кодом, предназначенную для создания структурированных наборов данных на основе оперативных веб-данных с использованием ввода на естественном языке. BigSet автоматизирует вывод схем, сбор данных и удаление дубликатов, а также обеспечивает плановое обновление наборов данных для обеспечения их актуальности.
Демонстрационная модель линейной регрессии демонстрирует точность 46 % на обучающих данных, превосходя базовые прогнозы. Журнал «Galaxy Science Fiction», известный своими потрясающими обложками, публиковал работы известного художника-космографа Чесли Бонестелла.
Платформа Amazon Bedrock AgentCore, реализованная в партнерстве с Coinbase и Stripe, позволяет агентам получать доступ к платным ресурсам от имени конечных пользователей. Проблемы безопасности, такие как неконтролируемые расходы и отсутствие согласия конечных пользователей, решаются за счет установления лимитов расходов и требования явного разрешения на проведение транзакций.
Amazon Bedrock теперь предлагает модели GPT-5.5, GPT-5.4 и Codex для производственных ИИ-приложений. GPT-5.5 отлично справляется с программированием и интеллектуальной работой, демонстрируя улучшенную способность выполнять многоэтапные задачи и повышенную автономность.
Развертывание крупных языковых моделей на инстансах AWS с графическими процессорами может занимать много времени, однако Amazon FSx for Lustre и NVIDIA GPUDirect Storage позволяют значительно сократить время загрузки с нескольких минут до нескольких секунд. Благодаря новой архитектуре NVIDIA Blackwell серверы AWS P6e UltraServer обеспечивают огромную вычислительную мощность для масштабного обу...
В новой статье представлена система Parallax — параметризованная версия алгоритма Local Linear Attention для трансформеров, которая повышает эффективность без ущерба для вычислительной мощности. В Parallax линейный решатель, используемый в LLA, заменен обученной матрицей проекции, что упрощает алгоритм, повышает его эффективность и облегчает реализацию.
На конференции GTC Taipei компания NVIDIA представила ПК серии RTX Spark для персональных агентов, оснащенные новыми вычислительными и памятью для искусственного интеллекта. Благодаря партнерству с Microsoft в Windows появились безопасные локальные агенты, а также были выпущены обновления для Hermes Agent и OpenClaw.
Регрессия с ядром (KRR) и регрессия на опорных векторах (SVR) — это методы машинного обучения, которые можно объединить для построения разреженной модели KRR, аппроксимирующей модель SVR. Этот гибридный подход сочетает в себе преимущества KRR в обработке больших наборов данных и эффективность SVR в хранении моделей, демонстрируя высокую точность прогнозирования в демонстрационном примере с исп...
Компания Genesis AI выпустила Genesis World 1.0, включающий в себя Nyx, Quadrants и интерфейс моделирования, предназначенный для ускорения разработки моделей робототехники с помощью симуляции. Оценка, занимающая менее 0,5 часа, дает результаты с битовой точностью, демонстрируя корреляцию 0,8996 между результатами моделирования и результатами внедрения на аппаратном обеспечении.
Метод дистилляции знаний позволяет переносить «скрытые знания» из больших моделей в малые с помощью позиционной KL-дивергенции. Технология X-Token от NVIDIA устраняет недостатки межтокенной дистилляции знаний, предлагая более эффективный и результативный подход, основанный на выравнивании интервалов и использовании дополнительных формулировок потерь.
Hermes Agent от Nous Research представляет функцию Tool Search, призванную устранить узкие места в системах ИИ-агентов, вызванные чрезмерным количеством инструментов MCP. Tool Search оптимизирует загрузку инструментов, повышая точность и сокращая затраты; значительное повышение точности было продемонстрировано в ходе внутренних оценок, проведенных компанией Anthropic.
Развертывание крупных языковых моделей (LLM) в среде Amazon SageMaker AI Inference требует комплексной системы мониторинга, позволяющей отслеживать как состояние инфраструктуры, так и качество работы LLM. Отслеживание таких показателей, как задержка, количество ошибок и точность ответов, имеет решающее значение для оптимизации затрат, производительности и качества результатов в долгосрочной пе...