Стрічка новин про штучний інтелект і машинне навчання

Головні новини та публікації щодня! Будьте на крок попереду: дізнавайтеся першими про нові ідеї, тренди та інновації у сфері технологій

Революційний агент Hermes підвищує точність Opus 4 на 74%

Hermes Agent від Nous Research впроваджує функцію Tool Search для усунення вузьких місць у системах штучного інтелекту, спричинених надмірною кількістю інструментів MCP. Tool Search оптимізує завантаження інструментів, підвищуючи точність і знижуючи витрати; значне підвищення точності було продемонстровано під час внутрішніх оцінок, проведених компанією Anthropic.

SIA: Агент із самоудосконалення від Hexo Labs

Компанія Hexo Labs випустила SIA (Self-Improving AI) як фреймворк з відкритим кодом. SIA редагує як каркас агента, так і ваги моделі з метою постійного вдосконалення. Оновлення ваг підвищують ефективність у різних сферах, перевершуючи результати, досягнуті лише за рахунок редагування каркаса.

Максимізація продуктивності великої мови (LLM) на базі штучного інтелекту в Amazon SageMaker

Розгортання великих мовних моделей (LLM) на платформі Amazon SageMaker AI Inference вимагає комплексного контролю для моніторингу як стану інфраструктури, так і якості роботи LLM. Моніторинг таких показників, як затримка, кількість помилок і точність відповідей, має вирішальне значення для оптимізації витрат, продуктивності та якості результатів у довгостроковій перспективі.

Революційний крос-токенайзер X-Token домінує в рейтингу GOLD на моделі Llama-3.2-1B

Метод дистиляції знань забезпечує передачу «прихованої інформації» від великих моделей до малих за допомогою дивергенції KL для кожної позиції. Розробка NVIDIA під назвою X-Token усуває недоліки міжтокенізаторної дистиляції знань, пропонуючи більш ефективний та дієвий метод, що базується на вирівнюванні проміжків та додаткових формулюваннях втрат.

007 First Light: вихід на GeForce NOW

GeForce NOW запускає «007 First Light», пропонуючи користувачам історію походження Джеймса Бонда та безкоштовний елітний комплект одягу. Насолоджуйтесь високоякісними хмарними іграми з новими іграми та ексклюзивними нагородами, зокрема демоверсією Resident Evil Requiem.

Розшифрування коду: відсутні дані в машинному навчанні

Моделі машинного навчання прогнозують такі показники, як дохід, статева приналежність, вік, штат проживання та політичні погляди. Заповнення пропущених даних для прогнозування може призвести до оманливих результатів у машинному навчанні.

Подолання меж: революція в робототехніці від NVIDIA

Галузь робототехніки розвивається: дослідницький підрозділ NVIDIA Research демонструє технологію перенесення результатів моделювання в реальні умови, що дозволяє роботам адаптуватися та надійно працювати в динамічних середовищах. Серед інновацій — координація роботи декількох маніпуляторів за допомогою ScheduleStream та фреймворку політик COMPASS для різних типів роботів, що забезпечує значне ...

Управління масштабованими наборами тестів у Amazon Bedrock AgentCore

Оцінка агентів стає ефективнішою завдяки поєднанню онлайн-сигналів зі стабільними офлайн-базовими показниками. Amazon Bedrock AgentCore підтримує використання тестових наборів з версіями, що забезпечує послідовність та перевірюваність вимірювань для вдосконалення агентів. Набори даних з версіями слугують еталоном, завдяки чому результати оцінювання є значущими як для розробників, так і для кон...

Розширте можливості Amazon SageMaker MLflow за допомогою проксі-сервера REST API

Amazon SageMaker MLflow пропонує комплексні можливості відстеження експериментів у галузі машинного навчання та управління моделями. Підприємства можуть безпечно інтегрувати MLflow з існуючими системами за допомогою проксі-сервісу на базі Flask, що забезпечує відповідність вимогам та спрощує процес.

Навчання моделей азербайджанської мови за допомогою штучного інтелекту SageMaker

Компанія Azercell Telecom співпрацює з AWS над створенням великої мовної моделі (LLM) та чат-бота для Азербайджану, досягаючи значної оптимізації та вдосконалення. Платформа на базі Amazon SageMaker AI забезпечує вищу продуктивність навчання, меншу витрату пам’яті та подвоєну ємність для обробки тексту, надаючи аналітичні дані для роботи зі складними мовами.

Представляємо LFM2.5-8B-A1B: потужну модель MoE для використання на пристрої

Компанія Liquid AI випустила LFM2.5-8B-A1B — розріджену модель MoE для запуску інструментів безпосередньо на пристрої. Вона покращує здатність до міркування та демонструє вражаючі результати тестування порівняно з попередньою версією.

MIT відкриває квантовий центр

Массачусетський технологічний інститут (MIT) та штат Массачусетс створять Лабораторію квантових систем (QSL) з метою розвитку квантових досліджень та інновацій. QSL стане передовим науково-дослідним центром, що сприятиме розвитку революційних квантових технологій у різних сферах практичного застосування.

Незадовільні результати: регресія з градієнтним підсиленням на наборі даних про діабет

Відточуючи свої навички програмування, розробник тестує модель регресії з градієнтним підсиленням на наборі даних про діабет, демонструючи витончену техніку, що лежить в основі цієї ансамблевої моделі. Реалізуючи 100 дерев рішень на C#, розробник досліджує тонкий, але ефективний підхід до прогнозування залишків з метою підвищення точності.

ПРИМІТКА: Навчання спеціалізованої моделі пам’яті для засвоєння нових знань

Дослідники з Національного університету Сінгапуру та Массачусетського технологічного інституту (MIT) пропонують систему MEMO для оновлення великих мовних моделей (LLM) без втрати якості за допомогою використання окремих моделей пам'яті та міркування. Унікальний конвеєр навчання MEMO генерує різноманітні пари запитань-відповідей для засвоєння знань, необхідних для міркування на основі різних до...