Компанія Stability AI випустила Stable Audio 3 з відкритими вагами та технічним документом. Моделі латентної дифузії підтримують вихідні дані змінної довжини та редагування на основі відновлення пропущених фрагментів для генерації стереоаудіо.
Розробка функції обернення матриці з використанням розкладу Холеського: коротший код проти більшої ефективності. Аналітика в галузі розробки програмного забезпечення з використанням коду, згенерованого штучним інтелектом, та дизайн персонажів в анімаційних фільмах.
Кеш KV є значною статтею витрат при обслуговуванні великих мовних моделей (LLM); його стиснення за допомогою квантування на основі обертань, реалізованого в OSCAR, підвищує ефективність при точності INT2. OSCAR обчислює обертання на основі статистичних даних уваги, щоб зменшити похибки квантування, покращуючи якість уваги та продуктивність моделі.
Компанія NVIDIA представляє модель Gated DeltaNet-2 з лінійною увагою для покращення редагування пам'яті. Модель оснащена двома каналними шлюзами, що забезпечує їй кращі результати порівняно з попередніми моделями в дослідницьких тестах.
У новому дослідженні команди Nous представлено модель CNA, яка дозволяє точно визначити нейрони MLP, відповідальні за «шлюзи відхилення» в моделях, що навчаються на інструкціях. Видалення лише 0,1 % активацій MLP знижує рівень відхилень більш ніж на 50 % без погіршення якості вихідних даних.
Інструмент Bumblebee від Perplexity сканує комп'ютери розробників на наявність вразливих пакетів, розширень та конфігурацій інструментів штучного інтелекту. Він заповнює прогалину в існуючих інструментах, перевіряючи стан локальних систем розробників на наявність потенційних ризиків безпеки.
Лабораторія AI Frontiers компанії Microsoft Research випустила Fara1.5 — сімейство моделей комп'ютерних агентів для веб-браузерів, інтегрованих із MagenticLite. Модель Fara1.5-27B демонструє 72% успішності виконання завдань на наборі даних Online-Mind2Web, випереджаючи таких конкурентів, як Operator від OpenAI та Gemini 2.5 від Google.
Для регресорів нейронних мереж, що працюють з категоріальними даними, слід використовувати кодування «one-hot»; кодування «drop-first» є зайвим і дещо менш ефективним. Результати демонстрації не дають підстав розглядати можливість використання кодування «drop-first» для нейронних мереж, що підтверджує переваги кодування «one-hot».
Ізотонічна регресія — це складний метод машинного навчання. Автор висвітлює поширені помилки та демонструє приклад на практиці з використанням scikit-learn.
Lance від ByteDance об'єднує в одній моделі функції розпізнавання, генерації та редагування зображень і відео, що є важливою віхою в архітектурі штучного інтелекту. Lance об'єднує всю екосистему роботи із зображеннями та відео, виконуючи завдання від створення підписів до багатоетапного редагування з дотриманням стилістичної узгодженості в обох модальностях.
Інженер на місці (FDE) працює безпосередньо з клієнтами, пишучи реальний код для виробничих систем. Модель FDE від Palantir кидає виклик традиційним SaaS-рішенням у сфері впровадження складних систем штучного інтелекту.
Amazon Nova Act, що тепер відповідає вимогам HIPAA, автоматизує робочі процеси в галузі охорони здоров’я за допомогою штучного інтелекту, зменшуючи обсяг ручної роботи для організацій, що надають медичні послуги. Ця система інтегрується із зовнішніми інструментами, здійснює навігацію веб-сайтами та виконує багатоетапні робочі процеси, підвищуючи ефективність та забезпечуючи дотримання норматив...
Компанія NVIDIA відзначилася на виставці COMPUTEX 2026: її суперкомп’ютер на базі штучного інтелекту Vera Rubin NVL72 та платформа Jetson Thor отримали найвищі нагороди. Vera Rubin NVL72 встановлює нові стандарти масштабованості та екологічності в галузі штучного інтелекту, забезпечуючи виняткову продуктивність та економічну ефективність для автономних додатків на базі штучного інтелекту.
Command A+ від Cohere — це модель MoE з відкритим кодом, оптимізована для агентських робочих процесів, яка поєднує в собі можливості чотирьох попередніх моделей. Завдяки трьом доступним варіантам квантування Command A+ демонструє значне підвищення продуктивності порівняно з попередніми моделями Command A при виконанні різних корпоративних завдань.
Alibaba представляє Qwen3.7-Max для виконання автономних багатоетапних завдань. Qwen3.7-Max пропонує режим розширеного мислення з контекстним вікном розміром 1 млн токенів, що підвищує можливості міркування.