AWS впроваджує функцію Cross-Region Inference (CRIS) у сервісі Amazon Bedrock, що дозволяє клієнтам розподіляти запити до генеративної ШІ між різними регіонами AWS, забезпечуючи необхідну пропускну здатність та безпеку. Профілі CRIS оптимізують пропускну здатність моделей, пропонуючи глобальні та європейські географічні зони, що дозволяє дотримуватися нормативних вимог та підвищити відмовостій...
Компанія NVIDIA представляє RTX Spark — суперчіп для ПК на базі Windows, що забезпечує покращений ігровий досвід завдяки технологіям штучного інтелекту та трасування променів. Співпраця з провідними корейськими розробниками ігор, зокрема KRAFTON та NC, спрямована на те, щоб зробити популярні ігри доступними для систем на базі RTX Spark, що викликає великий ажіотаж у ігровому співтоваристві.
Симпозіум SERC у Массачусетському технологічному інституті (MIT) був присвячений впливу штучного інтелекту на суспільство; у його рамках відбулися доповіді щодо прогнозування забруднення повітря та етичного впровадження штучного інтелекту. Під час панельних дискусій було розглянуто проблеми узгодження штучного інтелекту з людськими цінностями та управління системами штучного інтелекту.
Компанія NVIDIA представляє технологію Dynamo Snapshot для виконання завдань штучного інтелекту на платформі Kubernetes, що дозволяє зменшити затримку при першому запуску та покращити масштабованість під час пікових навантажень. Технології CRIU та cuda-checkpoint працюють разом для збереження стану GPU та CPU, забезпечуючи безперебійне відновлення та мінімальний час простою.
Досвідчений фахівець вважає перехресну валідацію в машинному навчанні неефективною через численні недоліки як у методі k-кратного поділу, так і в методі «залишити один випадок поза вибіркою». Відсутність узагальнюваності та ненадійність налаштування гіперпараметрів роблять перехресну валідацію справжньою головоломкою
Массачусетський технологічний інститут (MIT), Державний університет Джорджії та партнери запускають програму PATH, щоб забезпечити навчання у сфері штучного інтелекту для коледжів, орієнтоване на потреби промисловості, з акцентом на практичному навчанні та співпраці. Програма спрямована на формування практичних навичок та мислення у сфері штучного інтелекту у фахівців, готових до викликів майб...
Компанія NVIDIA представляє Nemotron 3 Ultra — модель із 550 мільярдами параметрів та гібридною архітектурою Mamba-Attention, яка забезпечує в 6 разів вищу пропускну здатність при інференції. Модель використовує алгоритм Multi-Token Prediction для прискорення генерації та забезпечує стабільне й точне навчання завдяки типу даних NVFP4.
Національний науковий фонд (NSF) продовжив фінансування проекту IAIFI Массачусетського технологічного інституту (MIT), зосередивши увагу на тому, як штучний інтелект сприяє розвитку фізики, а фізика — вдосконаленню штучного інтелекту. Спільні дослідження у сферах фізики та штучного інтелекту призводять до революційних відкриттів та інноваційних наукових підходів.
Компанія Miso Labs представляє MisoTTS — модель перетворення тексту в мову з 8 мільярдами параметрів, яка використовує алгоритм RVQ для розширення звукового діапазону та адаптації до інтонації мовця. Вирішуючи проблеми, пов’язані з розміром словника та обумовленням, MisoTTS забезпечує підтримку 2048³² токенів без додавання додаткових параметрів, перевершуючи конкурентів за показниками затримки.
Цього місяця GeForce NOW пропонує 18 нових ігор, серед яких довгоочікувана NTE: Neverness to Everness. Відкривайте для себе сюрреалістичні світи та класичні ремейки миттєво завдяки хмарному стримінгу — завантаження не потрібне.
Дослідники зі Стенфордського університету та компанії Lambda Labs розробили OpenJarvis – платформу для роботи на локальних пристроях, яка за ефективністю та швидкістю обробки конкурує з хмарними моделями. OpenJarvis забезпечує легке поєднання моделей, агентів і пам'яті, а також має унікальну систему пошуку оптимальних параметрів, керовану великою мовною моделлю (LLM).
Тод Мачовер, піонер у галузі музичних технологій з MIT Media Lab, отримав медаль Джорджа Пібоді за новаторську роботу в галузі штучного інтелекту та інтерактивної опери. Мачовер, якого називають музичним провидцем, розширює межі та можливості музики для всіх.
Компанія Google DeepMind випустила Gemma 4 12B — мультимодальну модель без енкодера для обробки тексту, зображень, аудіо та відео. Модель працює на ноутбуці з 16 ГБ оперативної пам’яті, заповнюючи прогалину між версіями для периферійних пристроїв та більш потужними варіантами; вагові матриці з відкритим кодом доступні для завантаження.
Під час тестування коду на наборі даних про діабет модель scikit SVR показала низьку точність прогнозування. Модель Kernel SVR перевершила лінійну модель SVR завдяки своїй потужності та масштабованості, що тісно пов’язано з алгоритмом KRR.
Штучний інтелект повинен підбирати відповідні інструменти для виконання завдань, щоб уникнути помилок і затримок. Дізнайтеся, як SFT і DPO підвищують точність виклику інструментів у мовних моделях для надійної автоматизації.