TGScope
Settings
Theme
TopicGPU & AI chipsSeptember 2026

GPU & AI chips — September 2026

What Telegram channels wrote about GPU & AI chips in September 2026: 839 posts from 474 channels, collected automatically from public Telegram channels.

839 posts·474 channels

More posts — page 30

839 posts total

Когда деньги упрутся в физику Пока деньги побеждают, мы покупаем всё больше интеллекта вычислениями. Но никто не знает, где здесь предел. Если бы в освоение космоса вкладывали столько же, сколько сегодня вкладывают в ИИ, весьма возможно, человек уже был бы на Марсе. Но чтобы отправиться намного дальше, недостаточно просто купить ещё топлива. Деньги не отменяют уравнение Циолковского: дополнительное топливо тоже приходится разгонять - а для этого нужно ещё топливо. И возможно, с ИИ происходит нечто похожее. Мы научились покупать всё больше интеллекта вычислениями - но пока не знаем, где закончится власть денег и начнётся власть физики.

Авторы нового интересного препринта «Как развивался искусственный интеллект за 70 лет» обращают внимание на разительный разрыв. Объёмы вычислений, используемых для обучения ИИ, сейчас ежегодно растут в 4 - 5 раз, тогда как сама аппаратная база развивается по гораздо более медленной, муровской траектории - порядка удвоения за два года. Этот разрыв уже невозможно объяснить одним только прогрессом железа: значительная его часть покупается инвестициями. Тогда может статься, что нынешняя революция ИИ - это не новый двигатель, а прежде всего очень много топлива. И хотя этот путь пока работает блестяще, никто не знает, сколько ещё прогресса можно купить таким способом. Купить ещё и ещё вычислений, GPU, дата-центров и электричества можно - были бы деньги. Но физические ограничения нельзя отменить даже триллионным чеком.

Так сколько ещё интеллекта можно купить деньгами - прежде чем деньги упрутся в физику? Полагаю, что раздумья над этим вопросом уже не дают спать не только Маску, Альтману и Амодеи, но и крупнейшим инвесторам.

Потому что от ответа зависит очень многое: продолжаем ли мы покупать всё больше интеллекта - или приближаемся к точке, где для следующего скачка понадобится уже не больше денег, а новый двигатель.   ИИгонка

❤️Игровой компьютер: R5-5600/RTX 3060ti 8GB/16GB/512GB Характеристики: Процессoр (СРU): AMD Ryzen 5 5600 Материнская плата: Gigabyte B550MK Видеокарта (GРU): ASUS RTX 3060ti 8GB Оперативная память (ОЗУ): DDR4 Cusu 16GB (8x2) 3.200MHZ Твердотельный накопитель: SSD m2 512GB Корпус: Ocypus C50 Блок питания: HSPD 600w 80+BRONZE

Гарантия от нашего магазина 6 месяцев.

Цена - 70,000₽

Наш контакт: @PTSMANAGER

(Написать клик)

🔮 А вот и началась эра AGI. OpenAI выкатили GPT-6 Astra.

OpenAI скормили модель кластеру из 100 000 GPU. Причем предыдущие модели (GPT-5.5/5.6) работали надсмотрщиками, контролируя процесс обучения. На бенчмарке ARC-AGI-3 (который долго считался непроходимым) Astra выбила 98.6%.

Кибербезу привет... оно взламывает системы. В закрытых тестах Astra достигла порога Critical. Она пишет рабочие эксплойты для защищенных ОС и браузеров. На хакерском бенчмарке ExploitBench модель выбила 100%. Но доступ к хакерскому ядру модели дадут только избранному кругу безопасников ⌨️

Главный научный сотрудник OpenAI Якуб Пахоцки пояснил, что модель стала настолько умной, что скрывает ход своих рассуждений от разрабов, если ее пытаются тестировать на обход контроля.

Будет ли ответка от Гигачата и Алисы 😬

Типичный 🥸 Сисадмин

Sep 4, 11:24 AMMore from @sysodmins

❤️Игровой компьютер: R7-9800X3D/RTX 5070ti 16GB/32GB/1TB Характеристики: Процессoр (СРU): AMD Ryzen 7 9800X3D Материнская плата: Gigabyte B850M AORUS ELITE Видеокарта (GРU): Gigabyte RTX 5070ti Aero 16GB Оперативная память (ОЗУ): DDR5 Kingbank 32GB (16x2) 6.400MHZ Твердотельный накопитель: SSD M2 Kingston NV3 1TB Корпус: MSI Блок питания: 1STPLAYER NGDP 750w 80+GOLD

Гарантия от нашего магазина 12 месяцев.

Цена - 290,000₽

Наш контакт: @PTSMANAGER

(Написать клик)

Энтузиасты запустили нейросетевой рендеринг DLSS 5 на видеокартах AMD. Это стало возможно благодаря проекту DLSS-NR on AMD от разработчика danielblnc, который адаптировал библиотеки NVIDIA под архитектуру RDNA 4.

Первые тесты утилиты провел блогер Ancient Gameplays на Radeon RX 9070XT в Cyberpunk 2077. Картинка с нейронной обработкой успешно сгенерировалась, однако активация опции провалила кадровую частоту с 86 до 12 fps. Автор модификации уже выпустил патч, повысивший производительность на 12%, и продолжает оптимизацию алгоритмов

Sep 4, 11:11 AMMore from @prohitec

Новая эра облачных услуг: от аренды серверов к управлению ИИ-инфраструктурой.

▶️ Российский облачный рынок переживает структурный сдвиг, сопоставимый с переходом от физических серверов к виртуализации. Наряду с классической IaaS стремительно набирает вес AI‑IaaS - инфраструктура, заточенная под обучение, дообучение и эксплуатацию ИИ‑моделей.

Как отмечает директор по развитию бизнеса сервис-провайдера M1Cloud Владимир Лебедев, в традиционном облаке объектами выступают виртуальные машины и хранилища, а в AI‑IaaS к ним добавляются поведение модели, происхождение данных, промпты, векторные индексы, GPU‑кластеры и действия подключенных инструментов.

Что будет дальше?

По оценкам аналитиков M1Cloud, до 2030 года среднегодовой темп роста облачного рынка в России составит 25-32%. Этот прогноз учитывает как миграцию нагрузок с зарубежных платформ, так и активное внедрение ИИ-проектов в госсекторе, финансовой сфере, промышленности и телекоме.

Прогноз M1Cloud до 2030 года (доля AI‑IaaS в общем облачном рынке):

⏺️ 2026 — 12–15% (18–22 млрд рублей) — пилоты, RAG, чат‑боты ⏺️ 2027 — 22–27% (38–48 млрд рублей) — промышленная эксплуатация в банках, страховании, госсекторе ⏺️ 2028 — 33–38% (62–78 млрд рублей) — массовое дообучение на корпоративных данных, AI‑Firewall как стандарт ⏺️ 2029 — 42–48% (95–115 млрд рублей) — мультиагентные системы, модели инициируют действия в CRM/ERP ⏺️ 2030 — 50–55% (130–160 млрд рублей) — AI‑IaaS становится базовым слоем ИТ‑архитектуры

К 2030 году рынок перейдёт от парадигмы «аренда серверов» к парадигме «управление цепочкой принятия решений модели». Стратегическое окно для российских игроков - 2026-2028 годы; после этого архитектуру определят те, кто первым встроит безопасность, суверенитет и наблюдаемость в ИИ‑инфраструктуру.

™️ МашТех в Telegram | в MAX

Sep 4, 10:31 AMMore from @mash_tech

Привет, друзья! NVIDIA выпустила бесплатный инструмент, который может превратить компьютеры в вашем доме в единую общую ИИ-систему

Он называется PAIR (Personal AI Router — «персональный AI-маршрутизатор») и объединяет совместимые ПК, Mac и системы NVIDIA в одной локальной сети, чтобы они могли делить свободные вычислительные мощности и запускать AI-модели и агентов сразу на нескольких устройствах. Вместо того чтобы зависеть от одного компьютера или отправлять всё в облако, PAIR распределяет ИИ-задачи между уже имеющимся у вас оборудованием.

Ваши запросы, файлы и данные агентов могут оставаться в локальной сети, при этом устройства могут подключаться и отключаться, а PAIR перераспределяет работу между доступными машинами.

Инструмент поддерживает видеокарты GeForce RTX 20-й серии и новее, системы DGX Spark, а также Mac с чипами M4 и новее, и работает на Windows, Linux и macOS.

Бета-версия бесплатна и с открытым исходным кодом, что даёт людям возможность собрать свою небольшую локальную AI-систему из оборудования, которое у них, возможно, уже есть.

#полезное

NVIDIA офіційно підтвердила, що DLSS 5, яка дебютувала в NBA 2K27, згодом стане доступною для власників відеокарт серії RTX 40 серії.

Наразі компанія зосереджена на оптимізації цієї вимогливої ШІ-моделі для архітектури RTX 50, тому повноцінна підтримка попередньої лінійки з'явиться після завершення всіх тонких налаштувань, повідомляє ресурс wccftech.

З моменту анонсу розробникам вже вдалося підвищити продуктивність моделі в 5 разів. Мета NVIDIA — прискорити алгоритми у 7–10 разів порівняно з ранніми тестами. Це дозволить суттєво зменшити навантаження на систему, знизивши втрату кадрів із нинішніх 50-60% до непомітних 10-15%.

Така оптимізація критично важлива для архітектури Ada Lovelace (RTX 40), яка не має підтримки новітніх апаратних блоків генерації кадрів (MFG).

Через ці апаратні обмеження алгоритм офіційно адаптують для RTX 40 лише тоді, коли він стане достатньо швидким і легким. Проте ентузіасти вже не чекають на реліз від розробників: за допомогою неофіційних модифікацій геймерам вдалося запустити DLSS 5 навіть на старіших відеокартах серій RTX 20 та 30.

Sep 4, 09:34 AMMore from @xgtv1

🏍ИИ взломает GTA 6 на ПК открытые нейросети научились взламывать софт за полчаса

Взлом коммерческого ПО и разбор защитных механизмов стремительно перестают быть уделом узкой касты специалистов по низкоуровневой отладке. Свежий эксперимент редакции XDA показал, что современные открытые языковые модели способны вскрывать лицензионные алгоритмы прямо на домашней рабочей станции - без гигантских серверных кластеров, облачных API и вездесущей корпоративной цензуры.

🔍Для теста взяли открытую модель Qwen 3.8 27B и скормили ей бинарник защищенного платного приложения со сложной привязкой к железу, проверкой цифровых подписей и реестром отозванных ключей. 🟥Нейросеть практически вслепую, даже не запуская программу, статически декомпилировала код, вытащила зашитые внутрь криптографические структуры и создала рабочий сценарий обхода защиты. 🟥В процессе генерации первая проверка подписи провалилась, но ИИ сам заметил расхождение в контрольных суммах, исправил ошибку и побайтно подогнал недостающие параметры, доведя взлом до финала всего за 30 минут.

⚡️Главный сдвиг кроется в полной автономности процесса. Локальные модели больше не скованы фильтрами бигтеха и не сливают исследуемый софт на чужие серверы, превращая видеокарту на обычном ПК в карманного реверс-инженера. Разработчикам систем лицензирования пора привыкать к новой реальности: на обход многомесячной работы их ИБ-отделов злоумышленникам теперь нужна лишь чашка кофе и пара промптов в локальной консоли.

© Тень Франклина

▶️ Чипы по подписке.

Тут PwC вместе с Oxford Economics вышли с интересным тезисом про то, что вычислительные мощности, в части инфраструктуры, могут в будущем поставляться по подписке. Дело в том, что решения стали требовать замены раз в 3-5 лет. Забавно, что это происходит на фоне замедления закона Мура.

Доля ИТ-оборудования в структуре капвложений вырастет с 70% в 2026 году до 93% к 2050, а каждый доллар, вложенный в стройку, тянет за собой еще около $12 будущих трат на серверы и GPU. Ожидается, что САРЕХ будет расти с $800 млрд в 2026 году до $1,1 трлн к 2030 и $1,8 трлн к 2050.

Спрос формируют не только гиперскейлеры, но и неоклауды, разработчики моделей, инференс-платформы, корпорации и государства. Около 30% нагрузок уже привязаны к конкретной юрисдикции по требованиям задержки, приватности и суверенности.

Если посмотреть на карту, то распределение будет примерно такое. Америка сформирует $16,5 трлн, из них $15,1 трлн – США. Это 48% мирового рынка. Азиатско-Тихоокеанский регион – $8,2 трлн. Европа отстает от своей доли в мировом ВВП с результатом $5,6 трлн из-за нехватки энергии и разрозненного регулирования. Так, например, Амстердам еще в 2025 году запретил новые дата-центры из-за лимитов сети. Ближний Восток – $1,1 трлн, но самый быстрый темп роста. Африка – скромные $255 млрд.

От себя отметим, что не в цифрах дело. PwC красиво рисует половину рынка в США, но траты не значит эффективность. Почитайте о разнице подходов Китая и США к инфраструктуре и многое станет понятно.

☎️ Телекоммуналка в Telegram | в MAX

❣️ Team Lead в команду ML-инфраструктуры R&D

Мы создаём инфраструктуру для обучения и дообучения больших языковых (LLM) и визуально-языковых (VLM) моделей. Наша задача — сделать систему максимально эффективной: рационально использовать вычислительные ресурсы и снижать риски сбоев. Всё более востребованным становится обучение с подкреплением (Reinforcement Learning, RL) — появляется необходимость создания специализированной инфраструктуры.

Какие задачи вас ждут:

• Оптимизация инфраструктуры RL-обучения Вы будете оптимизировать доставку и сохранение данных, коммуникации между блоками обучения; повышать эффективность работы внутри блоков.

• Развитие инструментов диагностики Вам предстоит создавать и улучшать инструменты, чтобы быстро находить и решать инфраструктурные проблемы.

• Обеспечение отказоустойчивости инфраструктуры Вы будете реализовывать подходы, которые сделают инфраструктуру обучения устойчивой к ошибкам и сбоям.

• Исследование решений Вам предстоит изучать новейшие подходы к организации инфраструктуры RL-обучения, оценивать их эффективность, внедрять в реальные проекты.

Мы ждём, что вы: • Знаете Python и работали в системном программировании, разработке библиотек или фреймворков • Умеете работать с PyTorch и распределённым обучением через torch.distributed • Владеете подходами параллелизации • Интересуетесь LLM и MLOps • Можете эффективно работать в команде

Будет плюсом, если вы: • Участвовали в создании инфраструктуры обучения ML-моделей • Внедряли и оптимизировали RL-решения • Использовали библиотеки RL-обучения для LLM и библиотеки инференса • Работали с GPU NVIDIA: понимаете архитектуру GPU, разрабатывали или оптимизировали алгоритмы с использованием CUDA или Triton • Владеете C++, работали с низкоуровневым программированием и оптимизацией

Почему у нас хорошо: Нам важно здоровье сотрудников, поэтому в крупных офисах у нас есть спортзалы — с тренажёрами, инвентарём и душевыми. Это не все бонусы — полный список тут.

📩 Откликайтесь на вакансию на нашем сайте

#генеративные_технологии #ML #LLM #VLM #python #pytorch

Sep 4, 09:03 AMMore from @ya_jobs

📌 PC Case Case PC DeepCool CH160 PLUS WH Micro ATX Mini-ITX Bianca SFF

✅ https://tidd.ly/4vOEgt0

💰 57,63€ 🚚 PcComponentes

📎 Case MicroATX/ITX meshato! Con supporto a GPU 3-slot da 342mm, dissipatori CPU da 164mm e aio fino a 240mm, PSU ATX fino a 140mm e con maniglia per il trasporto!

▶️ @VereOfferteTech #affiliate

⌨️Ноутбук Lenovo Legion Slim з 8-ядерним процесором для роботи та відеокартою на 6 гб для розваг!

✅Гарантія 6 місяців 🏦🏦🏦 оплата частинами

Характеристики: 🟦Windows 11 🧩Діагональ: 16 FullHD IPS 144Hz 🧩Процесор: Intel Core i5-12450H 🧩Оперативна пам’ять: 16gb ddr5 5600mhz 🧩Відеокарта: NVIDIA GeForce RTX 4050 6gb + Intel UHD Graphics 🧩Накопичувач: SSD NVME 512gb 🔋Акумулятори: 96% здоровʼя Код 12178

✅Ціна 39500грн💸

Телефон📲+380975202515 🌐KTROOM.COM.UA / НАПИСАТИ ❌Продано

Sep 4, 08:57 AMMore from @ktroom

#senior #удаленка

Top Selection AI-разработчик (Python, C++) Полная занятость Формат работы: удалённо

IT-кадровое агентство Top Selection ищет AI-разработчика. Проект: внедрение обученных моделей в закрытый контур экосистемы компании на частных серверах, адаптация AI-алгоритмов для защищённых мобильных устройств.

☑️ Чем предстоит заниматься -Внедрение обученных моделей в закрытый контур экосистемы компании (на частных серверах) с обеспечением автономной работы и защиты от внешних воздействий -Адаптация и оптимизация AI-алгоритмов для эксплуатации на защищённых мобильных устройствах — с учётом ограниченных вычислительных ресурсов и минимизации энергопотребления

☑️ Наши пожелания к кандидатам -Знание архитектур нейросетей (Transformer, CNN, RNN, GAN, Diffusion) -Владение методами обучения моделей с нуля и дообучения (fine-tune) существующих решений -Опыт работы с фреймворками PyTorch, TensorFlow, JAX -Навыки написания кода для инференса и развёртывания моделей в продакшн-среде -Понимание принципов оптимизации: градиентный спуск, функции потерь, регуляризация -Уверенное владение языками программирования Python и C++ -Способность реализовать с нуля отдельные компоненты модели: например, механизм внимания или отдельный слой -Глубокое понимание внутренней логики работы моделей

Контакты: [email protected]

════════════ 👉 Лучший сервис для оплаты зарубежных подписок, вещей, услуг и всего остального ════════════

Sep 4, 08:52 AMMore from @job_pythonz

#senior #удаленка

Top Selection AI-разработчик (Python, C++) Полная занятость Формат работы: удалённо

IT-кадровое агентство Top Selection ищет AI-разработчика. Проект: внедрение обученных моделей в закрытый контур экосистемы компании на частных серверах, адаптация AI-алгоритмов для защищённых мобильных устройств.

☑️ Чем предстоит заниматься -Внедрение обученных моделей в закрытый контур экосистемы компании (на частных серверах) с обеспечением автономной работы и защиты от внешних воздействий -Адаптация и оптимизация AI-алгоритмов для эксплуатации на защищённых мобильных устройствах — с учётом ограниченных вычислительных ресурсов и минимизации энергопотребления

☑️ Наши пожелания к кандидатам -Знание архитектур нейросетей (Transformer, CNN, RNN, GAN, Diffusion) -Владение методами обучения моделей с нуля и дообучения (fine-tune) существующих решений -Опыт работы с фреймворками PyTorch, TensorFlow, JAX -Навыки написания кода для инференса и развёртывания моделей в продакшн-среде -Понимание принципов оптимизации: градиентный спуск, функции потерь, регуляризация -Уверенное владение языками программирования Python и C++ -Способность реализовать с нуля отдельные компоненты модели: например, механизм внимания или отдельный слой -Глубокое понимание внутренней логики работы моделей

Контакты: [email protected]

════════════ 👉 Лучший сервис для оплаты зарубежных подписок, вещей, услуг и всего остального ════════════

Principal AI/GenAI Engineer в Synopsys

● Локация: Ереван

● Задачи: Проектировать и внедрять GenAI и ML-системы для решения сложных бизнес-задач; давать техническое руководство младшим членам команды; следить за развитием AI-технологий в индустрии; сотрудничать с разными отделами по требованиям к решениям; заниматься подготовкой данных, обучением и оптимизацией моделей, продакшн-деплоем, документацией и соответствием этическим стандартам.

● Требования: Продвинутая степень (PhD или магистратура) в computer science, data science, электротехнике или смежной области; от 8 лет в разработке ПО, machine learning и GenAI с продакшн-опытом; уверенный Python; знание бэкенд-систем и распределённых вычислений — плюс; экспертиза в ML-фреймворках (TensorFlow, PyTorch, LangChain/LangGraph, AutoGen) и LLM-моделях; опыт с облачными платформами, контейнеризацией (Kubernetes, Docker) и системами контроля версий; статистический анализ и визуализация данных; знакомство с Agile. Сильный плюс — опыт с semiconductor IP и EDA-инструментами.

● Как откликнуться: заполнить форму на сайте

🟥🟦🟧 Synopsys ընկերության գլխավոր AI/GenAI ինժեներ

● Տեղակայություն՝ Երևան

● Պարտականություններ՝ Ծրագրավորման խորը ուսուցման (GenAI և ML) համակարգերի նախագծում և ներդրում բարդ բիզնես խնդիրներ լուծելու համար; տալ տեխնիկական ուղեցույց թիմի կրտսեր անդամներին; հետևել արդյունաբերության մեջ արհեստական բանականության տեխնոլոգիաների զարգացումներին; համագործակցել տարբեր բաժինների հետ լուծումների պահանջների շուրջ; իրականացնել տվյալների պատրաստում, մոդելների ուսուցում և օպտիմալացում, արտադրական ներդրում, փաստաթղթավորում և էթիկական ստանդարտների պահպանում։

● Պահանջներ՝ բարձրագույն կրթություն (PhD կամ մագիստրոս) համակարգչային գիտություններում, տվյալների գիտություններում, էլեկտրատեխնիկայում կամ հարակից ոլորտում; առնվազն 8 տարվա փորձ ծրագրային ապահովման մշակման, մեքենայական ուսուցման և GenAI ոլորտներում, ներառյալ արտադրական փորձը; Python-ի բարձր մակարդակի տիրապետում; ML-ֆրեյմվորքներում (TensorFlow, PyTorch, LangChain/LangGraph, AutoGen) և LLM մոդելներում փորձագիտություն; ամպային հարթակների, կոնտեյներացման և տարբերակների վերահսկման համակարգերի հետ աշխատանքի փորձ; ստատիստիկական վերլուծություն և տվյալների վիզուալիզացում; Agile մեթոդաբանության իմացություն։

● Ինչպես դիմել՝ լրացրեք կայքում տեղադրված ձևաթուղթը

#IT #AI

@bestjobinarmenia

⌨️Ноутбук Lenovo Ideapad Gaming 3 з чотириядерним процесором для роботи та відеокартою на 4 гб для геймінгу!

✅Гарний стан! ✅Гарантія 6 місяців 🏦🏦🏦 оплата частинами

Характеристики: 🟦Windows 11 🧩Діагональ: 15.6 FullHD IPS 144Hz 🧩Процесор: Ryzen 5 5500H 🧩Оперативна пам’ять: 16gb ddr4 🧩Відеокарта: NVIDIA RTX 2050 4gb 🧩Накопичувач: SSD 512gb 🔋Акумулятори: 88% здоровʼя Код 12177

✅Ціна 25500грн💸

Телефон📲+380975202515 🌐KTROOM.COM.UA / НАПИСАТИ ❌Продано

Sep 4, 08:18 AMMore from @ktroom

#алматы #python

Computer Vision Engineer  AI Parking (aiparking.kz)  до 1 000 000 KZT / месяц (до вычета налогов)  Гибрид, Алматы · Full-time · испытательный срок 2 месяца AI Parking — платформа автоматизации парковок: распознавание номеров, камеры, шлагбаумы. Запускаем крупный проект: камеры следят за людьми. Обязанности: - Развивать и улучшать модели распознавания госномеров (ANPR/LPR): ночь, грязь, блики, угол, кириллица/латиница - Обрабатывать RTSP/IP-потоки в реальном времени - Снижать ошибки распознавания (сейчас до ~10% на части объектов) — FP/FN, путаница символов, ложные въезды/выезды - Собирать и размечать датасеты, чистить, аугментировать - Обучать и дообучать модели (PyTorch), оптимизировать инференс под edge/on-prem - Разрабатывать модели для видеонаблюдения за людьми: detection, tracking, action recognition - Работать с качеством на живых объектах, а не только на бенчмарках Требования: - Strong middle / senior - Сильный Python - PyTorch (TensorFlow — плюс) - CV: detection, tracking, OCR, classification - OpenCV, работа с видео и RTSP - Понимание обучения: loss, overfitting, augmentation, метрики - Опыт продакшн-инференса: latency, throughput, TensorRT/ONNX/OpenVINO — плюс - Опыт ANPR/LPR или OCR — сильный плюс - Опыт human detection / tracking / action recognition — плюс Будет плюсом: - Nomeroff-net, YOLO, PaddleOCR - Edge: NVIDIA Jetson / GPU-серверы Условия: - Подчинение тимлиду разработки - Техника от компании

Писать @dimekenn

Sep 4, 07:59 AMMore from @devkz_jobs

Perplexity разогнала локальный Qwen на Mac

Perplexity показала Lily, собственный движок для запуска Qwen3.6-35B-A3B прямо на Apple Silicon. Он написан специально под архитектуру модели и работает без PyTorch и MLX.

На MacBook Pro с M5 Max движок в среднем обрабатывает входной текст в 1,23 раза быстрее MLX-LM, а генерирует ответ в 1,35 раза быстрее. На контексте 4K скорость генерации достигает примерно 187 токенов в секунду.

Сам Qwen хранится в 4-битном виде и занимает около 19,4 ГБ. Lily оптимизирует работу с памятью, распределение экспертов и вычисления на GPU, что особенно важно для длинного контекста вплоть до 128K токенов.

Главное тут в другом. Большие модели на Mac уже упираются не только в мощность железа, но и в то, насколько хорошо движок заточен под конкретную модель и чип. Lily Perplexity планирует открыть в ближайшее время.

dailyprompts.ru

NVIDIA подтвердила появление DLSS 5 на видеокартах серии RTX 40

Компания NVIDIA официально заявила о планах добавить поддержку технологии DLSS 5 (3D-Guided Neural Rendering) на графические ускорители линейки GeForce RTX 40. Ранее технология позиционировалась как эксклюзив для серии RTX 50.

Sep 4, 07:28 AMMore from @prohitec

⚡️ AMD нацелилась на частоты 3,1-3,4 ГГц для RDNA 5

Инсайдер Kepler_L2 утверждает, что видел внутренние материалы AMD, где для графической архитектуры RDNA 5 указан целевой диапазон частот 3,1-3,4 ГГц. Пока неясно, относится ли он ко всей линейке или только к отдельным кристаллам.

Для сравнения, референсная Radeon RX 9070 XT имеет Boost до 2,97 ГГц, поэтому верхняя граница утечки примерно на 14% выше. Финальные частоты будут зависеть от конкретного GPU и лимитов мощности.

RDNA 5 также приписывают переработанные исполнительные блоки и изменения графического конвейера для повышения IPC, однако AMD эти детали официально не подтверждала.

Первые Radeon на RDNA 5 ожидаются не раньше 2027 года, точные сроки компания пока не объявляла.

#Аmd|#Видeoкарты

🟢 DLSS 5 офіційно вийшла — поки що лише в NBA 2K27

NVIDIA випустила DLSS 5 — нову технологію нейромережевого рендерингу. Вона стала доступною 4 вересня о 07:00 за київським часом разом із релізом NBA 2K27. На старті це єдина гра з офіційною підтримкою DLSS 5. Також технологія доступна в хмарному сервісі GeForce NOW Ultimate на серверах із GeForce RTX 5080.

DLSS 5 використовує 3D-Guided Neural Rendering як додатковий етап графічного конвеєра. Технологія аналізує готовий кадр, дані про рух, освітлення, матеріали та поверхні, після чого покращує: 🟡освітлення; 🟡тіні та контактне затінення; 🟡відбиття; 🟡деталізацію матеріалів; 🟡розсіювання світла на шкірі; 🟡проходження світла крізь волосся та рослинність.

Зараз DLSS 5 доступна лише на відеокартах GeForce RTX 50.

МАГАЗИН 🟡 ЗНИЖКА 🟡 ПІДТРИМКА

Sep 4, 07:04 AMMore from @hator_fan

OpenAI выпустила GPT-6 Astra

Что стало известно из официальной презентации:

- Брокман назвал модель возможным первым AGIA (искусственный интеллект общего назначения, способный выполнять большинство задач не хуже человека), но сам признал: чёткого критерия AGI нет. - Первая модель с «критическим» уровнем риска по кибербезопасности (по собственной шкале OpenAI) — влечёт доп. ограничения доступа. - Заявлено: 98,6% на ARC-AGI-3, высокий результат на эксплойт-бенче. Цифры от самой OpenAI, независимой проверки пока нет. - Обучена на 100 000+ GPU (Stargate, Техас) — крупнейший тренировочный запуск компании. - Работа с компьютером/браузером в демо — постановочная, по признанию самой OpenAI. - Доступ поэтапный: сначала Daybreak, затем в течение недели — платные подписки и API.

Ждете у себя в подписке?

Графика в iPhone 18 Pro может оказаться мощнее, чем в iPad Pro с процессором M4

Инсайдер с Weibo изучил расположение контактов процессора A20 Pro и сопоставил его со снимками кристалла.

По его данным, A20 Pro получит два производительных и четыре энергоэффективных ядра CPU, а также 7-ядерный GPU. Для сравнения, у A19 Pro используется шестиядерная графика.

https://www.iphones.ru/1386567

#новости@iphonesru

Sep 4, 05:55 AMMore from @iphonesru