TGScope
Settings
Theme
TopicGPU & AI chipsSeptember 2026

GPU & AI chips — September 2026

What Telegram channels wrote about GPU & AI chips in September 2026: 839 posts from 474 channels, collected automatically from public Telegram channels.

839 posts·474 channels

More posts — page 33

839 posts total

Тестируем и сравниваем ваш ПК, приложения, ПО

Сервис PassMark поможет тем, кто хочет приобрести или продать ПК, ноутбук, отдельные комплектующие, соответственно, с выбором или запрашиваемой ценой.

Также, подойдет для тех, кому просто интересно узнать, насколько актуальна их техника по сегодняшним цена.

На сайте сервиса показываются результаты тестирования производительности огромнейшей базы процессоров, видеокарт, жестких дисков, оперативной памяти, собранных компьютерных систем, а также Android и iOS устройств.

CMD

Sep 3, 08:33 AMMore from @cmd_it

Разворачиваем Llama 3 с Docker и vLLM

Запуск LLM – это не просто поднять контейнер.

Здесь важны производительность, память и эффективное использование GPU.

В этом гайде разберём: - Настройку GPU-окружения: Docker + NVIDIA Runtime - Деплой модели с Llama и vLLM - Оптимизацию памяти с помощью флага --gpu-memory-utilization, чтобы сбалансировать VRAM между весами модели и KV Cache - Техники квантизации, которые позволяют увеличить throughput более чем в 2 раза — с 1,62 до 3,64 req/s — и вдвое сократить потребление VRAM - Как работает Continuous Batching

Подробный гайд: https://devopscube.com/deploying-llama-with-docker-and-vllm/

Следуя экспериментам по оптимизации из гайда, можно получить: - рост общего throughput в 2,2 раза - Time to First Token (TTFT) в 3 раза быстрее - от 5 до 20+ одновременных пользователей на том же железе — NVIDIA RTX 4000

Примечание: этот гайд предназначен для обучения и экспериментов. Используйте его, чтобы разобраться в основных концепциях.

👉 DevOps Portal

Sep 3, 08:23 AMMore from @loose_code

Грайте на максимум без гальмування та перегріву! 🎮🔥

Ноутбук ACER Nitro V 16 AI поєднує неприборкану потужність заліза та розумні ШІ-алгоритми для найвищого FPS у сучасних іграх

💡 Головні фішки: 🎯 Процесор AMD Ryzen + відеокарта NVIDIA GeForce RTX. ❄️ Потужне двовентиляторне охолодження NitroSense. 🎙 Покращене ШІ-аудіо з усуненням фонових шумів.

💻 Переходьте за посиланням та прокачуйте свій геймінг з MOYO

🎉Акция Flash Up и Магнит: Флеш Ап в Магнит – Киберпрокачка🎉 с 15 июня по 30 октября 2026

Призы 🎁Стикерпак в мессенджере — при накоплении 10 Очков; 🎁Купон «Магнит» на 100 рублей — при накоплении 40 Очков; 🎁Универсальный сертификат Гифтери номиналом 150 рублей — при накоплении 80 Очков. 🎁Геймерские наушники стоимостью 10 000 рублей — 5 шт.; 🎁Игровой ПК стоимостью 50 000 рублей — 5 шт.; 🎁Видеокарта стоимостью 40 000 рублей — 5 шт. 🎁Игровая приставка стоимостью 60 000 рублей — 3 шт.

👉 https://promomean.ru/promo/flash-up-magnit/

✅ Закрытый канал с промокодами

🎁 В закрепе промокоды на скидки👉

🙄 5 МИФОВ вебкама, о которых говорят на каждом углу. И которые являются либо пугалками, либо фантазиями завистников, либо оправданиями :)

Миф №1. 🎊 УДИВЛЯЙ ПОСТОЯННИКА. Говорят, что для наконец-то появившегося постоянника всегда нужно что-то новое, иначе ты ему наскучишь, и он уйдет вместе со своими чаевыми. На самом же деле, постоянник приходит к тебе после того, как отсеял кучу других моделей по своему четко сформулированному запросу, который ты удовлетворяешь.

Миф №2. 🫠 О ТАКОМ НЕ РАССКАЗЫВАЮТ. Вебкам — работа, которой нужно стыдиться. Так утверждают те, кто ни разу не пробовал провести хоть один стрим. По крайней мере, работа не обычная и не скучная, и она не сведет тебя с ума, как главного героя "Красоты по-американски". При этом не значит, что нужно обязательно про неё рассказывать: держись внутренний опоры. Потому что сигналинг статуса и денег не подарит тебе того спокойствия, как то, которое у тебя есть, когда окружающие не могут тебя шантажировать даже исходя из своих собственных стереотипов.

Миф №3. ⭐ КЛЮЧ К УСПЕХУ В ВЫСИДКЕ. Говорят, что высидка часов даст рейтинг/денежный результат. С одной стороны, без определенного кол-ва часов в неделю (от 24 часов чистого онлайна в неделю 3 недели подряд) сайт не даст достойного места в листинге. Да, меньше мемберов найдёт тебя, и меньше купивших юзеров найдет тебя вновь. С другой стороны, выше определенного кол-ва часов онлайн уже не будет качественно нового результата. Сама по себе высидка не даст 100% выхлоп. Важно обращать внимание на качество работы с клиентами: воронку, процессы (до во время, после пвт), позиционирование и т.п.)

Миф №4. 📺 ВСЕ САЙТЫ СЛОМАНЫ. "Работать невозможно, у сайтов каждый день глюки, стримы вылетают постоянно". Да, глобально случаются баги, но по большей части проблемы происходят на стороне стримера: блокировки инета, проблемы с соединением, с кэшем, видеокартой или оперативкой, VPN, устаревшие клиенты программ и т. д. Нагрузка на сайт не может быть причиной: сервера рассчитаны на такое количество комнат, иначе мы бы их не видели.

Миф №5. 💸 НА ВЕБКЕ БОЛЬШЕ НЕ ЗАРАБОТАТЬ. "В 2026 невозможно действительно хорошо зарабатывать на вебке". У этого мифа сразу два начала. Кто-то говорит, что нельзя заработать, потому конкуренция высока. Но! сфера растет, значит, в ней крутится больше денег. Другие утверждают, что индустрию коснутся кризисы, глобальные изменения экономики, а адалт сейчас вообще инспектируют и щемят со всех сторон. Конечно, возможны проблемы, но вебкам спасает простой факт: это сфера luxury, а она, как правило, претерпевает меньше колебаний в кризисы, чем рынки повседневных/дешевых товаров).

❔ Какие мифы еще хочется разобрать? Пиши коммент и вступай в чат! — https://t.me/+x8flAQr7llI3Mzc8

Всем крутых стримов и китовьих чаевых 💜 Кажется, что-то вебкамное 🐈‍⬛ Выгодный вывод с сайтов

Sep 3, 07:59 AMMore from @auroraweb

🔥 Корпус Thermalright A70 Vision FAN5-M

💱 Сейчас всего за 13.615р. (15.767р.)

Самый жирный вариант данного корпуса: • Габариты — 450.8 × 289.5 × 477 мм, вес ~11 кг • Совместимость — кулер до 168 мм, видеокарта до 420 мм, БП до 200 мм (низ) • Слоты / накопители — 7 слотов, 2×3.5″, 2×2.5″ • Вентиляторы (5 шт. TL-M12) — снизу 3×120 мм, сбоку до 3×120 мм (ставится вода), сзади 2×120 мм • Пылевой фильтр — нейлоновый (снизу) • СЖО — радиаторы 120/240/360 мм сбоку и снизу • В нашей комплектации экран + подсветка + неплохие вертушки в комплекте. • Фишка — вывода шлангов в отсек БП нет, но есть специальное верхнее пространство для укладки шлангов и кабелей (туда же пойдёт экранчик 9.16″ от Thermalright) • Передняя панель — Power / Reset, 3.5 мм аудио, 2×USB 3.1 Type-A, 1×USB Type-C

➡️ Wildberries – 13.615р.

#Кoрпус

Sep 3, 07:50 AMMore from @inter_sh0p

Трансформер на 75 млн параметров взял 44% на ARC-AGI-1 за 67 центов

ARC-AGI много лет был аргументом в спорах «умеют ли нейросети рассуждать»: тысяча задач на цветных сетках, у каждой своё правило, запомнить ответы нельзя. Исследователь Митхил Вакде обучил маленький трансформер с нуля и получил 44% на публичном eval-наборе. Полтора часа на одной RTX 5090, аренда карты обошлась примерно в $0,67.

Трюк в обучении во время теста: модель дообучается на самих задачах при скрытых ответах, а для двумерных сеток используются обучаемые 3D RoPE. Самое честное место поста: когда автор убрал обучение на входных токенах, результат вырос с 40% до 44%, и он пишет «я не понимаю почему». На ARC-2 та же модель даёт 7%.

Код открыт под MIT, эксперимент можно повторить на игровой видеокарте. Что именно измеряет бенчмарк после такого результата, обсуждаем на сайте.

Sep 3, 07:44 AMMore from @tproger

🐳 Kubernetes: передача GPU и других устройств в контейнер без privileged

👁 Для сервисов, работающих с GPU, /dev-устройствами или специализированным железом, часто используют privileged: true. Это даёт контейнеру слишком широкие права, хотя приложению обычно нужен только конкретный ресурс. В Kubernetes можно описать устройство точечно через Device Plugin и получить его в Pod как обычный ресурс.

📝 Запрашиваем только нужный GPU

Kubernetes передаст контейнеру один GPU, а планировщик не позволит разместить Pod на узле, где такой ресурс недоступен.

apiVersion: v1 kind: Pod metadata: name: inference spec: containers: - name: app image: my-inference:latest resources: limits: nvidia.com/gpu: 1

📝 Выделяем специализированное устройство через Device Plugin

Device Plugin регистрирует устройство в kubelet, после чего Kubernetes учитывает его при планировании Pod. Такой механизм работает не только для GPU, но и для FPGA, сетевых ускорителей и другого специализированного оборудования.

resources: limits: example.com/fpga: 1

env: - name: DEVICE_MODE value: "accelerated"

📝 Проверяем распределение устройств

В описании узла можно увидеть доступные и занятые ресурсы, а в Pod — какие ограничения и запросы были назначены.

kubectl describe node worker-01

kubectl get pods \ -o wide

kubectl describe pod inference

❗️ Device Plugin позволяет уйти от универсального privileged и описывать аппаратные ресурсы как часть декларативной модели Kubernetes. Для инфраструктуры с GPU и специализированными устройствами это заметно безопаснее и лучше масштабируется, чем ручная передача /dev/* в контейнер.

tags: #devops #безопасность #k8s

🧭 @recura_tech 🌐 VK 🌐 MAX

Sep 3, 07:04 AMMore from @recura_tech

CCTV_YOLO

Это приложение для детекции объектов в реальном времени на видеопотоках с камер наблюдения, использующее модель YOLOv5n6.

Оно обрабатывает кадры в низком разрешении (320x180) для ускорения работы, а результаты отображает на кадрах в высоком разрешении.

Приложение предоставляет интерактивный интерфейс через Gradio, позволяя пользователям наблюдать обработанный видеопоток в реальном времени.

Оптимизировано для работы с GPU, поддерживающими CUDA, что обеспечивает быструю инференцию модели.

Lang: Python https://github.com/SanshruthR/CCTV_YOLO ================ 👁 News | 👁 Soft | 👁 Hacker

🔥 #Успевай Видеокарта GIGABYTE GeForce RTX 5060 WINDFORCE MAX OC V2 8GB всего за 41.093р. самая дешевая 5060 на данный момент

➡️ Wildberries – 41.093р. 🔥

⚡️Найдено ботом InterShop Pro #Видeокарта

Sep 3, 06:50 AMMore from @inter_sh0p

🔥 Корпус PowerCase Vision Micro M5B

💱 Сейчас всего за 3.399р. (4.899р.)

Хотите аквариум за копейки? Держите! Получаем цельное изогнутое стекло и 3 вентилятора в комплекте и всё это в DNS: • Формат — Mini-Tower, поддержка Micro-ATX / Mini-ITX • Компактный «аквариум» с боковой и передней панелями из закалённого стекла • С завода установлено 3×120 мм ARGB вентилятора • Всего можно установить до 7×120 мм вентиляторов • Поддержка СЖО — до 240 мм сверху, сзади — 120 мм • Металл — около 0.45 мм • Видеокарта помещается до 340 мм, кулер процессора — до 160 мм, БП — до 160 мм • Блок питания спрятан за материнской платой • Накопители — 2×2.5" + 1×3.5" • Есть пылевые фильтры сверху и снизу • Из портов: USB 3.2 Gen 1 + USB 2.0 + USB Type-C + аудио

➡️ DNS – 3.399р. (АРТ: 9360413)

#Кoрпус

Sep 3, 06:10 AMMore from @inter_sh0p

Диспетчер задач в Windows 11 теперь умеет показывать нейронагрузку

Последнее обновление добавило в «Диспетчер задач» новые показатели для NPU. На вкладке процессов появились столбцы NPU и NPU Engine, а в разделе «Сведения» — NPU Dedicated Memory и NPU Shared.

Кроме того, в мониторинге нагрузки видеокарты теперь можно вывести отдельный график Neural. Название NPU-движка зависит от версии драйвера и от того, встроен ли он в процессор или видеокарту.

Наконец-то можно посмотреть, чем там занят ваш нейропроцессор.

SpaceX, которая в феврале подмяла под себя xAI Илона Маска, срубила 3,2 миллиарда долларов на ИИ в 2025 году, а к 2027-му с легкостью пробьёт 60 миллиардов. Причём львиную долю этих бабок заносят сторонние игроки — те же Anthropic и Alphabet засылают миллиарды в месяц за аренду наземных дата-центров SpaceX. И это очень правильная маржинальность: если средняя компания из S&P 500 требует от 2 до 3 долларов активов для сбора 1 доллара продаж, то гигаватт вычислительной мощности за 40 миллиардов долларов генерирует те же 40 миллиардов выручки. Бизнес — просто пушка!

Но развести инвесторов на 6 триллионов долларов под ИИ за считанные годы — это серьезный вызов для американского рынка. Да, рынок переварил допэмиссию Alphabet на 85 миллиардов в июне. Да, SpaceX поставила абсолютный рекорд среди новичков: собрала 86 миллиардов на IPO и еще 25 миллиардов на долговом рынке всего 10 дней спустя. Но другим приходится крутиться и выдумывать дикие схемы. Nvidia, например, выделяет до 100 миллиардов финансирования для OpenAI, чтобы те покупали их же графические процессоры (GPU) под мощности в 10 гигаватт. OpenAI, Oracle и SoftBank запустили проект Stargate — фонд под ИИ-инфраструктуру с обещанными какими-то космическими 500 миллиардами долларов.

Продолжение следует..

Sep 3, 03:00 AMMore from @investi_kz

avgo 26q3

狀態很好,首次把 mtk 拉出來講看來認同是對手了

- QA 提到 japapeno 在 oai workload 裡勝過 gb ultra、TPU 也能夠跑其他前沿模型,成本為 GPU 不到一半

- TPU v8i 效能可比甚至超越 GPU

- Broadcom 的 v8i 已出貨,領先更早啟動的 MediaTek v8t。好像是電話會議第一次把對手點出來念一下,以前都是輕視角度+不想評論

- 坐擁領先 serdes、c2c 互連、先進 HBM 與 SRAM 整合、差異化先進封裝,從產品定義到量產最快的上市時間。最後者看起來是很猛的競爭力沒錯

- 當前 AI 算力需求大多數來自一小群前沿模型開發者,27~28 年還會爬,且業者很多都轉向 XPU 追求效能、成本、功耗

6 家 XPU 客戶中 4 家將非常巨大,各家 XPU 路線長短不同,Google 10 年、OpenAI 2-3 年、Meta 3 年

- Anthropic 與 OpenAI 短期靠第三方雲,長期自有晶片、自營資料中心、直接對外賣 API,每 GW 可產生約 300 億美元 ARR。

- 每 GW 內容價值約 200~300 億美元且長期穩定:ASP 上升被單顆功耗上升抵銷,成長靠 GW 數目

- Hock 最在意的是晶片出去後客戶能否及時部署,而非自身供應狀態,這是刻意保守主因

- Tomahawk Ultra 首次讓機櫃內 GPU/XPU scale-up 跑在乙太網上,損失與延遲不輸現有方案;開放標準是被採用主因。已進入 XPU 叢集與部分 GPU 叢集

- Tomahawk 6 連沒用 Broadcom XPU 的 hyperscaler 也在用;AI 網通營收成長會與 XPU 一樣快

- EML/CW 雷射需求快速超過業界供給,Broadcom 市佔可觀,雷射與 InP 產能年增三倍以上並持續擴充

- XPU 記憶體含量增加會持續稀釋毛利率,所以呼籲別再看毛利率、看營益率,靠營運槓桿可維持營益率

- 只為 2 家 lab 設融資工具,其他 4 家自籌。Broadcom 不直接放款、只提供適度殘值保證。認為 Anthropic 邁向 IPO 後信用會改變,OpenAI 能見度較低

Sep 3, 01:03 AMMore from @gooaye

Qualcomm details tri-core Adreno GPU with matrix cores for AI.

- 3 matrix cores to cut latency and power in local AI - Adreno Neural Fusion for steadier rendering, up to 40% power cut - 12% boost in GPU efficiency; up to 1.45GHz clock - Snapdragon 8 Gen 6 + Oryon CPU upgrade teased

More

Sep 2, 08:25 PMMore from @xiaomiui

ترمیم و افزایش کیفیت ویدئو با هوش مصنوعی، کاملاً روی سیستم خودت و رایگان

ابزار VRGDG SeedVR2 TensorRT Studio، مدل SeedVR2 رو به یک محیط ساده برای ترمیم و افزایش کیفیت ویدئو در ویندوز تبدیل کرده.

امکانات: افزایش کیفیت تا 4k Preview قبل از Render کامل مقایسه Original و Restored ادامه پردازش بعد از قطع شدن Color Correction و Post-processing شتاب‌دهی TensorRT روی کارت‌های NVIDIA RTX سیستم موردنیاز: Windows 11 کارت گرافیک NVIDIA RTX حداقل 35GB فضای خالی درایور جدید NVIDIA اتصال اینترنت برای نصب اولیه Python 3.12+ (در نصب آماده می‌شود) هرچه VRAM بیشتر باشد، دستت برای مدل‌ها و تنظیمات سنگین‌تر بازتر است. مدل‌های FP8 هم برای کاهش مصرف VRAM مناسب‌ترند. در یک تست، RTX 5090 یک ویدئوی ۸ ثانیه‌ای 360p را با مدل 7B Sharp FP16 به 2K در حدود ۸ دقیقه تبدیل کرده.

لینک ابزار

@Farda_Ai

Sep 2, 07:50 PMMore from @farda_ai

📱 RTX 3060 всё ещё самая популярная видеокарта в Steam

✅ Valve опубликовала статистику за август 2026 года. Первое место заняла RTX 3060 с долей 3,92%, следом идут RTX 4060 Laptop — 3,84% и RTX 5070 — 3,77%

Среди процессоров по-прежнему лидирует Intel — 59,04%, а на AMD приходится 40,96% пользователей

В операционных системах продолжает доминировать Windows 11 — 59,47%, тогда как доля Windows 10 составляет 34,63% ⚡️

Игровой ноутбук THUNDEROBOT RS16

https://ali.click/hy5tk1f?erid=2SDnjdb3Jb5

129 373₽

Игровой ноутбук с мощным 24-ядерным Intel Core i9-13900HX и дискретной видеокартой GeForce RTX 5060 рассчитан на современные игры, работу с графикой и ресурсоемкие программы. Конфигурация включает 32 ГБ оперативной памяти DDR5 и быстрый SSD на 1 ТБ.

Большой 16-дюймовый IPS-экран получил разрешение 2.5K и высокую частоту обновления 240 Гц, благодаря чему динамичные игры выглядят заметно плавнее. Полноразмерная клавиатура имеет цифровой блок и подсветку. Поставляется с Windows 11 и русской раскладкой.

🤖 Los Mac de Apple ganan terreno en los laboratorios de IA

Según reportes, OpenAI habría adquirido decenas de miles de Mac mini y Mac Studio para entrenar sistemas mediante reinforcement learning —aprendizaje por prueba y error— y desarrollar agentes capaces de usar ordenadores.

La misma información señala que Anthropic está alquilando ordenadores Mac a través de Amazon Web Services. El motivo sería que, para ciertas cargas de IA, la capacidad de memoria empieza a pesar más que la potencia bruta de las GPU, los chips especializados habituales en estos trabajos.

🤖@GeneracionIA

‍🕹 MSI MAG PANO M100L PZ – Micro-ATX Case PC

💶 49,99€ invece di 88,99€ (-44%) ✅ Attiva qui la promo A-Z prima di acquistare 👉 https://amzlink.to/az05MUG4qoyY9

ℹ Case PC MSI MAG PANO M100L PZ WHITE predisposto per schede madri Micro-ATX, con supporto GPU e indicatore livello, filtri antipolvere tool-free, spazio per cavi da 33 mm, porta USB Type-C 20 Gbps e USB Type-A 5 Gbps. Pannello laterale in mesh, senza ventole.

⚙️ Configura il tuo PC: QUI! - #affiliate

Sep 2, 05:52 PMMore from @mttvideo

☝🏻Майнинг на игровых компьютерах возвращается, теперь для нужд ИИ

Два стартапа — Far Labs из Абу-Даби и Evolving Edge из Остина — строят биржи, где владельцы обычных ПК сдают простаивающие видеокарты под задачи ИИ.🎮

«Представьте Uber или Airbnb, но для вычислений ИИ», — так описывает это основатель Far Labs Ильман Шажаев.

Модель режется на куски и раскидывается по чужим машинам, оркестратор собирает из частичных ответов один. Целятся в небольшие открытые модели, а не во frontier-масштаб.

☝🏻Пускать чужой код на свой ПК — идея так себе, и это понимают: инференс крутится в песочнице с шифрованием и жёсткими лимитами на GPU, память, диск и сеть. Evolving Edge вдобавок открыл исходники узлового софта.

Однако, свои ставки выплат ни Far Labs, ни Evolving Edge пока публично не называют.🤷🏼‍♀️ ================ У этого канала есть YouTube👁

⚡️ У оперативки появился шанс подешеветь. Но не завтра

Китайская компания CXMT начала пробное производство сверхбыстрой памяти HBM3E, которую сейчас активно забирают ИИ-ускорители. Китайские разработчики уже тестируют её со своими процессорами, а коммерческое использование может начаться в 2027 году.

На первый взгляд, к ценам на обычную DDR5 это не относится. Но сейчас Samsung, SK hynix и Micron всё больше производственных мощностей отдают под память для ИИ. Из-за этого обычной памяти для компьютеров становится меньше, а цены на неё растут.

Появление ещё одного крупного производителя может немного разгрузить рынок. Если CXMT сможет занять заметную долю, у остальных производителей будет меньше причин перенаправлять свои мощности на ИИ-память — а значит, со временем может вырасти предложение обычной DDR5.

Но это не значит, что оперативка скоро резко подешевеет. Пока что это просто ещё один шанс остановить рост цен на память. Но ждать дешёвой DDR5 этой осенью точно не стоит.

Ждём дешёвую DDR5 или уже смирились? 🥲 __________

❤️ DigitalRazor #digitalrazor_news