TGScope
Settings
Theme
TopicGPU & AI chipsSeptember 2026

GPU & AI chips — September 2026

What Telegram channels wrote about GPU & AI chips in September 2026: 839 posts from 474 channels, collected automatically from public Telegram channels.

839 posts·474 channels

More posts — page 6

839 posts total

Linux официально приходит на ноутбуки со Snapdragon X2.

Qualcomm добавляет полноценную поддержку Linux для своих новых чипов Snapdragon X2. Работа уже идёт, и изменения планируют отправлять в апстрим ядра Linux.

Причём речь не просто о том, чтобы Linux смог загрузиться.

Qualcomm работает над поддержкой в Linux GPU Adreno, NPU Hexagon, камеры, аудио, управления питанием и другого железа ноутбуков.

Для раннего превью для разработчиков используется Debian 13, а сертификация Ubuntu запланирована на первую половину 2027 года.

HP, ASUS и HUMAIN также планируют выпускать устройства на Snapdragon X2 с поддержкой Linux начиная с первого квартала 2027 года.

ARM-ноутбуки годами сталкивались с проблемами поддержки железа в Linux.

Теперь Qualcomm действительно работает вместе с Linux-экосистемой, чтобы сделать ноутбуки на Snapdragon полноценными Linux-машинами

@linuxos_tg

Sep 24, 06:08 PMMore from @linuxos_tg

К ноябрю 2027 выйдут PS6 и новый Xbox — инсайдер Kepler_L2 подтвердил релизы к праздничному сезону.

Sony запустит PS6 Orion и портативную Canis. В Canis — 4 ядра Zen 6c, 2 Zen 6 LP, GPU на RDNA 5 (16 CU) и 24 ГБ LPDDR5X. Это не стриминговый девайс, в отличие от PS Portal.

PS6 получит 30 ГБ GDDR7, Zen 6 и GPU RDNA 5 с ~50 CU. Её GPU — до 40 TFLOPS, что в 4 раза мощнее базовой PS5.

Xbox Project Helix будет сильнее — 56 TFLOPS (на 40% больше), с теми же Zen 6 и RDNA 5. ОЗУ пока неизвестно.

Helix — гибрид консоли и ПК: поддержка Xbox- и PC-игр, новое поколение DirectX и FSR Next. Microsoft улучшила трассировку лучей и сохранит совместимость с четырьмя поколениями игр.

Обе консоли прошли tape-out — чипы готовы, идут тестовые образцы.

Себестоимость PS6 — ~$960. Пора копить. 💰🚀

#PS6 #Xbox #GameTech

Program Service

Адам Елдаров, ex-CPO YouDo, написал два поста про экономику AI-подписок и развенчание мифа о том, что подписки — «субсидируемые» и что компании на них теряют огромные деньги. Я согласен наверное с 95% того что там написано. Форвардить два поста не хочется, поэтому зайдите и почитайте, если вам интересно: https://t.me/c3po_notes/589 и следующий за ним.

Не знаю, планировал ли Адам писать про это дальше, но мне кажется логичным продолжением будет рассуждение о том, когда у компаний изменится баланс выручки и трат на RND / обучение моделей. Пока что растет и одно, и другое, поэтому легко ошибиться и сказать «так они всегда будут убыточными!», что, очевидно, не правда, потому что второй компонент можно контролировать: ты можешь выбрать не тратить больше денег на обучение или исследование.

Сейчас такой выбор никто не делает, так как денег от пользователей и инвесторов хватает. И оба эти компонента +- одинаковые у двух ведущих компаний. Экономика их трат тоже примерно одна и та же: они платят примерно одинаково своим сотрудникам и примерно одинаково платят за видеокарты и датацентры.

Если выручка перестанет расти или вообще наметится спад (одновременный для двух компаний в силу внешних причин) — обе компании будут принимать одинаковые решения по урезанию костов. Пока она продолжает расти — они пытаются дотянуться до как можно большего количества мощностей и ведущих специалистов, и оба компонента ограничены какими-то факторами сверху. Вполне возможно, что через 2-3 года расходы компаний на мощности перестанут расти вслед за выручкой — просто потому что больше чипов не будет, можно купить лишь столько, сколько производит маленький островок около Китая. По-моему Dylan из SemiAnalysis говорил, что где-то в 2028-м году две (три?) компании будут получать больше половины всех новых чипов — отсюда, очевидно, x2 сделать уже просто некуда.

Для всех игроков в системе экономика одинаковая: сервер стоит столько-то, в будущие датацентры нужно инвестировать столько-то, чтобы получить столько-то выручки (выручка на мегаватт мощностей у всех разная, и тут OpenAI/Anthropic далеко впереди всех; остальные игроки будут пытаться спустить этот показатель с небес, но они не могут сделать это ниже своего уровня — а они в среднем менее эффективны — потому что иначе придётся платить из своего кармана, который не такой глубокий, как у фронтира).

Sep 24, 05:06 PMMore from @seeallochnaya

Инфраструктурное ПО впервые оценили по действующим лицензиям

«ТМТ Консалтинг» провел первое исследование российского рынка софта по управлению IT-инфраструктурой. Специалисты смотрели не только на закупки, но и на действующие лицензии на оборудовании в эксплуатации. Дополнительно учитывались опросы заказчиков и вендоров, а также оценочная выручка от лицензий и технической поддержки.

Что показало исследование?

➡️Рынок продолжает расти. Основным драйвером остается импортозамещение, дополнительный спрос создают гибридные облака, увеличение объемов данных и высоконагруженных приложений. В контейнеризации рост поддерживают ИИ, машинное обучение и GPU-кластеры.

Второй важный вопрос — кто является бенефициаром развития технологий. Одним из основных оказалась компания «Базис» (входит в ГК «РТК-ЦОД»), акции которой торгуются на Мосбирже под тикером BAZA.

Что по цифрам?

▪️Продукты компании установлены примерно на каждом третьем сервере в России. ▪️В российском сегменте систем виртуализации доля «Базиса» по итогам 2025 года составила 40%. ▪️В сегменте программно-определяемых хранилищ (SDS) компания заняла долю в 31%. ▪️В сегменте программно-определяемых сетей (SDN) компания названа наиболее заметным российским разработчиком самостоятельного продукта.

Вывод: растущий рынок консолидируется вокруг совместимых экосистем нескольких крупных вендоров.

💰Подписывайтесь на bitkogan в MAX

Sep 24, 04:09 PMMore from @bitkogan

Единое управление RGB-подсветкой без фирменного софта

Вышла стабильная версия OpenRGB 1.0 — открытая программа, заменяющая тяжеловесные фирменные утилиты для управления RGB-подсветкой материнских плат, видеокарт и периферии.

В новом релизе добавлена работа в фоновом режиме, переработана система профилей, осуществлен переход на Qt6, а для полного доступа к оборудованию в Windows теперь требуется отдельный драйвер PawnIO.

Разработчики предупреждают, что из-за применения методов обратного инжиниринга сохраняется небольшой риск повреждения компонентов, поэтому использовать софт следует на свой страх и риск.

#софт @pcTeapot

Sep 24, 03:00 PMMore from @pcteapot

🔍🤖ابزار zvec-grep؛ موتور جست‌وجوی محلی برای Coding Agentها

تیم Qwen علی‌بابا ابزار zvec-grep یا zg را معرفی کرده؛ یک لایه جست‌وجوی کاملاً Local که جست‌وجوی معنایی، متنی و Regex را در یک CLI ترکیب می‌کند.

🧠 این ابزار Vector Search + BM25 + ripgrep را با Reciprocal Rank Fusion ادغام می‌کند و به‌جای Chunkهای خام، ساختار کد، Symbolها و سلسله‌مراتب اسناد را ایندکس می‌کند. نتیجه نیز مستقیماً به فایل و شماره خط اشاره دارد.

🔒همچنین Embedding، Index و Search همگی روی دستگاه انجام می‌شوند و نیازی به GPU نیست. از طریق MCP نیز می‌توان آن را به Claude Code، Codex، Cursor، OpenCode و سایر Agentها متصل کرد.

📉 طبق Benchmarkهای ارائه‌شده، استفاده از zg در Claude Code و Codex علاوه بر افزایش دقت پاسخ، مصرف Token را هم کاهش می‌دهد؛ چون Agent با جست‌وجوی کمتر سریع‌تر به بخش درست کد می‌رسد.

http://github.com/zvec-ai/zvec-grep

@rss_ai_ir

#zvecgrep #Qwen #Alibaba #CodingAgent #MCP #VectorSearch #RAG #هوش_مصنوعی

Sep 24, 02:50 PMMore from @rss_ai_ir

Яндекс открыл веса Alice AI Foundation LLM

Alice AI Foundation LLM представляет собой собственный MoE-претрейн Яндекса. Весь цикл обучения провели с нуля, без стартовых весов сторонних открытых моделей.

В модели 80B параметров, из которых на каждый токен активируются 3B. Это меньше, чем у большинства других открытых претрейнов, но по бенчам результаты в паритете, а иногда и лучше. При обучении отдельно оптимизировали обмен данными между видеокартами и отбор материалов, чтобы сократить вычисления при сохранении качества. В техрепорте есть комплиментарный замер с Nemotron и Qwen – с кодом и с математикой. Плюс к этому заявляют, что заложили базу для рассуждений ещё на претрейне.

Модель выпустили под Apache 2.0, её можно свободно использовать и дообучать. За пару дней у модели уже больше 2000 скачиваний на HF.

Техрепорт Веса на HF

@ai_newz

Sep 24, 01:31 PMMore from @ai_newz

🏭 Как собрать одну рабочую станцию вместо трёх

Промышленная компания обратилась к нам с задачей объединить в одной системе сразу три этапа работы: проектирование оборудования в Siemens NX/CATIA, расчёты в Ansys Mechanical и визуальную проверку цифрового двойника в NVIDIA Omniverse.

До этого инженеры работали на нескольких компьютерах, а один цикл «изменение → расчёт → проверка» занимал 8–16 рабочих часов. В результате мы собрали рабочую станцию на Threadripper PRO 7985WX, 512 ГБ ECC-памяти и двух RTX PRO 6000 по 96 ГБ.

После внедрения цикл сократился до 5–10 часов, а полный инженерный процесс примерно на 35–40%.

➡️ ЧИТАТЬ

Разбираем, почему здесь понадобилось столько памяти, зачем две профессиональные видеокарты и почему количество ядер процессора пришлось согласовывать с лицензиями Ansys. __________

❤️ DigitalRazor #digitalrazor_pc #digitalrazor_пк

** 更新后请重启手机!

# N1 26.09 Alpha7 -修复 daemon窗口监测默认设置下未正常工作 -调整 同时开启daemon层窗口检测和无障碍服务时,不自动禁用,只弹出提示 -修复 未设置屏幕旋转也创建了旋转控制悬浮窗

# N1 26.09 Alpha6 -优化 轻装上阵更畅快,迄今为止体积最小的版本 -重构 性能调节框架-CPU频率控制进一步完善 增加Fast Share功能传输过程CPU Boost 增加文件浏览功能ZIP压缩解压、复制文件等操作的CPU Boost 增加增强LMKE主动压缩、回写过程CPU Boost、KSwapd0 Boost 再次重构GestureBoost激活和退出逻辑 修复辅助调速器设定的频率应用错误 修复Scene FAS中核频率偏移失效 -调整 配置文件统一为小写 -修复 Scene FAS中核频率偏移功能失效 -优化 降低daemon调用系统服务获取数据的耗时 -其它 由于升级TargetSDK后系统对通知样式的处理变化,无奈去除了祖传的经典通知布局 -新增 文本编辑器插件,在Scene内编辑文本文件时,提示安装语法高亮编辑器插件 -修复 无法关闭常驻通知 -修复 玄戒O1开启卓越性能后,高温高压时过热重启 -修复 更新TargetSDK后创建快捷方式失败 -修复 线程统计由于复用混乱,有时出现错误数据 -新增 悬浮小横条 -优化 Daemon层窗口检测默认

# N1 26.09 Alpha5 -修复 误将辅助调速器的调节范围下限设为CPU频率下限 -修复 进程详情不显示SWAP占用 -新增 悬浮手势小横条

# N1 26.09 Alpha4 -修复 退出Scene FAS进入其它应用后,可能未解除频率控制 -优化 基于新频率控制器的优势,daemon层响应应用切换调节策略的速度提升2s

# N1 26.09 Alpha2~3 -修复 首测中发现的一些错误

# N1 26.09 Alpha -新增 系统监视器,支持自定义显示内容,增加磁盘读写、网络传输监控 -新增 线程监视器增加二级界面,点击线程查库更详细的调度信息 -新增 桌面图标长按功能菜单自定 -新增 进程管理 按UID分组进程 -新增 目标SDK提高到36(Android 16),增加预测性返回手势 -优化 统一字体大小,避免系统字体大小设置影响部分界面显示 -优化 统一界面元素点击视觉反馈色调 -新增 耗电统计增加按应用、游戏分组 -新增 活动/服务默认排除无匹配结果的应用 -新增 GPU Vulkan驱动版本显示和详细信息弹窗 -优化 减少scene-daemon列出进程/线程产生的CPU和内存开销 -优化 辅助调速器采样率提高3倍,同时开销降低50% -优化 FAS Lite的调速器采样率提高2倍 -新增 Scene FAS适配Android 17 -新增 Scene FAS持续跟踪缓冲区(FrameBuffer),根据缓冲区余帧适当调整升频策略 -新增 *试验性* 核心分配-性能需求提示 Scene FAS联动:Runnable Boost实现,检测到主要线程长时间运行,在丢帧发生前boost频率 普通APP,辅助调速器联动:检测主线程长时间阻塞,暂时提高余量并允许突破设定的频率上限,降低界面切换延迟 -新增 核心分配重新设计的线程排序算法[x 由于表现不佳目前暂时禁用] -修复 核心分配通过app_cpuset预设,指定非单个核心误变成只有cpu0 -优化 骁龙8GEN5 LP CoreCtl适配补充 -新增 为玄戒O1 适配HP/核心分配/FAS/卓越性能 -优化 重构性能调节框架-CPU频率控制,更合理组织各种限频、Boost策略 -修复 辅助调速器泄露fd,导致持续运行内存占用缓慢增加

Sep 24, 01:11 PMMore from @scene2023

🖥 Инфраструктурное ПО впервые посчитали по работающим лицензиям. Что нашли?

«ТМТ Консалтинг» провел первое исследование рынка ПО управления динамической инфраструктурой (УДИ) на основе установленной базы действующих лицензий.

Рынок растет благодаря импортозамещению, гибридным облакам, увеличению объемов данных и высоконагруженных приложений. Дополнительный спрос создают ИИ, машинное обучение и GPU-кластеры.

Теперь к тому, как этот растущий спрос распределяется между компаниями. По результатам исследования, продукты лидера российского рынка ПО УДИ «Базиса» (акции торгуются на Мосбирже под тикером BAZA) работают примерно на каждом третьем сервере в России.

Что с долями за 2025 год? — 40% российского сегмента систем виртуализации; — 31% рынка отечественных программно-определяемых хранилищ (SDS); — в сегменте программно-определяемых сетей (SDN) «Базис» назван наиболее заметным российским разработчиком самостоятельного продукта.

🧩 Почему методика важна? Одно дело — продать лицензию или попасть в закупку. Другое — чтобы продукт действительно работал на эксплуатируемом оборудовании. В исследовании сопоставили закупки, опросы заказчиков и вендоров, установленную базу и оценочную выручку от лицензий и технической поддержки. Облака и внедрение не учитывали.

🧩 Что это означает для BAZA? Для «Базиса» результаты исследования позитивны: они подтверждают сильные позиции компании на растущем рынке и наличие большой клиентской базы для дальнейших продаж. Это соответствует долгосрочной истории роста компании за счет привлечения новых заказчиков и расширения сотрудничества с действующими клиентами.

🧩 ИТОГО: рынок растет и смещается от отдельных продуктов к экосистемам, а «Базис» входит в число их основных поставщиков.

@profitanet

Sep 24, 11:53 AMMore from @profitanet

⚡️ К вашему вниманию: DeepCool CC550 4F — компактный Mid-Tower корпус с мощным охлаждением

Главные особенности: ▫️4 предустановленных ARGB-вентилятора 120 мм и продуманная сетчатая панель для охлаждения ▫️Двухкамерный дизайн скрывает блок питания и накопители, сохраняя порядок внутри ▫️Внимателен к габаритам: поддерживает видеокарты до 317 мм и башенные кулеры до 163 мм ▫️Легкая сборка: безинструментальное снятие панелей и 23 мм пространства для кабель-менеджмента

🥰 — если хотел бы себе этот корпус

DeepCool Russia

Sep 24, 11:14 AMMore from @deepcoolru

Вот более собранный вариант:

Alibaba выкатили «ИИ-фотошоп» Qwen-Image-2.1

Alibaba выпустила Qwen-Image-2.1 — новую открытую модель для генерации и редактирования изображений. И да, это произошло всего через два месяца после версии 3.0.

По позиционированию новинка ближе к формату быстрого и лёгкого «ИИ-фотошопа»: модель умеет работать с картинками, при этом не требует жирного железа.

Что важно: — 7 млрд параметров — открытые веса — достаточно базовой видеокарты уровня RTX 4060 — по классу модель сравнивают с Nano Banana 2

То есть это уже не история про «красиво, но только в облаке», а вполне реальный вариант для локального запуска.

Попробовать можно бесплатно на Hugging Face: https://huggingface.co/spaces/Qwen/Qwen-Image-2.1

Sep 24, 09:03 AMMore from @omggpt

Внутри этого ПК «расцветает» сакура из титана: Aftershock продаёт Cherry Bloom за $14 200

Компания Aftershock представила необычный настольный компьютер Cherry Bloom. Внутри прозрачного корпуса установлено декоративное дерево сакуры с 70 цветками ручной работы: они раскрываются при нагреве системы и закрываются, когда она остывает.

Лепестки сделаны из термочувствительного титанового сплава. В цветах нет моторов или других приводов — их форма меняется под воздействием температуры. Таким образом, тепло от компонентов компьютера помогает «расцвести» дереву.

ПК собран в корпусе-аквариуме со стеклянными боковыми панелями и верхней крышкой. В конфигурацию входят процессор Ryzen 7 9800X3D с жидкостным охлаждением, видеокарта Zotac GeForce RTX 5080 Solid OC White, 64 ГБ оперативной памяти DDR5-6000 и SSD на 2 ТБ. За питание отвечает блок мощностью 1300 Вт.

Aftershock оценила Cherry Bloom примерно в $14 200.

XMG подняла цены на ноутбуки на €100–300 на фоне почти шестикратного роста стоимости DDR5 SO-DIMM

XMG объявила о новом повышении цен на ноутбуки. Большинство моделей подорожали на €100–150, а для некоторых конфигураций рост оказался существеннее. Больше всего прибавил в цене SCHENKER KEY 18 Pro — €300. Новые цены действуют с 18 сентября в магазине bestware.

Одной из главных причин XMG называет подорожание оперативной памяти. По оценке компании, рыночная стоимость распространённых модулей DDR5 SO-DIMM почти в шесть раз выше, чем в середине 2025 года. За это же время выросли цены на настольную DDR5 и SSD.

Для сравнения XMG взяла по три массовых продукта из каждой категории, доступных на Geizhals. В расчётах использовались розничные цены, но, как утверждает компания, её закупочные расходы выросли примерно в той же пропорции. За исходный уровень — 1,0× — приняли цены июля 2025 года, до резкого подорожания во второй половине года.

На стоимость ноутбуков повлияли не только цены на память. XMG также отмечает рост закупочных расходов на печатные платы, электронные компоненты, мобильные процессоры Intel и AMD, видеокарты и память GDDR7. Кроме того, подорожала авиадоставка систем из Азии.

Собственные базовые платформы ноутбуков XMG не производит: компания разрабатывает устройства вместе с ODM-партнёрами, а окончательную конфигурацию, сборку и контроль качества проводит в Лейпциге.

Стартовые цены XMG APEX 16, CORE 15, CORE 16, FUSION 16, NEO 16 и нескольких моделей PRO выросли на €100. На €150 подорожали APEX 16 MAX, APEX 17, FOCUS 17 и FUSION 15. Цена SCHENKER KEY 18 Pro увеличилась на €300.

Апгрейд до GeForce RTX 5090 Laptop GPU теперь стоит на €120 дороже для обеих версий XMG NEO 16 и для SCHENKER KEY 18 Pro. Доплаты за некоторые конфигурации с RTX 5070, напротив, снизились, однако сами ноутбуки в целом всё равно стоят дороже. Повышение не затронуло XMG EVO и модели SCHENKER CONNECT, ELEMENT и WORK.

XMG подчёркивает, что меняет цены из-за увеличения закупочных расходов, а не ради повышения маржи. Компания не рассчитывает на устойчивое удешевление компонентов в среднесрочной перспективе. Кроме того, некоторые конфигурации с отдельными процессорами, видеокартами и объёмами памяти могут поставляться дольше или временно отсутствовать в продаже.

Sep 23, 07:33 PMMore from @ctrlgame

🌐 Artificial Intelligence Tools & Their Use Cases 🤖🔮

🔹 TensorFlow ➜ Building scalable deep learning models for computer vision and NLP 🔹 PyTorch ➜ Dynamic neural networks for research and rapid AI prototyping 🔹 LangChain ➜ Creating AI agents with memory, tools, and chaining for complex workflows 🔹 Hugging Face Transformers ➜ Pre-trained models for text generation, translation, and sentiment 🔹 OpenAI GPT Models ➜ Conversational AI, content creation, and code assistance 🔹 Scikit-learn ➜ Classical ML algorithms for classification, regression, and clustering 🔹 Keras ➜ High-level neural network APIs for quick model development 🔹 CrewAI ➜ Multi-agent systems for collaborative AI task orchestration 🔹 AutoGen ➜ Conversational agents for automated programming and problem-solving 🔹 Jupyter Notebook ➜ Interactive AI experimentation, visualization, and sharing 🔹 MLflow ➜ Experiment tracking, model packaging, and deployment pipelines 🔹 Docker ➜ Containerizing AI apps for reproducible environments 🔹 AWS SageMaker ➜ End-to-end ML workflows with cloud training and inference 🔹 Google Cloud AI ➜ Vision, speech, and natural language APIs for app integration 🔹 Rasa ➜ Building customizable chatbots and virtual assistants

💬 Tap ❤️ if this helped!

Sep 23, 07:16 PMMore from @ai_best_tools

🚩 Fuli Luo опубликовала новую архитектуру HySparse2, на которую перейдёт MiMo V3. Сходство с DeepSeek V4.1 довольно очевидное, да и сама она один из бывших создателей DeepSeek. Однако крайне тревожный момент, что всё больше ситуация напоминает: архитектуры Сбербанка и Яндекса ошиблись, начав копировать модный китайских гибрид GPT+State для тяжелых LLM как в Kimi K3.

Дело в том, что гибрид как в Kimi K3 потенциально сильнее в IQ, т.к. лучше понимает глобальный контекст в своём State. Однако чтобы реализовать это преимущество, нужно иметь суперкластер, аналогичный доступному Kimi, а также очень сложные пайплайны RL-обучения с тысячами песочниц. В случае Сбербанка и Яндекса там нет такого ресурса GPU, а практика Reinforcement Learning ограниченная. Достаточно указать, что Яндекс выпустил только Base-модель своей Алисы без RL, но её хватило, чтобы перебить RL-обучение GigaChat, т.е. у Яндекса недовели RL до конца, у Сбера оно такое слабое, что Base перебить не может у Яндекса. Я уже писал про это по бенчмаркам.

Однако в архитектуре GPT+State есть серьёзная уязвимость для построения «worker-агентов», т.е. агентов-делателей. Для начала DeepSeek и Xiaomi решили опираться на идею YOCO (self-/encoder-часть готовит глобальные KV, которые верхняя/cross-/decoder-часть переиспользует). Это даёт ранний выход из prefill: после self-decoder / causal encoder можно остановиться и не гонять весь prompt через верхние слои. В случае агентов им нужно без конца «префилить» контекст, т.к. они постоянно его перечитывают. Поскольку у DeepSeek и Xiaomi нейросети умеют подготовить векторную репрезентацию контекста и выйти, то они просто громят по эффективности и старые GPT, и GPT+State.

Второй аспект. У DeepSeek и Xiaomi более точное цитирование при маленьких затратах VRAM за счёт разреженного внимания на Top-K лучших токенов. В Mamba-like моделях это огромная проблема, т.к. State сжимает информацию с потерями, поэтому там возникает проблема в точности цитат, что в том же коде сразу же syntax error. Чтобы это решить, и Kimi K3, и GigaChat добавляют слои на Full Attention, чтобы нейросеть лучше видела цитаты, но он чудовищно неэффективен относительно разреженного внимания DeepSeek и Xiaomi по расходу GPU и VRAM.

Проще говоря, сейчас DeepSeek и Xiaomi могут установить феерически низкий ценник по API, что даже сделали, а также делать бессмысленным установку других моделей локально для агентов. Самое время командам Сбера и Яндекса подумать, туда ли они идут. Пытаться сделать «русский Kimi K3» — хорошая идея для маркетинга, но пока задача хотя бы не флешки китайцев догнать, а даже Qwen 3.8 27B. Надо быть реалистичнее в том плане, что ты делаешь не самую умную LLM, но которая полезна как агент-исполнитель, а не агент-думатель. Так вот, агенты-исполнители, похоже, не делаются на гибридах через State лидерами рынка и ведущими учёными в LLM.

https://arxiv.org/pdf/2609.26368

Sep 23, 05:27 PMMore from @turboproject

🚨📢📌

انویدیا و #بازدارندگی تکنولوژیک: تحلیل عمیق و مسائل راهبردی

نویسنده: comet

۱. بازدارندگی #تکنولوژیک یعنی چه؟

بازدارندگی تکنولوژیک با آن منطق قدیمی «تضعیف متقابل مطمئن» یا همان MAD هسته‌ای فرق دارد. در آن منطق، طرفین با تهدید نابودی هسته‌ای یکدیگر را مهار می‌کردند. اما امروز آمریکا به‌جای #بمب اتم، روی کنترل فناوری‌های حیاتی مثل هوش مصنوعی، نیمه‌رساناها و فناوری کوانتومی تکیه کرده است. هدف این است که:

اول، معادله اقتصاد جهانی تحت کنترل بماند. هر اقتصاد مدرنی، حتی چین و روسیه، به #فناوری‌های آمریکایی وابسته است.

دوم، گزینه‌های #نظامی رقیب محدود شود. بدون قدرت محاسباتی پیشرفته، تولید سلاح‌های هوشمند، سیستم‌های جنگ الکترونیک و کنترل پهپادها سخت یا غیرممکن می‌شود.

سوم، از درگیری مستقیم جلوگیری شود. اگر آمریکا بتواند رقیب را از طریق تنگناهای تکنولوژیکی «خاموش» کند، نیازی به جنگ فیزیکی پیدا نمی‌کند.

۲. انویدیا؛ ستون فقرات این استراتژی

چرا #انویدیا این‌قدر مهم است؟ چون این شرکت فقط یک تولیدکننده GPU با قدرت بالا نیست؛ یک «تنگنای تک‌نقطه‌ای» یا همان Chokepoint است. یعنی گلوگاهی که همه مجبورند از آن عبور کنند.

سهم انویدیا از بازار GPUهای عمومی بیش از ۸۰ درصد است. فناوری CUDA آن یک اکوسیستم نرم‌افزاری ساخته که جایگزین کردنش سال‌ها زمان می‌برد. پردازنده‌های H100 و H200 آن پیش‌نیاز مدل‌های بزرگ زبانی و سیستم‌های هوش مصنوعی نظامی هستند. زنجیره تأمین آن هم به TSMC در تایوان و فناوری بسته‌بندی CoWoS وابسته است.

کاربردهای نظامی انویدیا دو دسته‌اند:

📌دسته مستقیم: تولید هوش مصنوعی برای هدف‌شناسی و پردازش داده‌های جنگی، سیستم‌های جنگ الکترونیکی برای تشخیص و تداخل سیگنال‌ها، و شبیه‌سازی و آموزش سناریوهای جنگی.

📌دسته غیرمستقیم: کنترل زنجیره تأمین اقتصادی که خودش به قدرت نظامی ترجمه می‌شود، و محدود کردن توسعه سلاح‌های رقیب، مثل سیستم‌های خودمختار چین.

۳. سناریوی سقوط؛ تحلیل بحران‌ها

چه متغیرهایی می‌توانند این برتری را به خطر بیندازند؟🤔

اول، شکست نوآوری. اگر انویدیا در نسل‌های بعدی GPU از رقبایی مثل AMD، اینتل یا استارتاپ‌های چینی عقب بیفتد. احتمال این پایین است، ولی صفر نیست. چون انویدیا فقط سخت‌افزار نیست؛ CUDA یک دیوار بلند است.

دوم، تحریم‌های متقابل. اگر چین و روسیه بدون اطلاع انویدیا فناوری TSMC را سرقت کنند، یا اگر تایوان تحت فشار ژئوپلیتیکی تولید CoWoS را محدود کند.

سوم، تصمیمات سیاسی خطرناک. اگر دولت آمریکا به دلایل سیاسی داخلی انویدیا را تکه‌تکه کند، یا اگر اروپا یک جایگزین متحد مثل SambaNova یا Graphcore بسازد.

۴. راهبردهای رقابتی چین و جایگزین‌ها

🚨چین برای استقلال از انویدیا چند مسیر را امتحان می‌کند.

تولید داخلی: هواوی با Ascend، و علی‌بابا با T-Head. اما هر دو با تحریم‌های صادراتی و عقب‌ماندگی فنی دست‌وپنجه نرم می‌کنند.

خرید از طریق واسطه: استفاده از شرکت‌های هلندی مثل ASML برای فناوری چاپ لیتوگرافی، یا سرمایه‌گذاری در استارتاپ‌های خارجی.

استراتژی «کشتزار پراکنده»: توزیع نیاز محاسباتی در چند کشور مثل روسیه، کره شمالی و ایران تا اثر تحریم کم شود.

جایگزین‌های دیگر هم وضعیت خوبی ندارند. Google TPU قدرتمند است اما فقط برای خدمات خود گوگل بهینه شده. AMD MI300 رو به رشد است ولی اکوسیستم ضعیف‌تری دارد. Intel Gaudi جدید است و بازار محدودی دارد. استارتاپ‌های ایرانی و روسی هم ناچیزند، چون نه سرمایه دارند و نه دسترسی به TSMC.

۵. سناریوی ترکیدن حباب؛ پیامدهای ژئوپلیتیکی

اگر انویدیا سقوط کند، سه اتفاق بزرگ می‌افتد.

اول، افول برتری تکنولوژیک #آمریکا. کنترل بر هوش مصنوعی جهانی از دست می‌رود و رقبا مثل چین و روسیه تقریباً هم‌وزن می‌شوند.

دوم، بازگشت به منطق نظامی کلاسیک. وقتی نرم‌افزار دیگر ابزار کنترل نیست، تنبیه‌های سخت نظامی لازم می‌شود. احتمال درگیری مستقیم بالا می‌رود. در شرق آسیا توازن قوا تغییر می‌کند. در تایوان فشار چین شدیدتر می‌شود، چون محدودیت تکنولوژیکی دیگر جلوی آن را نمی‌گیرد. در خاورمیانه، تقابل ایران، اسرائیل و آمریکا بدون نقاب دیپلماسی تکنولوژیکی رخ می‌دهد.

سوم، نابرابری جهانی شدیدتر می‌شود. چین می‌تواند با سلاح‌های خودمختار و هوش مصنوعی در منطقه سلطه پیدا کند و آمریکا ناچار می‌شود تنش‌های ژئوپلیتیکی را به خشونت تبدیل کند.

۶. راهکارها و گزینه‌های سیاستی

برای آمریکا که می‌خواهد سلطه‌اش را تثبیت کند:

تقویت انویدیا از طریق تشویق سرمایه‌گذاری بخش دولتی، حمایت از TSMC در خاک آمریکا با قانون CHIPS، و محدودیت صادرات به کشورهایی مثل ایران و روسیه.

ایجاد جایگزین‌های محلی با سرمایه‌گذاری در اینتل و بخش‌های دولتی، و توسعه TPU و GPU داخلی برای نیروی دریایی و فضایی. https://t.me/danesheplasma

Sep 23, 03:08 PMMore from @danesheplasma

تقویت زنجیره تأمین با ملی‌کردن بخشی از TSMC و CoWoS، و تنوع‌بخشی به تأمین‌کنندگان در کره جنوبی و ژاپن.

برای رقبا مثل #ایران و #روسیه:

استراتژی «کشتزار پراکنده» با بخش‌بندی محاسبات در چند کشور هم‌قومیت، و استفاده از GPUهای نسل پایین‌تر که تحریم نشده‌اند.

سرمایه‌گذاری تحقیقاتی روی الگوریتم‌هایی که کمترین سرمایه محاسباتی را نیاز دارند، مثل مدل‌های زبانی سبک به‌جای GPT-4.

همکاری جهانی با کشورهای تحت فشار تحریم مثل #چین و کره شمالی، و استقلال‌جویی تکنولوژیکی در سطح منطقه‌ای.

برای اتحادیه اروپا که به دنبال استقلال راهبردی است:

ایجاد GPU اروپایی مستقل، همکاری با تایوان برای تنوع‌بخشی TSMC، و توسعه قوانینی مثل DMA برای محدود کردن انحصار انویدیا.

تا امروز، نظام جهانی بر یک فرض کار می‌کند: انویدیا تا سال‌ها پیشتاز خواهد بود. همین فرض، استراتژی آمریکا را چند ستاره نجات می‌دهد. اگر این فرض شکست بخورد، نه الزاماً به دلیل ضعف فنی، بلکه به دلیل سرقت فناوری، تصمیمات سیاسی نادرست یا تحریم‌های متقابل، آن‌وقت تمام سناریوهای جنگی کلاسیک دوباره به میز بازی برمی‌گردند.

این یعنی صلح امروز روی شانه‌های GPU ایستاده است. تا زمانی که انویدیا سلطه دارد، جنگ می‌تواند با تحریم‌های نرم اقتصادی جایگزین شود. اما اگر این نماد شکست بخورد، تاریخ نشان می‌دهد که ابرقدرت‌ها دوباره سراغ سلاح‌های سخت می‌روند.

برای رقبای منطقه‌ای مثل ایران، راه خروج از این تله چیست؟ بله، استقلال‌جویی تکنولوژیکی پراکنده و توسعه الگوریتم‌های تطبیقی؛ چیزی که برتری انویدیا را دور بزند و بدون آن کار کند. https://t.me/danesheplasma

Sep 23, 03:08 PMMore from @danesheplasma

Исследовательница OpenAI выложила большой конспект по устройству LLM

Исследовательница OpenAI Алиса Лю открыла бесплатный конспект по устройству больших языковых моделей — тот самый материал, который помог ей попасть на работу в корпорацию.

Это не «что такое ChatGPT за 5 минут», а плотный разбор для тех, кто хочет понимать LLM глубже интерфейса чат-бота.

Внутри: — отдельные нейроны и базовые принципы обучения — архитектура трансформеров — ускорение генерации — работа моделей на нескольких видеокартах — KV-кэш — FlashAttention — обучение на человеческих предпочтениях — расчёты потребления памяти — примеры кода на PyTorch

Материал на английском, математики много, формулы тоже на месте. То есть читать придётся не как тред в X, а как нормальный технический учебник — с паузами, заметками и периодическим «так, а почему это вообще работает».

Конспект: https://alisawuffles.notion.site/alisa-s-book-of-llms

Sep 23, 03:01 PMMore from @omggpt

Every neocloud buys the same accelerators from the same supplier, on the same roadmap.

The hardware edge lasts about a year.

Scheduling, placement, and failure recovery last.

Most providers are competing on the layer that’s disappearing, ignoring the critical role of the GPU orchestration layer.

Aethir has been providing compute orchestration services from day one. Our compute fleet spans a global network of independent Cloud Hosts, with 430,000 GPUs across 200+ locations in 94 countries, coordinated by Aethir.

Read our new blog for the full rundown👇

https://x.com/AethirCloud/status/2102751385716502800

🔥 Видеокарта Asus GeForce RTX 5070 OC 12 ГБ

Старая цена — 92.900₽ Новая цена — 78.179₽ (с кодом ENKGV1VS)

Товар по ссылке

Цена зависит от аккаунта — она может быть как выше так и ниже

🍀 Чудо Скидки — подписаться

Sep 23, 12:17 PMMore from @chudo_skidki

🖥 Видеокарта Asus GeForce RTX 5070 OC 12 ГБ

Старая цена — 92.900₽ Новая цена — 78.179₽ (с кодом ENKGV1VS)

Товар по ссылке

Цена товара может отличаться, размер скидки зависит от вашего аккаунта

👉 Промокоды & Кешбэк. Подписаться

🔥ASUS *Upgrade Bundle che costa meno di una rtx 5070 TI usata e che va come una rtx 5080🔥

Prime Radeon RX 9070 XT OC Edition 16GB GDDR6 Gaming Grafikkarte

🔹 Axial-tech-lüfter verfügen jetzt über eine kleinere lüfternabe 🔹 Zuverlässige netzteil-leistung 🔹 Das phase-change-gpu-wärmeleitpad sorgt für eine optimale wärmeübertragung und senkt die gpu-temperaturen für mehr leistung und zuverlässigkeit 🔹 Langlebiger lüfter

A soli 911,89€ 🧨

Venduto e spedito da Amazon

Visualizza su Amazon 🍀 | Discutine 👥

#Adv - Disclaimer Prezzi