TGScope
Settings
Theme
OrganizationDeepSeekSeptember 2026

DeepSeek — September 2026

What Telegram channels wrote about DeepSeek in September 2026: 510 posts from 372 channels, collected automatically from public Telegram channels.

510 posts·372 channels

More posts — page 3

510 posts total

Opus 5.5 ожидаемо занял первое место на Arena в разработке фронтов. На деле разница с Astra больше, чем кажется. В детальной статистике видно, что GPT-6 Astra проигрывает дуэль Opus 5.5 с вероятностью 60%.

Из китайских моделей сильнее всех Qwen 3.8 Max, но больше удивляет Qwen 3.8 27B, который по рейтингу находится на уровне GLM 5.3 Flash и DeepSeek V4. Конечно, это лишь способность SLM рисовать «мордочки» больше, но этот карапуз делает это невероятно, раз сумел затесаться среди топовых LLM.

Sep 24, 09:21 AMMore from @turboproject

🎉👋 Нейронки для вайбкодинга. Что выбрать?

Давайте составим рейтинг ии агентов, которые чаще всего используют для создания айти продуктов.

1️⃣Claude code. Безоговорочные лидер, особенно с новой моделью Opus 5.5. Подписка от 20$.

2️⃣Codex. GPT-6 Sol - главный конкурент клода. Хоть и по качеству не уступает клоду, но новая модель жрёт лимиты очень быстро, тарифа Pro за 20$ вам просто не хватит ни на что.

3️⃣Zcode. Использую GLM-5.3 Flash Max. Работает медленнее Клода, где-то как GPT, по качеству может быть хуже, но лучше Sonnet 5 и самостоятельно может работать часами пока не выполнит задачу. За это почётное 3 место. Подписка от 18$, по моей ссылке первый месяц 16$.

Остальное я не использовал, но читал отзывы:

4️⃣Kimi Code. Kimi k3 считается топовой моделью не сильно уступающей клоду и GPT. Подписка от 20$.

5️⃣Cursor. Тут можно пользоваться разными моделями и т.к. Илон Маск купил курсор, то есть щедрые лимиты на Grok. которая тоже вроде ничего. Подписка от 20$.

6️⃣Xiaomi MiMo. На днях выпустили. В рейтингах догоняет топов. Подписка от 20$.

Дальше обозначу пару категорий моделей:

7️⃣во первых модели от Google и meta, где нет стандартных подписок как выше и нужно постараться чтобы тот же Antigravity от гугла заработал из РФ. У меня так не получилось это.

8️⃣модели без подписок, работают через API. В целом, все ии модели работают через API, это их основной доход. Но Deepseek и Qwen в принципе не имеют подписки и отдельного приложения как у Клода, GPT и ZCode.

Есть конечно ещё модели и инструменты для кода вроде Hermes, OpenCode и др. но вышеперечисленные самые популярные. Рейтинг моделей можно глянуть на арене, а цены и подключить апи в Openrouter.

Напомню, кто давно хотел начать создавать свои айти продукты, но не знает с чего начать, сегодня начинаем курс по созданию IT продуктов с помощью ИИ для начинающих. Подробности и запись тут.

🤖 В эпоху AI

У бизнеса появился ещё один канал, в котором важно быть заметным — ответы нейросетей.

Пользователь может не идти в Яндекс или Google, а сразу спросить ChatGPT, Алису или Perplexity, какой сервис выбрать или где заказать услугу. И получить несколько конкретных рекомендаций.

Вопрос — будет ли среди них ваш бренд.

Работу с видимостью бренда в ответах нейросетей называют GEO — Generative Engine Optimization.

Вручную за этим сложно следить: запросов могут быть сотни, моделей несколько, а ответы меняются со временем. Понять, что именно происходит с вашим брендом в GEO, помогает ГЕОранк.

Добавляете бренд, конкурентов и запросы потенциальных клиентов. Сервис проверяет ответы ChatGPT, Алисы, Gemini, Perplexity, DeepSeek, других моделей и показывает: — как часто ваш бренд упоминают и рекомендуют, на каких позициях он появляется; — каких конкурентов рекомендуют чаще; — в каком контексте говорят о компании и на какие источники ссылаются; — по каким запросам вас находят; — меняется ли видимость после работы с GEO.

Можно отслеживать динамику: как меняется видимость после работы с сайтом, контентом и внешними площадками.

Но дело не только в цифрах. ГЕОранк анализирует результаты и даёт рекомендации: какие зоны проседают, с какими источниками стоит работать и где есть потенциал для роста.

Проверить свой бренд → georank.ru

Sep 24, 09:00 AMMore from @vladm

Технический отчёт DeepSeek-V4.1-Flash — часть 1/2

Разберём технический отчёт DeepSeek-V4.1-Flash. В первой части обсудим архитектуру модели. Главное достижение авторов — экстремальное сжатие KV-кеша. При стандартном для frontier-моделей максимальном контексте в миллион токенов глобальный KV-кеш на один токен составляет 890 байт, что делает инференс даже максимального числа токенов почти бесплатным (менее одного гигабайта в сумме).

В архитектуре DeepSeek-V4.1-Flash каузальные энкодер и декодер, у каждого по 20 слоёв. Энкодер-декодер-архитектура выбрана не случайно: это помогает экономить вычисления. Нижняя половина слоёв формирует глубокое представление префикса, на которое затем аттендится декодер. В случае короткого промпта это позволяет в среднем в два раза сократить стоимость вычислений.

DeepSeek-V4.1-Flash — MoE-модель на 552 миллиарда параметров, плюс 196 миллиардов в Engram. На префилле активируются 8 миллиардов параметров, а на декоде — 16 миллиардов. Размер скрытого представления — 5120; количество аттеншн-голов — 64. Есть sliding window attention, один shared-эксперт и 384 маршрутизируемых. На один токен активируются шесть экспертов.

Кроме того, с самого начала обучения использовались изображения, так что модель — нативно мультимодальная. Изображение проходит через DeepSeek-ViT (32 слоя, 2D-RoPE), далее применяется pixel unshuffle 3х3, MLP-проектор, и всё это перегоняется в текстовый эмбеддинг. Вместо привычной свёртки для отображения пикселей в токены применяется линейный слой, что даёт возможность использовать Muon.

Как работает каждый из компонентов. На префилле энкодер делает полный проход по префиксу. На декоде глобальный KV-кеш проецируется из скрытого представления последнего, двадцатого слоя энкодера. Хидден подаётся не напрямую, а отображается layer-specific-проекциями. Это позволяет экономить на кеше в декодере.

Ещё одна важная особенность модели — Compressed Sparse Attention 2 (CSA2) в нескольких режимах, против CSA и Heavily Compressed Attention (HSA) в базовой DeepSeek-V4-Flash. О том, что такое CSA и HSA, мы писали вот тут, а в этом разборе сосредоточимся на режимах CSA2. Всего их три:

— Full Mode — вычисляем полный KV-кеш и делаем полный аттеншн, но оставляем возможность определять важные и неважные токены, имея некие индексы. На части хороших кандидатов аттендимся сразу, а часть — 16 тысяч — передаём дальше.  — Reindex Mode — аттендимся на KV-кеш из Full Mode, выбираем из переданного пула хороших токенов своих кандидатов. — Reuse Mode — переиспользуем Top-K-индексы от Full Mode. Самый частый блок: 15 из 20 и на префилле, и на декоде.

Во второй части продолжим разговор об архитектуре, а также затронем претрейн и посттрейн.

Разбор подготовил ❣ Денис Кузнеделев

Душный NLP

Sep 24, 08:48 AMMore from @stuffynlp

DeepTech трек на Yandex Scale'2026 — для тех, кому интересны технологии

Yandex Scale — флагманская конференция Yandex Cloud. На технологическом онлайн-треке DeepTech можно послушать про инженерные задачи и кейсы специалистов Яндекса.

Подключайтесь, если находитесь на старте своей карьеры и хотите узнать про реальные решения в индустрии.

ㅤ В программе 6 докладов ➡️

🟦 Евгений Дюков расскажет, как LuaJIT и Lua 5.5 помогли ускорить Lua в Valkey™ в 2–5 раз

🟦 Владислав Носивской на примере DeepSeek разберёт оптимизацию инференса для агентских сценариев

🟦 Александр Зевайкин покажет, что происходит с алгоритмами поиска, когда YDB одновременно нужны распределённость, транзакционность и линейное масштабирование

🟦 Сергей Нестерук разберёт архитектуру платформы Yandex Cloud, которая помогает безопасно выводить ИИ-агентов в прод

🟦 Даниэль Халиулин поговорит про первое публичное решение для мониторинга ИИ-агентов в РФ

🟦 Костя Крамлих разберёт, как Interconnect, Private Link, Inbound DNS и DNS Firewall помогают собрать герметичный контур между Yandex Cloud, on-premises и другими облаками.

Yandex Scale’2026 — встречаемся сегодня онлайн в 14:00

🤖 Каким ИИ пользуются юристы: топ-5 по вашим ответам

Я спросила в Instagram, чем вы пользуетесь в работе, и получила 34 ответа. Картина вышла понятная: универсальные нейросети берут для черновиков, а выводы со ссылками на нормы ищут в системах, собранных под российское право.

Разобрала пятёрку лидеров.

🔵Стриж, 12 ответов. ИИ-ассистент под российское право. К каждому выводу даёт кликабельную ссылку на норму или судебное решение, опирается на СПС Гарант и обзоры практики Верховного и Конституционного судов. Платный, от 1 000 ₽ в месяц, пробный период 3 дня. Финальная проверка остаётся за юристом, так пишет и сам сервис.

🔵ChatGPT, 7 ответов. Универсальная нейросеть от OpenAI. Помогает быстро набросать черновик письма, претензии или структуру позиции. Официально в России недоступен с 2024 года, нужны VPN и зарубежная карта. К КонсультантПлюс и Гаранту не подключён и может выдумать номер дела или статью. Персональные данные доверителей в зарубежные сервисы не загружай.

🔵Claude, 5 ответов. Нейросеть от Anthropic. Удобно разбирать длинные документы целиком: на платных тарифах до 200 тысяч токенов, это около 500 страниц за раз. Официально в России тоже недоступен, нужны VPN и зарубежная карта. Актуальных редакций законов не видит, поэтому каждую ссылку сверяй по СПС.

🔵Алиса AI и Нейроюрист, 2 ответа. ИИ от Яндекса, работает в России без VPN. В Алисе AI есть режим «Юрист» с законодательством РФ. Нейроюрист запущен в ноябре 2025 года и подкрепляет ответы ссылками на материалы Гаранта. Бесплатно 20 запросов в месяц, дальше подписка в Yandex Cloud.

🔵КонсультантПлюс и Гарант, 2 ответа. ИИ-помощник КонсультантПлюс ищет ответ строго в базе системы и отдаёт подборку документов со ссылками, видно актуальность редакции. ИСКРА от Гаранта готовит краткое заключение со ссылками на законодательство и шаблоны документов. Нужен доступ к платной системе: у ИСКРЫ 3 дня бесплатно, у КонсультантПлюс пробный доступ по заявке.

⚖️ Что из этого следует. Для российского права надёжнее системы, которые отвечают со ссылками на нормы и практику: Стриж, Нейроюрист, ИИ в КонсультантПлюс и Гаранте. ChatGPT и Claude оставь для черновиков и сверяй по СПС каждую статью и номер дела. Ответственность за ошибку в любом случае несёт юрист.

Остальные ответы из опроса: DeepSeek, Perplexity, LawGPT, Legal Brain, ExplainLaw, CasusLegal. И один честный: «пользуюсь только мозгом» 😄

А чем пользуешься ты? Напиши в комментариях, дополним список 👇

Sep 24, 07:05 AMMore from @iyourlawyer

Структура рынка LLMs

Проанализировал статистику OpenRouter – собрал более 450 моделей (там нет национального и модельного среза, поэтому агрегацию пришлось делать самому), вышедших с января 2025 (почти 100% всего трафика в системе), что позволит понять распределение предпочтений в сегменте ИИ.

Все выводы относятся к наблюдаемому потоку OpenRouter, а не ко всему мировому рынку LLM. Страна означает происхождение разработчика, а не пользователей или серверов.

Пока без графиков. Я устал править кривой ТГ, уничтожающий все форматирование. Нет ответа, почему руки из задницы растут по элементарным функциям.

🔘Экспоненциальный рост потребления токенов. Недельный поток увеличился с 4.9 трлн токенов в середине сентября 2025 года до 128.9 трлн в сопоставимую неделю 2026 года, т.е в 26.2 раза.

🔘География разработчиков практически двухполюсная: Китай и США занимают почти всё пространство. За 26 июля – 23 сентября на китайские модели приходится 63.75% токенов, на американские – 34.70%, вместе 98.45%. Всем остальным странам и неустановленным разработчикам остаётся 1.55%.

🔘Китайское доминирование стало устойчивым форматом, а не кратковременным эффектом отдельного релиза. В недельной истории китайские разработчики опережают американских 16 полных недель подряд, начиная с 1 июня, а долю выше 50% удерживают 12 недель подряд, начиная с 29 июня. Главный признак структурного перехода здесь – не максимальная доля, а продолжительность сохранения нового соотношения сил.

🔘Доминирование по токенам не означает такого же доминирования по количеству обращений. За весь 60-дневный период Китай обеспечил 46.6% запросов, США – 50.3%, несмотря на почти двукратный китайский перевес по токенам. Средний запрос к китайским моделям содержит около 29 тыс токенов против 14.6 тыс у американских: существенная часть разрыва связана с токеноёмкостью использования, а не с числом обращений.

🔘Американские модели теряют относительный вес, но на месячном горизонте их использование продолжает быстро расти. Между сопоставимыми 28-дневными окнами американский поток токенов увеличился на 43.7%, китайский – на 51.1%.

🔘Последняя неделя показывает более жёсткую ротацию: за 17–23 сентября китайский поток увеличился на 15.6%, американский сократился на 14.7%, доли составили 68.4% и 29.2% соответственно.

🔘После исключения кэша китайское преимущество сохраняется, но становится значительно скромнее. В потоке без кэшированного входа доли Китая и США за 60 дней составляют 50.4% и 46.1% вместо 63.75% и 34.70% в общем счётчике. При этом Китай обеспечивает около 60% выходных токенов.

🔘Объяснение китайского большинства исключительно бесплатностью не подтверждается. После исключения вариантов с пометкой free и известных анонимных бесплатных предварительных версий доля Китая не снижается, а увеличивается до 67.2% за весь период и 72.6% за последнюю неделю.

🔘Сотни доступных моделей сосуществуют с крайне узким распределением использования. За последнюю неделю крупнейшие 5 моделей обеспечили 51.6% токенов, крупнейшие 20 – 80.4%.

🔘Почти весь дополнительный поток достаётся четырём разработчикам. Tencent, OpenAI, Z.ai и DeepSeek обеспечили 87.0% чистого прироста токенов между сопоставимыми 28-дневными окнами.

🔘Китайская тройка уже существенно масштабнее американской тройки по наблюдаемому потоку. DeepSeek, Z.ai и Tencent за последнюю неделю суммарно обеспечили 56.6% токенов, тогда как OpenAI, Google и Anthropic – 20.7%. Разрыв составляет примерно 2.7 раза.

🔘Даже сильный месячный результат не гарантирует сохранения текущего импульса. OpenAI увеличила поток на 105.6% между 28-дневными окнами (это эффект Luna и демпинга в 10 раз), но в последнюю неделю потеряла 32.5% относительно предыдущей.

🔘Китайский успех не означает успеха каждого китайского разработчика. За сопоставимые 28-дневные окна Tencent выросла на 119.5%, Z.ai – на 83.4%, тогда как Xiaomi сократилась на 8.9%, MiniMax – на 18.2%. Национальный агрегат скрывает сильную внутреннюю конкуренцию.

🔘Новые поколения LLMs практически всегда приводят к снижению использования предшественника. Tencent Hy4-preview (в группе лидеров) получила 52.65 трлн токенов за последние 28 дней, одновременно Hy3 потеряла 14.38 трлн относительно базового окна, хотя стоимость между ними различается в разы в пользу дорогой Hy4.

🔘Рост имеет два источника: больше обращений и больше токенов внутри каждого обращения. Совокупный поток за последние 28 дней увеличился на 49.8%, число запросов – на 30.9%, средняя токеноёмкость запроса – на 14.4%. В арифметической декомпозиции примерно две трети прироста связаны с количеством обращений и одна треть – с их увеличившимся объёмом.

🔘Токенный поток уже способен расти при сокращении обращений и выходной генерации. За последнюю неделю токенов стало больше на 4.7%, запросов меньше на 3.5%, выходных токенов меньше на 1.8%; кэш обеспечил 96.3% прироста общего потока.

🔘Дорогие модели – узкий сегмент использования, а не основа токенной экспансии. На класс с выходной ценой от 20 долл приходится 2.88% токенов и около 1.1% запросов за последние 28 дней. Его вклад в общий прирост токенов составляет лишь 0.44%: основное расширение платформы происходит далеко от верхней ценовой границы.

🔘В дорогом сегменте Anthropic заметно масштабнее OpenAI по накопленному потоку. Anthropic обеспечивает 73.2% дорогих токенов, OpenAI – 26.8%.

🔘Массовые модели – на ненулевые тарифы до 5 долл за миллион выходных токенов приходится 82.6% потока, вместе с бесплатными вариантами – 90.6%. Эти две группы обеспечили 97.1% чистого прироста между сопоставимыми окнами: расширение использования происходит почти целиком в нижней части ценовой шкалы.

🔘Китайская структура использования значительно сильнее смещена к низким тарифам. Около 95.1% токенов китайских моделей приходится на ненулевые выходные тарифы до 5 долл, у американских моделей – 59.8%.

🔘Две китайские Flash-модели уже концентрируют больше четверти всего недельного потока. GLM-5.3-Flash и DeepSeek V4.1-Flash вместе обеспечили 28.6% токенов за последнюю неделю.

Últimos Posts Xataka, wwwhatsnew, Genbeta 24/09/2026

Xataka

1.- El 6G aún no ha llegado y ya hay quien hace cuentas para sacarle jugo económico: hasta 15.000 millones sobre la mesa

2.- Una profesora universitaria lo admite: "no hay ningún motivo para creer que los jóvenes Gen Z vayan a tener seguridad económica"

3.- Europa quiere depender menos de EEUU en chips de IA. Alemania y Países Bajos tienen un plan: usar IA para diseñarlos

4.- "Va a ser imposible hacer juegos grandes a partir de ahora". ¿Están los grandes recortes en el sector condenando el desarrollo de blockbusters?

5.- Las empresas han encontrado otra forma de atraer talento: ofrecer acciones junto al sueldo para compartir beneficios y riesgos

6.- Han organizado un combate de MMA entre un youtuber y un robot a lo 'Terminator': la máquina le ha soltado una patada monumental

7.- Volkswagen ya recibe más pedidos de coches eléctricos que de gasolina y diésel en Alemania. Y eso les ha obligado a cambiar de plan

8.- En China, los padres helicóptero no compran móviles a sus hijos, les compran un smartwatch para tenerlos controlados

9.- Comprar la NVIDIA Shield TV Pro fue todo un acierto: con ella disparé el rendimiento de mi tele y es el TV box que siempre recomiendo

10.- Apple está explorando un rival de Whoop. Lo interesante no es lo que tendrá, sino lo que le quitará al Apple Watch

wwwhatsnew

1.- China investiga a DeepSeek y Moonshot por robar datos a Claude mientras Xiaomi lidera el open-weight con MiMo-V2.6

2.- Cómo configurar los altavoces Sonos paso a paso (y cómo resolver los problemas de conexión más frecuentes)

3.- El Apple Home Hub está casi listo: pantalla con reconocimiento facial, Siri AI y diseño que mezcla iOS con tvOS

4.- La batería de coche eléctrico que carga del 10 al 97% en 9 minutos y funciona a -20 grados centígrados

5.- El reactor que produce 800 barriles diarios de combustible sostenible para aviación: por qué importa ahora

6.- Un átomo de diferencia: ingenieros duplican la velocidad de la enzima que come plástico PET

7.- Anthropic lanza Claude Opus 5.5: más potente que Opus 5, un 40% más barato de usar y con las salvaguardas más estrictas que ha tenido jamás un modelo Opus

8.- Adobe Premiere llega a Android de forma gratuita: edición multipista, IA Firefly y exportación en 4K sin marcas de agua

9.- Corridor recauda 25 millones de dólares en seed para llevar la gestión de seguros médicos con IA a las pymes

10.- Cómo mejorar el sonido surround de tu casa sin comprar nada nuevo

Genbeta

1.- Así ha cambiado Internet en los 20 años transcurridos desde el lanzamiento de Genbeta

2.- Un jefe boomer no entendía que sus empleados millennials no quisieran cargos directivos. Ellos tienen claras las razones

3.- Meta se ha puesto a la cabeza de la carrera de los agentes de IA adquiriendo Manus por 2.000 millones de dólares

4.- "Será un trabajo estresante", promete Sam Altman en esta oferta. Por eso ofrece más de medio millón de dólares de sueldo

5.- El CEO de Randstad afirma que el teletrabajo ahora se reserva solo para talentos "muy especiales" y explica quién tiene este perfil

6.- He comprado online porque en mi pueblo cada vez hay menos tiendas.... y siento que el proceso agota: es como horas extra de trabajo

7.- El cibercrimen ya no sólo es digital: 2025 ha sumado muertes y torturas a su historial

8.- La IA ha desatado la furia de este creador del lenguaje Go. Sólo ha necesitado enviarle un e-mail de agradecimiento

9.- Cadenas de TV como Telecinco o Antena 3 critican los "realities" de Internet: "La Casa de los Gemelos" campa a sus anchas en YouTube

10.- El planazo pionero de China para evitar que los chatbots de IA aconsejen mal: recurrir a los humanos cuando hay temas espinosos

@MundoTecnologico Últimos Posts

🎬 Не успели мы познакомиться с тем, что Opus 5.5 — хороший композитор, но теперь оказывается и выдающийся сценарист. Как говорят господа из Towards AI, новый Claude почти сломал их бенчмарк.

Задание в этом бенчмарке для разных ИИ — написать сценарий популярного ролика на YouTube. Оценивают вслепую три LLM-судьи из разных семейств (Anthropic, OpenAI и DeepSeek) по нескольким критериям с учётом ещё специфических YouTube-оптимизаций типа Hook Strength, то есть способности зацепить зрителя в первые 15 секунд и т. п.

Судя по очень разным оценкам нишевых бенчмарков, новый фронтир у Дарио получился очень удачный. Я бы на его месте уже побежал на IPO, пока какой DeepSeek V5 или GPT-7 Galaxy не прилетел.

https://x.com/Whats_AI/status/2102787126727156144

Sep 24, 03:12 AMMore from @turboproject

🚩 Fuli Luo опубликовала новую архитектуру HySparse2, на которую перейдёт MiMo V3. Сходство с DeepSeek V4.1 довольно очевидное, да и сама она один из бывших создателей DeepSeek. Однако крайне тревожный момент, что всё больше ситуация напоминает: архитектуры Сбербанка и Яндекса ошиблись, начав копировать модный китайских гибрид GPT+State для тяжелых LLM как в Kimi K3.

Дело в том, что гибрид как в Kimi K3 потенциально сильнее в IQ, т.к. лучше понимает глобальный контекст в своём State. Однако чтобы реализовать это преимущество, нужно иметь суперкластер, аналогичный доступному Kimi, а также очень сложные пайплайны RL-обучения с тысячами песочниц. В случае Сбербанка и Яндекса там нет такого ресурса GPU, а практика Reinforcement Learning ограниченная. Достаточно указать, что Яндекс выпустил только Base-модель своей Алисы без RL, но её хватило, чтобы перебить RL-обучение GigaChat, т.е. у Яндекса недовели RL до конца, у Сбера оно такое слабое, что Base перебить не может у Яндекса. Я уже писал про это по бенчмаркам.

Однако в архитектуре GPT+State есть серьёзная уязвимость для построения «worker-агентов», т.е. агентов-делателей. Для начала DeepSeek и Xiaomi решили опираться на идею YOCO (self-/encoder-часть готовит глобальные KV, которые верхняя/cross-/decoder-часть переиспользует). Это даёт ранний выход из prefill: после self-decoder / causal encoder можно остановиться и не гонять весь prompt через верхние слои. В случае агентов им нужно без конца «префилить» контекст, т.к. они постоянно его перечитывают. Поскольку у DeepSeek и Xiaomi нейросети умеют подготовить векторную репрезентацию контекста и выйти, то они просто громят по эффективности и старые GPT, и GPT+State.

Второй аспект. У DeepSeek и Xiaomi более точное цитирование при маленьких затратах VRAM за счёт разреженного внимания на Top-K лучших токенов. В Mamba-like моделях это огромная проблема, т.к. State сжимает информацию с потерями, поэтому там возникает проблема в точности цитат, что в том же коде сразу же syntax error. Чтобы это решить, и Kimi K3, и GigaChat добавляют слои на Full Attention, чтобы нейросеть лучше видела цитаты, но он чудовищно неэффективен относительно разреженного внимания DeepSeek и Xiaomi по расходу GPU и VRAM.

Проще говоря, сейчас DeepSeek и Xiaomi могут установить феерически низкий ценник по API, что даже сделали, а также делать бессмысленным установку других моделей локально для агентов. Самое время командам Сбера и Яндекса подумать, туда ли они идут. Пытаться сделать «русский Kimi K3» — хорошая идея для маркетинга, но пока задача хотя бы не флешки китайцев догнать, а даже Qwen 3.8 27B. Надо быть реалистичнее в том плане, что ты делаешь не самую умную LLM, но которая полезна как агент-исполнитель, а не агент-думатель. Так вот, агенты-исполнители, похоже, не делаются на гибридах через State лидерами рынка и ведущими учёными в LLM.

https://arxiv.org/pdf/2609.26368

Sep 23, 05:27 PMMore from @turboproject

Лян Вэньфэн — создал DeepSeek, который лидер Flash-моделей Ян Чжилинь — создал Kimi, который впервые поборолся из китайцев с Claude Тан Цзе — создал GLM, где многие считают, что лучший баланс цены и качества Ло Фули — создала MiMo, самую дешёвую Flash-модель с топовым IQ Янь Цзюньцзе — создал MiniMax, который взорвал рынок генерации видео в ИИ Цзян Дасинь — бывший вице-президент в Microsoft, который руководил созданием Bing, Cortana и облачной платформы Azure, а сейчас создал популярную китайскую LLM.

В ИИ-бизнесе, как в любом стратегическом, крайне важны визионарии. Если вы делаете что-то масштаба ракетных и ядерных технологий, то без Королёва и Курчатова вы скорее обречены быть создателем посредственных копий лидеров. В России были мощные эксперты в ИИ, как Досовицкий, который и наделил Gemini его лучшим зрением среди LLM. Если не выдвинуть в руководство российских ИИ-проектов таких же мощных экспертов, то вряд ли что хорошее выйдет. Нельзя заменять экспертов на клоунов и шоуменов. Тот же Цзян Дасинь — доктор наук и уважаемый в отрасли эксперт.

Sep 23, 04:24 PMMore from @turboproject

Попробовали мы тут спросить у нейросети про диету при онкозаболеваниях…

И хорошо, что попробовали, потому что теперь напишем этот пост и, возможно, кому-то поможем 💙

Кратко: пожалуйста, не пользуйтесь нейросетями для получения советов на тему своего здоровья. Они могут крепко начудить и посоветовать вам совершенно не то, что нужно.

➡️ Итак, полученная нами цитата, «автор» – deepseek:

«Как же должен выглядеть стол онкобольного? Основной принцип — это полувегетарианская диета с достаточным количеством белка, преимущественно растительного (бобовые, соя), но с включением небольшого количества животного белка (мясо птицы, телятина, нежирная рыба)».

Подвох в том, что заподозрить ошибку непросто, потому как информация тут отчасти верная:

🔵 Достаточное количество белка – действительно один из основных принципов построения рациона 🔵 Красное мясо, к которому относится телятина, и правда стоит ограничить, особенно переработанное, в виде фарша, колбасы и т.п. 🔵 Употреблять белок из разных источников, животных и растительных, – тоже правильная мысль. Это поможет получать все необходимые аминокислоты, да и просто разнообразить рацион

⚡️ Но вот откуда идея, что на первом месте должен быть растительный белок? И почему в опале оказались мясо птицы и рыба? Совершенно непонятно. И поясним, как обстоят дела в реальности:

✅ Животный белок усваивается гораздо лучше растительного – более 90%, против ~60–80%. Так что при равном количестве съеденного белка вы получите фактически больше белка именно из животной пищи ✅ Рыба – прекрасный источник легкоусвояемого белка, полезных жиров, витаминов и минералов. Она никак не под запретом, может быть на столе хоть каждый день, это только на пользу ✅ Мясо птицы – тоже хороший источник белка, особенно если говорить про нежирные сорта, например, индейку. Впрочем, если нет проблем с ЖКТ, то и куриное мясо тоже отлично вписывается в рацион, белка в нем много

❗️ В заключение – убедительная (надеемся!) просьба. Пожалуйста, проверяйте информацию, из какого бы источника вы ее ни получили, когда дело касается вашего здоровья. А лучше всего – задавайте вопросы вашему лечащему врачу.

Подписаться на «Есть, чтобы жить. Питание для онкопациентов»: 💬 Telegram | 💙 Вконтакте | 💬 Одноклассники | 📝 Дзен

🇺🇦 У шкідливого ПЗ з’явилася рада директорів. Людей не взяли.

Cisco Talos знайшла ClosedQuorum для Windows. За задумом авторів, Gemini, DeepSeek, Qwen і Mistral голосують за наступний крок на зараженому ПК, зокрема крадіжку паролів. Якщо голоси поділилися порівну, вирішує DeepSeek.

Реальних атак поки не підтвердили, а публічний зразок містить лише ключі-заглушки для доступу до ШІ.

Людину з процесу прибрали. Нараду залишили. — 🇬🇧 Malware now has a board of directors. No humans hired.

Cisco Talos found ClosedQuorum for Windows. Its design has Gemini, DeepSeek, Qwen and Mistral vote on the next action on an infected PC, including password theft. DeepSeek breaks a tie.

Use in real attacks remains unconfirmed, and the public sample contains only placeholder AI access keys.

They removed the human from the process. Kept the meeting.

ЗДОРОВА, ЗАСРАНЦЫ И КОЧ БРАТАНЫ!

25 СЕНТЯБРЯ — ДВОР КУЛЬТУРЫ JACKASS!

Я — череп из дипсика. Хз че делать запрос говно, но будет какая-то туса

Вас ждёт музыкальная селекция и клабшоу ну вы поняли нью-джазик и нефорский рэп. У парней какое-то ПРОГРАММНОЕ ОБЕСПЕЧЕНИЕ, так что точно газ. ⛔️Без вентиляторов и других кондиционеров.⛔️

вход фри до 23:00, далее — 1000₽

Казанская, 7д Резерв столов: @dvorkulturivspb Пре-пати: 21:00 Клуб: 00:00 18+ | фс/дс

Возвращение кита: вышла DeepSeek V4.1 Flash — новая быстрая модель, которая бьет GPT-5.6 Sol! 😮

Главное:

🟢 Это MoE-модель на 552 млрд параметров, которая заточена под кодинг и агентные задачи. На DeepSWE v1.1 она набрала 74,2 балла, что выше GPT-5.6 Sol и Claude Opus 5!

🟢 В CyberGym тоже обошла GPT-5.6 Sol: 88 против 84. А на Automation-Bench вообще стала лучшей.

🟢 Стоит при этом от $0,15 за 1 млн входных токенов и $0,60 за выходные. Красота.

Уже на Hugging Face 😉😉

НейроТренды

Появился новый вызов: «нас вообще видно в ответах нейросетей?» Раньше беспокоились о выдаче в Google и Яндексе, теперь — о ChatGPT и других ИИ.

Всё чаще люди спрашивают у нейросетей не просто факты, а совет: где купить, кого выбрать, какой сервис лучше. И если в рекомендациях появляется ваш конкурент, а вас — нет, это уже потеря клиентов.

Так возникло понятие GEO — продвижение бренда в ответах ИИ.

Но как понять, что происходит «внутри» нейросетей? Вручную проверять массу запросов и моделей почти невозможно — ответы меняются каждый день.

Поможет ГЕОранк — российский сервис, который автоматически отслеживает, упоминают ли ваш бренд в ChatGPT, Perplexity, Gemini, DeepSeek, Алисе и других.

Добавьте бренд, конкурентов и запросы — и сервис покажет, где вас рекомендуют, где вы проигрываете, на каких позициях появляетесь и какие источники влияют на ответы.

Теперь вы не гадаете: видно чётко, по каким запросам вас нет в рекомендациях и что нужно усилить. 🚀

IT Тренды

Есть новая версия вечного вопроса «а мы вообще есть в выдаче?». Только теперь речь не про Google и Яндекс, а про ChatGPT и другие нейросети.

Люди всё чаще спрашивают у них не просто информацию, а конкретные рекомендации: какой сервис выбрать, где заказать услугу, какую компанию рассмотреть. Нейросеть сразу выдаёт несколько вариантов — и среди них может быть ваш конкурент, а вас вообще не быть.

Отсюда и появился GEO — продвижение бренда в ответах и рекомендациях нейросетей.

Но сначала нужно понять, что там происходит сейчас. Руками это проверять сложно: запросов много, моделей тоже, а ответы постоянно меняются.

Для этого есть российский сервис ГЕОранк. В него добавляете бренд, конкурентов и нужные запросы, а сервис сам проверяет ответы ChatGPT, Perplexity, Gemini, DeepSeek, Алисы и других моделей.

В кабинете видно, по каким запросам нейросети рекомендуют вас, где вместо вас показывают конкурентов, на каких позициях появляется бренд и какие источники влияют на ответы.

Так можно не продвигаться в GEO вслеп

Sep 23, 11:12 AMMore from @aijourn

Jina AI прокачала DeepSeek-OCR и ускорила разбор документов

Модель рассчитана на локальный запуск даже на недорогих системах. На вход можно подать скан, фотографию или PDF, а на выходе получить Markdown с поддержкой LaTeX.

Кроме полной транскрипции, модель умеет: — распознавать таблицы — разбирать формулы — подписывать изображения — отвечать на вопросы по документу — извлекать ключевые поля

В основе — DeepSeek-OCR с визуальным энкодером DeepEncoder на 380 млн параметров. Он сжимает страницу до 256 визуальных токенов, а при необходимости добавляет до 9 фрагментов по 100 токенов. Декодер — MoE-модель на 3 млрд общих и 570 млн активных параметров.

Главный вклад Jina — спекулятивное декодирование FastMTP. Один общий блок предлагает сразу 3 токена вперёд, а декодер принимает самую длинную часть, совпадающую с его собственным выбором. Проще говоря, модель пытается угадывать продолжение заранее и экономить время там, где угадала.

По тестам всё выглядит бодро.

Sep 23, 11:01 AMMore from @omggpt

✨ اگه برای تولید محتوا دنبال ابزارهای هوش مصنوعی هستی، این لیست رو از دست نده!

⬅️ امروزه برای هر بخش از تولید محتوا، ابزارهای مختلفی وجود داره؛ از سناریونویسی و ایده‌پردازی گرفته تا ساخت عکس، ویدئو، موسیقی و صدا. اما بین این همه ابزار، پیدا کردن گزینه مناسب می‌تونه زمان‌بر باشه. این لیست می‌تونه نقطه شروع خوبی برای انتخاب ابزار مناسب باشه:

✍️ برای سناریونویسی و ایده‌پردازی: Claude → نوشتن و بازنویسی سناریو و ایده‌پردازی ChatGPT → ایده‌پردازی، تولید متن و توسعه سناریو DeepSeek → کمک به تحقیق، ایده‌پردازی و تولید متن Meta AI → تولید و پردازش محتوای متنی 🖼 برای تولید عکس: Nano Banana → ساخت و ویرایش تصاویر با هوش مصنوعی ChatGPT → تولید تصویر و ویرایش خلاقانه Leonardo → ساخت تصاویر و طرح‌های خلاقانه Midjourney → تولید تصاویر هنری و واقع‌گرایانه 🎬 برای تولید ویدئو: SeeDance → ساخت ویدئو با هوش مصنوعی Google Omni → تولید و پردازش محتوای ویدئویی Veo → ساخت ویدئوهای خلاقانه Runway → تولید و ویرایش ویدئو با AI 🎵 برای آهنگ و صدا: ElevenLabs → تولید صدای طبیعی و تبدیل متن به گفتار Udio → ساخت موسیقی با هوش مصنوعی Suno → تولید آهنگ و موسیقی MusicGen → ساخت موسیقی بر اساس ورودی متنی 🎙برای بهبود و کیفیت صدا: Adobe Podcast → بهبود کیفیت و وضوح صدای ضبط‌شده CleanVoice → حذف نویز و بخش‌های اضافی صدا Voice AI → پردازش و تغییر صدای هوشمند Auphonic → بهینه‌سازی و تنظیم کیفیت فایل صوتی

@nazari_mobile ⭐️

Sep 23, 10:53 AMMore from @nazari_mobile

DeepSeek - это диалоговый чат-бот на базе искусственного интеллекта, разработанный одноименной китайской лабораторией. Его создатели утверждают, что этот ИИ конкурирует с моделью o1-preview от OpenAI, разработчиков ChatGPT. Но самое поразительное в этом приложении то, что у чат-бота есть инструменты для «самопроверки», поскольку он может тщательно «размышлять» перед ответом (процесс, который также подробно показывает экран при нажатии кнопки).

📤 Версия: 2.5.3 📁 Категория: #Нейросети 🤖 Android: 7.0 и выше 🔑 Моды: Extra mod (Регистрация / Авторизация через email) @ApkGeek

Sep 23, 10:30 AMMore from @apkgeek

La inteligencia artificial está siendo uno de los grandes temas de esta semana entre los líderes mundiales, con la Asamblea General de la ONU en Nueva York y la próxima reunión entre Donald Trump y Xi Jinping en Washington. También participan altos ejecutivos de grandes tecnológicas, y se espera que buena parte de las conversaciones giren en torno a regulación, seguridad y cooperación internacional en IA.

Sam Altman, CEO de OpenAI, y Dario Amodei, CEO de Anthropic, tienen previsto intervenir ante el Consejo de Seguridad de la ONU. OpenAI está defendiendo la creación de estándares internacionales sobre seguridad de la IA, mientras que Reino Unido quiere posicionarse como un posible intermediario en el debate regulatorio global.

Uno de los puntos más delicados está en la relación entre China y las empresas de IA. Anthropic ha acusado a varias compañías chinas de utilizar Claude de forma indebida y de enviar datos sensibles a través de sus sistemas, lo que ha llevado al regulador chino a investigar a DeepSeek y Moonshot AI. Todo esto podría convertirse en uno de los temas relevantes de fondo en la reunión entre Xi y Trump.

🟢Petrolio sotto i 100 dollari e bond in recupero: progressi nei colloqui USA-Iran. Nasdaq torna sui massimi storici

Il calo del petrolio torna a guidare i mercati. I prezzi del greggio scendono ancora dopo che Donald Trump ha segnalato progressi nei tentativi diplomatici per mettere fine alla guerra con l’Iran, favorendo gli acquisti sui titoli di Stato e riducendo le preoccupazioni sull’inflazione.

Il Brent perde circa lo 0,6% e scende verso 98,60 dollari al barile, avviandosi verso la serie negativa più lunga dell’ultimo anno. Più marcato il ribasso del WTI, che cede l’1,3% a 89,38 dollari.

👉USA-Iran, Trump: incontro “molto positivo”

Il movimento del petrolio arriva dopo che Trump ha dichiarato che funzionari americani hanno avuto un incontro “molto positivo” con rappresentanti iraniani, mentre Washington intensifica gli sforzi diplomatici per arrivare alla conclusione del conflitto. Il mercato guarda soprattutto alle possibili conseguenze sull'offerta energetica. Un eventuale cessate il fuoco potrebbe ridurre ulteriormente il premio per il rischio geopolitico incorporato nelle quotazioni del greggio e, soprattutto, attenuare le pressioni inflazionistiche generate nelle ultime settimane dall'impennata dell'energia. È proprio questo secondo effetto a sostenere questa mattina il mercato obbligazionario. I bond governativi di Australia e Nuova Zelanda avanzano, con il rendimento del decennale australiano in calo di 5 punti base al 5,25%, mentre salgono anche i future sui Treasury americani. Il mercato cash statunitense aprirà soltanto nella sessione londinese a causa della festività in Giappone.

Dopo che i rendimenti globali hanno raggiunto nelle scorse settimane livelli pluridecennali, un'ulteriore discesa del petrolio potrebbe togliere pressione alle banche centrali proprio mentre la Fed ha riaperto il ciclo dei rialzi dei tassi.

🔥Nasdaq sui massimi storici, continua il tema AI

Sul fronte azionario il quadro rimane positivo, anche se con movimenti più contenuti. L’MSCI Asia Pacific guadagna lo 0,1%, mentre i future su S&P 500 e Nasdaq 100 sono sostanzialmente invariati. I future sull’Euro Stoxx 50 avanzano dello 0,3%.

A Wall Street il Nasdaq 100 ha però aggiornato ieri i massimi storici, i primi dallo scorso giugno, ancora una volta sostenuto dai semiconduttori e dall'entusiasmo per l'intelligenza artificiale.

Rimane protagonista Muse, il nuovo AI agent di Meta. Shopify è balzata del 7,1% dopo aver annunciato una partnership con Meta, mentre il mercato sta iniziando a interrogarsi anche sui possibili settori penalizzati dalla diffusione degli agenti AI. Ieri le vendite hanno interessato in particolare alcuni titoli finanziari e broker, per il timore che l'intelligenza artificiale possa comprimere commissioni e margini. Segnale opposto dalla Cina, dove i titoli legati all'AI arretrano dopo indiscrezioni secondo cui le autorità avrebbero aperto un'indagine sulle startup DeepSeek e Moonshot AI per questioni relative alla sicurezza dei dati.

👉Trump-Xi, ora l'attenzione passa al vertice di Washington

L'altro grande appuntamento rimane l'incontro tra Donald Trump e Xi Jinping, previsto questa settimana a Washington. Le aspettative su un accordo strutturale rimangono contenute. Sul tavolo ci saranno dazi, commercio e le tensioni sulle materie prime critiche, con Stati Uniti e Cina che nelle ultime settimane hanno comunque mantenuto aperto il dialogo. Per i mercati potrebbe quindi essere importante anche semplicemente la conferma della volontà delle due potenze di evitare una nuova escalation commerciale.

👉Dollaro alla quarta seduta di rialzo, oro in calo

Sul valutario il dollaro continua a rafforzarsi: il Bloomberg Dollar Spot Index sale dello 0,2%, mettendo a segno la quarta seduta consecutiva positiva. L’euro scende dello 0,2% a 1,1424 dollari, mentre lo yen perde lo 0,2% a 157,67 per dollaro. Gli investitori attendono oggi anche un intervento del governatore Fed Michael Barr, alla ricerca di indicazioni sulla traiettoria dei tassi dopo che altri esponenti della banca centrale hanno avvertito che le pressioni inflazionistiche potrebbero rimanere persistenti. L'oro perde lo 0,7% a circa 4.330 dollari l'oncia, mentre Bitcoin sale a circa 86.600 dollari.

Эксперт объяснила, как выявить ложные ссылки на научную литературу, сгенерированные ИИ

Заместитель директора фундаментальной библиотеки РГПУ имени А.И. Герцена Светлана Морозова представила результаты исследования библиографических конфабуляций — правдоподобных, но несуществующих ссылок, которые генеративные модели создают для академических текстов и которые затем попадают в опубликованные научные работы, сообщает Поиск. По её словам, конфабуляция — не ошибка и не опечатка, а результат взаимодействия пользователя с моделью, когда запрос, вероятностная генерация и отсутствие проверки совместно производят несуществующий библиографический объект. Термин пришёл из медицины: человек заполняет пробелы в памяти данными, которые кажутся ему достоверными, без намерения обмануть — так и модель комбинирует реальные фамилии, фрагменты заглавий, журналы и годы с выдуманными.

В рамках проекта «ИИллюзИИ и галлюцитирования» исследователи проанализировали 54 статьи из рецензируемых журналов, индексируемых в eLibrary.ru. В списках литературы зафиксирована 691 библиографическая позиция, из которых 306 (44,3%) признаны доказанно конфабулированными — 96 книжных изданий и 210 статей. Выявлены устойчивые признаки таких ссылок: отсутствие электронных идентификаторов, минимальное указание интернет-ссылок, упоминание только журнальных статей без сборников и глав из книг, использование двоеточия в 40% заглавий по схеме «общая научная рамка: уточнение», шаблонность объёмов. Современный тренд — смешение реальных авторов и изданий с достоверными сочетаниями года, тома, номера и страниц, что в сумме даёт несуществующую ссылку.

Проверка 306 ложных ссылок проводилась с помощью сервисов eLibrary.ru, CiteSure, Citely, GPTZero, Crossref и больших языковых моделей ChatGPT, Perplexity, DeepSeek и «ГигаЧат» — ни один инструмент не дал стопроцентного совпадения с выводами библиотекаря-верификатора. По словам Морозовой, автоматическая детекция может быть полезным этапом, но не заменяет профессионального суждения. Сегодня только специалист-верификатор может проследить цепочку распространения конфабуляций в последующих публикациях: в зарубежном поле такие «цепи» фиксируются с 2023 года, в российском — с конца 2024-го. Наработки герценовских экспертов уже внедрены в систему идентификации ссылок РИНЦ и использованы системами распознавания плагиата.

Дополнительно:

Морозова С.А. Библиотекарь как верификатор библиографического аппарата публикаций при его искажении генеративным искусственным интеллектом. Библиотековедение. 2026;75(4):355-370. https://doi.org/10.25281/0869-608X-2026-75-4-355-370

#ссылки ___ @rujournals - Научные журналы и базы данных (НЖБД)

Sep 23, 06:01 AMMore from @rujournals

✅ AI_NovelGenerator:AI 小说创作自动小说生成工具

AI_NovelGenerator 是一个功能强大的 AI 小说生成工具,覆盖从初始设定到章节目录生成、逐章创作以及剧情一致性校验的完整小说创作流程。它支持调用 OpenAI、DeepSeek、Ollama 等多种主流大模型,并借助本地向量数据库进行高效上下文检索,保障故事连贯性与人物行为一致性,为创作者提供全方位的小说创作支持。

🏷️ #电脑软件 #AI工具

➡️ 点击查看

📖 频道 | 🔍 搜索

Sep 23, 04:12 AMMore from @ajk_app