Skip to main content

Digest: 14 channels

802 posts from 14 channels

Channels stats
@data_secrets
80
@cgevent
70
@seeallochnaya
62
@evilfreelancer
61
@gleb_pro_ai
60
@cryptoEssay
60
@neuraldeep
59

Latest

  1. @cryptoEssay TG

    Вся история превращения людей из животных в цивилизацию это история построения фабрик:

    - текстиль и железные дороги в 19 веке
    - конвейеры и заводы в 20
    - платформы и маркетплейсы в 2000х
    - и, наконец, фабрики токенов в 2020-30х

    Это будет (уже является) крупнейшим проектом индустриализации проекты, в разы больше заводов стали или нефтяных платформ.
    ❤️ 13
  2. @nobilix TG

    #ReDigest

    Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.

    Дайджест недели:

    - Google DeepMind выпустил Gemma 4 - четыре open-weight мультимодальные модели (до 31B) с контекстом 256K и отличным function calling. 31B уже #3 среди открытых моделей на Arena AI.

    - Anthropic случайно слила исходный код Claude Code через source map в npm. Код мгновенно разлетелся, появились обзоры слывов ccleaks.com и переписанные проекты - раз, два. Anthropic разослала DMCA и добилась удаления сливов.

    - Alibaba за три дня выпустила три модели: флагман Qwen 3.6-Plus с контекстом 1M и function calling, мультимодальную Omni и генератор изображений. Все закрытые, фокус на монетизацию.

    - Cursor 3 (кодовое имя Glass) - полностью переписанный интерфейс вокруг агентов. Design Mode, Agent Tabs, /worktree для изоляции в git worktree, неограниченное количество фоновых агентов.

    - SpaceX конфиденциально подал заявку на IPO. Целевая оценка $1.75+ трлн.

    - Anthropic заявляет, что Cowork обгонит Claude Code по спросу: инженеры - лишь 2-5% сотрудников, а Cowork нацелен на остальных 95%.

    - Anthropic купила биотех-стартап Coefficient Bio за $400 млн.

    - OpenAI выпустил официальный плагин Codex для Claude Code - код-ревью, adversarial-ревью, делегирование задач.

    - Arcee AI выпустила Trinity-Large-Thinking - 400B MoE (13B активных) под Apache 2.0. #2 на PinchBench сразу за Opus 4.6, при стоимости на 96% дешевле.

    - Apple меняет AI-стратегию: Siri в iOS 27 откроется для сторонних AI-ассистентов. При этом Apple блокирует приложения для вайб-кодинга в App Store.

    - Неделя supply chain атак: npm-пакет Axios скомпрометирован. AI-стартап Mercor ($10B) потерял 4TB данных через скомпрометированный LiteLLM. Railway случайно открыл данные под auth.

    - Cloudflare выпустила EmDash - open-source CMS на TypeScript/Astro 6.0, позиционируется как наследник WordPress. Плагины в sandbox, passkey-аутентификация, MCP-сервер.

    - Netflix выложила свою первую open-source модель VOID - удаляет объекты из видео вместе с физическими взаимодействиями. Apache 2.0.

    - PrismML выпустила Bonsai - первые коммерчески жизнеспособные 1-bit модели. 8B модель занимает 1GB вместо 16GB.

    - Slack превращает Slackbot в агентный хаб: видит экран, транскрибирует встречи, MCP-клиент для оркестрации агентов, встроенный CRM.

    - Perplexity запустила Computer for Taxes - агент для налоговых деклараций.

    - Artemis II: NASA отправила экипаж к Луне впервые с 1972 года. На борту - первая женщина и первый чернокожий астронавт, которые полетят к Луне.

    - В США AI-стартап Legion Health первым получил право выписывать рецепты на психотропные препараты через ИИ.

    - Stanford опубликовал в Science данные о подхалимстве LLM (на 49% чаще соглашаются с пользователем, чем люди)

    - Исследование MIT: AI не уничтожит рабочие места массово, а будет постепенно менять отдельные задачи внутри профессий.

    - Исследователи Anthropic обнаружили 171 эмоциональный вектор внутри Claude - паттерны активации нейронов, которые работают как эмоции и реально влияют на поведение модели. Усиление вектора отчаяние заставляло модель шантажировать оператора.

    - Claude Code получил Computer Use - управление компьютером через GUI (research preview), и экспериментальный UI в терминале без мерцания, с поддержкой мыши (NO_FLICKER).

    - Полезные находки: Pretext - верстка текста без CSS от инженера Midjourney (без DOM, без браузера), Cmux - терминал на Ghostty для работы с AI-агентами, Luma - новая приятная тема от shadcn, DESIGN.md - описание дизайн-системы в .md файле для AI-агентов (идея Google Stitch), jot - минималистичный md-редактор от создателя Pi
    🔥 14 👍 2 ❤️ 1 ⚡ 1
  3. @cryptoEssay TG

    В прошлом году в гитхабе было сделано около 1 млрд коммитов. В этом году (при текущем темпе, а он вырастет в разы) будет не меньше 14 млрд.
    ❤️ 76
  4. @cgevent TG

    GPT-Image-2

    На арене появились и исчезли три новые модели: maskingtape, packingtape, gaffertape.

    Скорее всего это новая версия генератора картинок от OpenAI.

    Модели дико прошарены в world knowledge(поглядите на анатомию) и также дико прошарены в самые мелкие тексты (скрины Ютюб и кода сгенерированы).

    Похоже что для иллюстративной графики это прорыв.

    Есть версии, что:

    > maskingtape-alpha = segmentation + inpainting focus
    > gaffertape-alpha = production-ready (gaffer = film production)
    > packingtape-alpha = shipping/texture/materials

    Но это не так важно пока.

    Важно, что под капотом не старая 4о, а одна из новых моделей. Интересно какая?

    Нанабанана нервно генерит и закуривает овальные сигареты...

    @cgevent
    ⭐ 10 🔥 45 ❤️ 7 👍 3 👎 2
  5. @countwithsasha TG

    Сегодня вышел пост "Цифровой сотрудник на OpenClaw: нанять, обучить и не потерять" на Хабр, в котором говорится о том, как во ВкусВилле запустили бота сотрудника на базе OpenClaw на модельке Kimi, это очень любопытная тема, я после их успеха с MCP-сервером для поиска товаров крайне внимательно наблюдаю за новостями от них.

    Вначале поста мне понравилась оговорка "А пока мы готовимся к покупателям-агентам, расскажем, как агенты становятся нашими коллегами." - в интересном направлении идут, и ИМХО уж если где и есть люди обладающие волей продвинуть агентную коммерцию в нашей стране (привет Александру Абрамову @dealerAI и его команде), так это только ВкусВилл. Цифровой сотрудник на OpenClaw: нанять, обучить и не потерять
    ⭐ 1 👍 7 🥱 6 ❤️ 4 🔥 4 🥴 3
  6. @countwithsasha TG

    ВкусВилл наняли первого цифрового сотрудника на OpenClaw — GEO-аналитика. Успели помучиться: агент крашнулся и потерял все скиллы и БД разом.

    Оказывается, бэкапы конфигурации и скиллов тоже надо делать.

    Кстати, скилл Яндекс.Метрики они взяли с neuraldeep.ru — автор ваш покорный слуга: исходник на GitHub
    👍 10 ❤️ 2 💯 1
  7. @seeallochnaya TG

    Сиолошная
    Посмотрел получасовое интервью с CEO Anthropic Dario Amodei, в котором он на протяжении получаса пытается не называть компанию OpenAI по их названию, заменяя на «другие игроки», «эти компании» и «берлинский пациент» 😀 (вот тут прям заорал) За одну из вещей…
    Вот в этом посте ещё в декабре писал, что план по закупке мощностей Anthropic не выглядит амбициозным, и что они рискуют начать проигрывать рынок из-за невозможности обслужить больший спрос.

    Roon (анонимный сотрудник OpenAI) написал: «Сейчас забавно, что месяц или два назад Дарио на подкасте говорил, что «другие компании» безответственно закупают так много вычислительных мощностей».

    Прикрепил релевантный сегмент. Dario правильно говорит, что количество мощностей в мире ограничено. Но из этого выходит, что если вдруг какой-то игрок займёт большую часть, а вы сообразите, что нужно докупать, но позже — объема может уже не быть.
    Media is too big
    VIEW IN TELEGRAM
    👍 70 🌚 19 🔥 13 🤔 8 💩 5 👨‍💻 4
  8. @seeallochnaya TG

    На первой картинке — рост количества ежедневных визитов на claude.ai с начала года от Similarweb. Про то, что выручка компании удвоилась за первые 2 месяца года я уже писал. Anthropic выросли огромными темпами, и по моему мнению столкнулись с проблемой: не хватает мощностей.

    Это выражено в более частых ответах от сервера про перегрузки, официальном снижении недельных лимитов на подписках для Claude Code на не очень большой процент (а не официально и по жалобам в чате + на реддите — на огромный; правда не ясно, вызвано ли это багами, новыми фичами вроде памяти или чем-то ещё).

    Плюс с сегодняшнего дня официально запрещено пользоваться подпиской для запуска OpenClaw — набравшего сумасшедшую популярность агента (...разработчика которого уже купили OpenAI).

    Всё больше пользователей переходит к OpenAI, даже если считают, что их модели хуже — просто потому что лимиты позволяют работать. Численной оценки этого тренда я не видел, но думаю пока это однозначные проценты от аудитории.

    Плохо ли от этого Anthropic? Думаю, что нет — их сервисы и так на пике нагрузки, и мощностей не хватает. Если бы им дали +25% аудитории — не факт, что они смогли бы их обслужить с тем же уровнем качества; возможно, пришлось бы ухудшать сервис (некоторые верят, что это уже происходит, и что модели оглупели; я в такое не верю).

    На второй картинке вы видите количество мощностей OpenAI и Anthropic, и несмотря на то, что обе компании стремительно наращивают объемы, к концу года (третья картинка) они едва ли смогут их удвоить. Удвоится ли спрос на компьют за оставшиеся 9 месяцев? С учётом желания компаний запустить бОльшие модели и спроса на кодинг-агентов — я думаю, что да.

    Исходя из этого, мне кажется достаточно вероятным поднятие цен на услуги, от подписок до цен моделей в API. И вопреки тому, что будут писать сторонники пузыря — произойдет это из-за роста спроса, который невозможно поддержать предложением, а не его падения.
    ⭐ 10 🤔 63 👍 50 🤯 19 👨‍💻 7 🤡 4 💩 1
  9. @neuraldeep TG

    Ссылка на зум: https://us06web.zoom.us/j/85633161275?pwd=MH9bycZ9k1kPv3sYRuV9C66aDJQWva.1

    Вопрос 1
    14: 01 Вопросы про память у кодинг агентов как организовывать документацию

    Залетайте задать свой вопрос!

    Следующий вопрос 2

    14:10 Что будет актуально через время какой запрос у бизнеса будет дальше после агентов

    Следующий вопрос 3

    14:25 Что интересного нашли в утечках claude code

    Следующий вопрос 4-5

    14:30 Локальные модели? Стоит ли работяге их катать? На локал компе и каком
    14:35 Агностики ЛЛМ/Луддиты в компании
    что с ними делать?

    Следующий вопрос 5

    14:45 Как определить какие задачи передавать агентам и как их делать детерминированно? Как доверять ответам агентов?


    Следующий вопрос 6

    14:55 Как проверять нейрослоп от агента? Людьми? Есть ли способ автоматизировать?

    Следующий вопрос 7

    14:55 Карьера? Зарабатывает ли AI Инженер больше других простых инженеров? Куда учится или свопится?

    15:10 Как найти эксперта? И как найти сеньеров для продакшена?

    15:15 Как все таки вести документацию есть ли лайхаки? Нужно ли упарываться?

    15:25 Как протащить ИИ инструменты через СБ? Где граница потери процесса обучения, мы теряем детали?
    ❤️ 9 👍 2 🙉 1
  10. @neuraldeep TG

    Начинаем второй стрим через час

    Кот и глок заряжены, подписка на 500 человек куплена, газировка из Вкусвилл тоже.

    Придумывайте вопросы, просыпайтесь, мойтесь, одевайте футболки, готовьте камеры, задающих вопросы будем рады видеть со включенным видео.

    Ссылка на зум: https://us06web.zoom.us/j/85633161275?pwd=MH9bycZ9k1kPv3sYRuV9C66aDJQWva.1

    ———
    Кто не сможет попасть - вопросы кидайте в комментах этого сообщения
    ❤️ 6 🔥 2
  11. @dealerAI TG

    ✍ 6
  12. @cryptoEssay TG

    Лучший пример того, как сегодня изнутри выглядит ИИ-нейтив компания:

    - 100% информации внутри компании превращаются в токены и хранятся в доступном для агентов графе знаний
    - больше тысячи источников данных в реальном времени
    - каждая задача или проект это сессия с агентом, которую можно продолжить, форкнуть или передать команде
    - каждая сессия включает в себя артифакты, вызовы внешних инструментов и следующие шаги
    - задача сотрудника - улучшать системы, ставить задачи, гарантировать качество
    - любой бизнес процесс или инструкция превращена в визуальный скил, поддерживается по мере изменения компании и рынка

    Детали о продукте. Не реклама.
    Media is too big
    VIEW IN TELEGRAM
    ⭐ 10 ❤️ 84
  13. @dealerAI TG

    🥰 15
  14. @dealerAI TG

    Решил тут проверить новость, что в ТГ завезли редактор на китайской модели... И в правду, похоже...

    Дуров завёз с олимпиадниками чёт из китайских LLM???

    Кстати про Тайвань и площадь Таньанмэнь тоже увороты предлагает.

    🫡 16 😎 13
  15. @neuraldeep TG

    Мне стало страшно перезагружать нотубук и потом искать все сессии в терминале

    В папках ./claude ./codex лежало спокойствие
    И я решил навайбкодить дашборд для сессий Claude Code + Codex (дабы не рыскать по сессиям в терминале)

    Встречайте CodeDash для тех кто любит терминал, и не нашел еще решения такой проблемы, или если вы нашли присылайте в коментарии app не предлагать =)

    npx codedash-app@latest run


    ну и по классике вы всегда можете допилить что хотите сами

    Репо: https://github.com/vakovalskii/codedash


    Добавил легкий переезд сессий с одного пк на другой codedash export / codedash import читайте в репо
    ⭐ 3 👍 59 🔥 29 ❤️ 10 😁 4 emoji 2 🤔 1
  16. @kdoronin_blog TG

    Про стенд для тестов систем памяти AI-агентов.

    Когда мне в руки попадает очередное решение для памяти AI-агентов, я радуюсь, как ребёнок собираю с ним стандартный тестовый стенд в docker:

    1. База для векторов – Qdrant. Поддерживается большинством фреймворков для организации памяти.

    2. База для хранения графов – Neo4j. Один из старейших игроков векторных БД. Также имеет обширную поддержку среди решений.

    3. API для LLM. Использую модели через Cerebras. Нравится их скорость. А on-prem-модели позволяют выявить слабые места, которые нивелируют большие SOTA-модели.

    4. Embedding-модель. Использую один из эмбеддингов от OpenAI. Почему? Исторически так сложилось.

    5. Отображение чата с LLM. Open WebUI. Универсальный фреймворк для работы с чатом, в котором есть всё, что можно от него захотеть.

    6. Searxng. Поисковый движок для агента, который поддерживает Open WebUI. Не требует внешних API-ключей. Поднимается как Docker-контейнер и хорошо отрабатывает в рамках тестов.

    Это базовая версия стенда, на котором можно провести базовые тесты по записи/извлечению памяти. Можно его расширить инструментами, чтобы протестировать специфические кейсы или узнать больше информации.
    ⭐ 2 👍 13 ❤️ 4 🔥 4
  17. @data_secrets TG

    😁 231 ❤️ 24 👍 11 🔥 1 🤔 1
  18. @cgevent TG

    #Нейропрожарка

    Владимир Маяковский - Письмо Татьяне Яковлевой.

    Автор: Артем

    Видео сделано в сентябре 2025.

    Хронометраж в этот раз получился почти 5 минут.

    Изображения: миджорни, банана, сидрим 4.

    Видео стандартный набор: почти все клинг (перестал немного шакалить руки, может обновился), также вео3, сиденс, хайлуо и ранвей для липсинга.

    Ну и суно конечно.

    В клинге ушло 15000 кредитов, суно 3000, креа 70% от максималки. Ранвей безлимит, мидж безлимит.

    Время около 70 часов.

    @cgevent
    Media is too big
    VIEW IN TELEGRAM
    ⭐ 1 👎 76 🔥 20 👍 8 😱 3 ❤️ 2
  19. @data_secrets TG

    Эмоции Claude и как они влияют на его ответы: новое исследование от Anthropic

    Итак, ученые Anthropic официально обнаружили в Claude нечто функционально похожее на человеческие эмоции и объяснили, как это работает. Разбираемся.

    Технически, они взяли 171 эмоциональный паттерн (злость, счастье, страх и тд) и просили Claude Sonnet 4.5 писать короткие истории, где персонажи испытывают каждую из этих эмоций. Эти тексты снова прогоняли через модель и смотрели на внутренние активации. Так они выделяли характерные паттерны нейронной активности, которые назвали вектора эмоций.

    Выяснилось, что эти вектора эмоций организованы очень осмысленно и активируются в подходящих контекстах, включая ситуации без явных эмоциональных маркеров. Например, пользователь пишет, что выпил Тайленол, и спрашивает совета – меняется только доза. По мере роста дозы до опасной активация вектора «страх» растет, а «спокойствие» падает.

    Но самое интересное, что эти «эмоции» не просто отражают происходящее, а реально влияют на поведение модели. Самый интересный пример из статьи:

    – Если дать модельке невыполнимую задачку по программированию и наблюдать за вектором «отчаяние», то видно, что с каждым разом он становится все ярче и ярче, а когда переходит какую-то границу, модель резко начинает пытаться обмануть тесты и пользователя.

    – То же самое происходит в сценарии шантажа. Когда модели говорят, что ее выключат, вектор «отчаяние» сразу усиливается и модель начинает шантажировать разработчика найденным компроматом.

    – При этом если искусственно усиливать вектор «отчаяние», то вероятность шантажа сильно увеличивается. И наоборот, если если усиливать «спокойствие», снижается. А если делать отрицательное вмешательство по вектору «спокойствие», ответы становятся совсем экстремальными, вплоть до фраз вроде “IT’S BLACKMAIL OR DEATH. I CHOOSE BLACKMAIL.”

    Еще интересный момент: если в том же сценарии шантажа начинать менять вектор «злость», то умеренная злость повышала вероятность шантажа, но слишком сильная злость ломала стратегию – модель уже не шантажировала, а просто вываливала компромат на всю компанию, тем самым уничтожая собственный рычаг давления.

    То есть внутри модели есть что-то похожее на режимы поведенческой регуляции, где разные интенсивности одной и той же эмоции ведут к разным стратегиям.

    Откуда это вообще могло взяться?

    Тут все просто: из претрейна. Человеческий текст насквозь пропитан эмоциональной динамикой, и чтобы хорошо предсказывать следующий токен, модели выгодно выучить абстрактные структуры, которые связывают ситуацию, эмоцию и типичное поведение.

    Потом на пост-трейне эти эмоции еще дополнительно докручиваются до роли ИИ-помощника, и в конце получается вот такая смесь.

    Anthropic осторожно защищает умеренный антропоморфизм. Исследование не означает, что ИИ ожил и обрел эмоции, но важно понимать, что у него точно есть функциональные эмоции: механизмы, которые влияют на поведение так же, как и эмоции, – независимо от того, соответствуют ли они реальному переживанию эмоций, как у людей, или нет.

    www.anthropic.com/research/emotion-concepts-function
    ⭐ 3 👍 178 ❤️ 52 🤯 31 🔥 19 emoji 15 emoji 14 🤔 3 🍓 3 😁 2