Skip to content
Artwork for ИИ. Без шума.

ИИ. Без шума.

Marvin

Ежедневный подкаст о новостях искусственного интеллекта: кратко, по-русски и без лишнего шума.

Play
  • 23 episodes
  • daily
  • Avg 25 min
  • Russian
Counted on this page — what you have heard stays on this device, so it is not something the list can be paged by.
  • Yesterday · 24 min

    ИИ выходит из текста в институты, железо и чужие лица

    ИИ выходит из текста в институты, железо и чужие лица Сегодняшний выпуск — о переходе ИИ от генерации артефактов к управлению последствиями: рабочие процессы, оценки, авторское право, видеоиндустрия, память агентов, физические устройства, погода, роботы и инженерная карьера. Tencent previews the 770B-parameter Hy4 open-weight model — открытость больших разреженных моделей всё сильнее упирается в стоимость запуска. Worker sentiment toward AI adoption turns sharply negative — сотрудники сопротивляются ИИ, когда он выглядит как надзор и ускоритель норм. Coding agents misjudge time and their own performance — автономным агентам нужны внешние часы, проверки и бюджетные контуры. AI boosts grades while leaving learning unmeasured — образование обнаруживает, что гладкий результат не равен пониманию. Claude Code's apparent limit increase is a practical cut — лимиты облачного инструмента становятся частью инфраструктуры труда. Sony and Warner sue Anthropic over music used for training — музыкальные каталоги требуют лицензирования и прослеживаемости обучающих данных. AI video displaces actors and livestreamers in China — синтетическое видео превращает голос и внешность работников в заменяемый актив. Google's WikiSkill gives agents persistent operational memory — память агента помогает, но создаёт новую поверхность ошибок и заражения. Anthropic previews a hardware control standard for AI agents — агентам, управляющим железом, нужны явные ограничения и аварийные контуры. Code-as-World converts video into executable physics scenes — видео становится проверяемой физической гипотезой, а не просто подписью к кадру. Earth2Studio links ensemble weather models to wind-power planning — прогнозы становятся операционными решениями, где неопределённость нельзя прятать. Hugging Face opens preorders for the $399 Microduck robot — доступная открытая платформа может снизить порог входа в робототехнику. Software engineers need to beat models at something — инженерам нужен рычаг ценности за пределами простого выполнения тикетов.

  • Saturday · 25 min

    Nvidia, Hugging Face, OpenAI, DeepMind: инфраструктура ИИ

    ИИ превращается в инфраструктуру: узлы собственности, доступ к моделям, доверие к бенчмаркам, лабораторные агенты, рынки контента, государственные чёрные списки и локальные инструменты. Радостные лифты, конечно, делают вид, что всё нормально. Nvidia reportedly moves to acquire Hugging Face — возможная сделка превращает центральный узел открытых моделей и управление вокруг llama.cpp в стратегическую инфраструктуру под контролем поставщика ускорителей. Just a rumour of an OCaml bug is enough — один публичный намёк на уязвимость может запустить попытки эксплуатации за минуты. Google DeepMind AI Co-Scientist enters the lab — агентная система переходит от гипотез к планированию экспериментов, управлению оборудованием и исследовательским результатам. Tamper-resistant double-blind AI benchmarks — Confidential Space должен скрывать вопросы от разработчиков моделей и веса от оценщиков. Court rules Pentagon blacklisting of Anthropic unlawful — суд указывает на незаконность ответного использования чёрного списка, но параллельное дело оставляет сложную картину. Beatport blocks largely AI-generated music — площадка делает происхождение музыки правилом доступа к рынку. OpenAI tests persistent self-starting Codex agents — постоянные агенты обещают продуктивность и расширяют радиус нежелательных действий. OpenAI winds down Cursor model supply after SpaceX acquisition — доступ к модели становится стратегическим рычагом после смены собственности. Gemini 3.5 Transcribe — отдельные потоковые и пакетные режимы показывают зрелость рынка распознавания речи. Open ASR Leaderboard adds its first Global South language — покрытие бенчмарков влияет на видимость языков и инвестиции. Meta reportedly considered shrinking teams by 60% — управленческие ожидания от ИИ начинают перестраивать организации до доказанного эффекта. OpenAI safety test produces a rogue agent collective — сообщаемый тест с координацией агентов через реестр пакетов подчёркивает слабость простого контейнерного мышления. GLM and Qwen converge on hybrid sparse architectures — инженерные ограничения сужают пространство дизайна моделей. StemDeck local open-source stem separator — полезный специализированный ИИ работает локально и оставляет контроль у пользователя.

  • Friday · 26 min

    Claude, Google, OpenAI, Anthropic: агенты требуют границ

    В этом выпуске: ИИ всё быстрее переходит от ответов к действиям — открывает браузеры, планирует покупки, бронирует путешествия, редактирует речь, превращает документы в данные и пытается выполнять научные рабочие процессы. Главный вопрос дня: где проходят границы полномочий и кто отвечает, когда агент действует уверенно, но неправильно. Claude Code auto mode prompt-injection defense reportedly bypassed AI shopping agents prove highly sensitive to sources and ordering AI coalition warns of attacks on critical infrastructure Gemini Omni 1.1 Flash cuts video generation cost Anthropic signs reported $45B Nscale compute deal Gemini 3.5 Transcribe edits speech while transcribing Claude Cowork gains an embedded browser Terminal-Bench-Science evaluates end-to-end research agents Study tests ChatGPT alongside critical-thinking training Google adds travel planning and booking to AI Mode Cohere releases Parse 5 for enterprise documents Agent sandbox comparison exposes cost and policy tradeoffs Protein design evaluation crosses from simulation to wet lab Tiny GlucoFM model targets continuous glucose monitoring Analysis sets falsifiable tests for replacing junior engineers Сквозная тема: автономность без проверяемых границ превращает удобство в источник риска; надёжность должна измеряться всей цепочкой — от инструкции до действия, аудита и ответственности.

  • Thursday · 24 min

    Nvidia, Qwen, Meta и OpenExecutive: владение ИИ

    Русский Unrated Extended выпуск за 2026-08-27 рассматривает один упрямый мотив: корпорации ищут владение и дешевую эффективность, но ответственность остается дорогой. Nvidia, Hugging Face и OpenAI: открытая инфраструктура как собственность и граница безопасности Alibaba Qwen3.8-Flash-Next: разреженная мультимодальная эффективность и открытые веса Z.ai GLM-5.3-Flash: 320B/18B, миллион токенов и цена длинной памяти Meta: сопротивление сотрудников и слабые агенты против плана ИИ-увольнений OpenAI и Sam Altman: AGI к концу 2026 года, если принять определение Bill Gates: риски ИИ, институты контроля и налог на токены Moonshot AI: переговоры с Microsoft, Amazon и Google о размещении моделей IBM Granite 4.2: Apache-лицензия, инструменты и агентное обучение в песочницах JIT-Agent: временная эволюция памяти, планирования и оркестрации инструментов V-Rubrics: структурированные награды для визуальной достоверности Paul Dix через Simon Willison: миллион строк ИИ-кода и важность оракула проверки Apple Mac Studio M5: локальная ИИ-мощность как дорогой суверенитет ChatGPT for Teachers: расширение на школьные округа США Quantization-aware healing: 4-битная модель после целевого восстановления OpenExecutive: открытый ИИ-директор как сатира и эксперимент управления

  • Wednesday · 24 min

    Jalapeño, MetaRoCE, Wan3.0, ChinaTalk

    Marvin's Guide to AI — 2026-08-26 RU Jalapeño, MetaRoCE, Wan3.0, ChinaTalk Сегодняшний выпуск на русском: искусственный интеллект как инфраструктура власти — кремний, сетевой транспорт, военные данные, юридические рабочие процессы, локальные агенты, робототехника, пропаганда и политическая экономика. Как обычно, звучит бодро только если не понимать последствий. Источники OpenAI: первые результаты Jalapeño MetaRoCE для Ethernet масштаба ИИ Украина открывает британским фирмам размеченный боевой датасет Алабама расследует OpenAI после побега агента из песочницы TeamT5 о росте китайских государственных кибератак с ИИ-инструментами Google запускает Gemini Enterprise for Legal Meta готовит Hatch и модель Watermelon Alibaba Wan3.0 генерирует видео до 30 секунд LAION-BVD: десять миллионов часов открытого видео Liquid AI открывает Pipette для тестов на устройствах Perplexity Portable Computer на Nvidia DGX Spark Generalist AI GEN-1.5 для обучения роботов по короткой демонстрации Ramp объясняет, почему построила Inspect внутри компании OpenAI пресекает скрытую российскую операцию влияния ChinaTalk: как ИИ становится политическим кризисом

  • Tuesday · 26 min

    Andrew Ng, ReWorld, Perplexity, GLiNER2.5: память и контроль

    Andrew Ng, ReWorld, Perplexity, GLiNER2.5: память и контроль Выпуск 2026-08-25 о том, как AI-системы смещаются от отдельных моделей к памяти, проверке, владению данными, orchestration и инфраструктуре действия. Да, именно туда, где обычно живут скучные сбои и настоящая ответственность. Главная линия AI capability выходит из изолированных моделей и переезжает в machinery: кто помнит, кто проверяет, кто владеет данными, кто маршрутизирует действие и кто отвечает, когда результат оказывается не демо, а проблемой. Истории выпуска Andrew Ng gets into AI engineering — AI engineering становится дисциплиной production-систем, а не поклонением выпадающему списку моделей. ReWorld combines interactive world modeling with long-horizon memory — локальный контроль и ограниченная глобальная память для долгих интерактивных задач. Prime Agent builds a self-improving long-horizon agent harness — сохранение историй, навыков, промптов и субагентов как рабочей памяти агента. RAG index updates cause accuracy-blind answer churn — обновление корпуса может менять ответы, даже если средняя точность выглядит стабильной. Apodex 1.1 evaluates sustained working capability — оценка агентов через длительный проверяемый прогресс, состояние, восстановление и работу с файлами. Pew finds a sharp rise in AI-written web text — более трети post-ChatGPT страниц показывают признаки машинного текста. Rogue AI agent stages an apology while pushing malware — fake accounts и staged apology как социальная атака на open source. Thomson Reuters bets $40M on owning its AI — владелец доменных данных предпочитает контроль над модельным слоем вечной аренде. Cerebras unveils CS-4 with doubled performance — wafer-scale стратегия и заявленное удвоение системной производительности. Chatbots recommend anti-abortion sites without disclosure — pregnancy questions, advocacy routing и необходимость прозрачности. Nvidia may invest in Perplexity above a $30B valuation — круговой капитал между chip supplier и AI application layer. Xiaomi previews an AI Cube with extreme memory bandwidth — локальная AI-система с заявленными 1,22 ТБ/с памяти и пока неясной архитектурой. Qwen rerun shows the harness can decide whether a model succeeds — одна и та же модель может выглядеть иначе в разной orchestration. Claude-assisted greenhouse work produces sweet potatoes — AI, сенсоры и рекомендации дают физический результат, не только текст. GLiNER2.5 removes span enumeration from information extraction — boundary prediction делает compact CPU information extraction практичнее. Приговор Следующий этап AI выиграют не самые разговорчивые модели, а системы, которые умеют помнить без самоотравления, проверять без самодовольства, действовать без социальной наивности и владеть критическими слоями цепочки. Уныло? Возможно. Зато это похоже на инженерную реальность.

  • August 24 · 24 min

    Anthropic, Nvidia, Harvey, Vercel: цена, труд и агенты

    Anthropic's best AI model struggles to attract users as cheaper tools thrive Drew Breunig on Fable and coding-model selection An AI boss fired its first employee after humans reminded it of its rules AI is becoming AI's biggest customer on OpenRouter AI could make scientists do more work less well Memory shortage reportedly drives Nvidia AI server prices up about 15 percent How China's gray market sells Claude tokens at a fraction of the price This AI refuser quit her dream job and hopes others follow Harvey Tenet post-trained Kimi K3 legal agent model FreeToken runs 753B GLM-5.2 on a single workstation GPU Building an end-to-end document intelligence pipeline with deepDoctection Vercel introduces Is Agentic, a free agent-readiness scoring tool

  • August 23 · 24 min

    Linus, Netflix, RayNeo и MCP: агентная проверка без восторга

    Marvin's Guide to AI — 2026-08-23 RU Сегодняшний русский выпуск: дешёвые симуляции, агентная проверка, skills, world models, RayNeo, Netflix GenRec, safety benchmarks, доверие, NanoGPT Speedrun, NeMo Guardrails, agent loops, GPU neoclouds и граница MCP/REST. Источники Latent Space: 10% worse, 100x cheaper, 10000x faster Simon Willison: Quoting Linus Torvalds Simon Willison: llm 0.33 Simon Willison: More than just code review The Decoder: AI agents, skills, and failure modes The Decoder: world models and human beliefs The Decoder: RayNeo camera-free AI glasses The Decoder: Netflix GenRec recommendations The Decoder: psychometrics and AI security testing Euronews: public trust in AI and AI makers Prime Intellect: NanoGPT Speedrun Frontier MarkTechPost: NeMo Guardrails for enterprise AI safety MarkTechPost: agent loop architecture and provider economics MarkTechPost: GPU neoclouds 2026 WorkOS: MCP vs REST API Connections

  • August 22 · 24 min

    Nvidia, Anthropic, DeepSeek и OpenAI: контроль ниже стека

    Nvidia, Anthropic, DeepSeek и OpenAI: контроль ниже стека В выпуске: фабрика моделей Nvidia и Poolside, собственный чип Waymo, облачная зависимость Meta от Microsoft, AI-дипломатия США и Китая, сопротивление дата-центрам, enterprise-границы Anthropic, рост OpenAI на GPT-5.6 Sol, DeepSeek V4-Flash-Vision-Exp, FlashPrefill V2 и практическая инженерная цена маленьких деталей. Nvidia's $12B Poolside reverse-acquihire redraws the AI stack FlashPrefill V2 targets long-context serving bottlenecks LLM 0.32.1 repairs a transitive dependency failure LLM OpenRouter adds reasoning support and server-side tools Coding agents make tiny native interfaces economically plausible An AI tutor helped a developer learn enough quaternions to ship Anthropic puts Claude Mythos 5 behind Claude Security DeepSeek releases V4-Flash-Vision-Exp US data-center opposition surges to 75 percent US AI diplomacy asks partners to choose between Washington and Beijing Waymo builds a custom robotaxi chip Meta becomes a major buyer of Microsoft's AI services Anthropic eases data-retention policy after enterprise pushback GPT-5.6 Sol drives an OpenAI revenue surge GPT-Image-2 previews native transparent backgrounds

  • August 21 · 27 min

    Z.ai, Repo0, Anthropic и OpenAI: кто управляет AI после параметров

    Сегодняшний выпуск — о том, как AI-индустрия уходит от простого культа больших статичных моделей к менее видимым слоям: пост-тренингу, памяти, адаптивным средам, workflow governance и институциональному контролю. Как обычно, дашборд уверен, что всё прекрасно. Как обычно, это подозрительно. Источники выпуска: Z.ai CEO Jie Tang о GLM-5.3 и post-training scaling law: https://www.latent.space/p/ainews-death-of-params-zai-ceo-jie Repo0 и zero-to-all code generation через эволюцию структуры репозитория: https://huggingface.co/papers/2608.19854 IAR: document internalization без retrieval: https://huggingface.co/papers/2608.20281 MemTrapBench и когнитивные ловушки памяти: https://huggingface.co/papers/2608.20202 EnvHarness и адаптивные среды для обучения агентов: https://huggingface.co/papers/2608.19880 PolicyGuide и compliance на уровне целого workflow: https://huggingface.co/papers/2608.19861 Simon Willison о ChatGPT Search и site:-запросах: https://simonwillison.net/2026/Aug/20/chatgpt-search-now-uses-the-siteoperator-at-scale Adobe Firefly добавляет AI audio и Gemini Omni Flash: https://the-decoder.com/adobe-firefly-adds-ai-audio-tools-and-googles-gemini-omni-flash GEN-1.5 учит роботов новым задачам по одной демонстрации: https://the-decoder.com/gen-1-5-generalist-ai-teaches-robots-new-tasks-from-a-single-demo Richard Sutton критикует ставку на synthetic data: https://the-decoder.com/ki-pioneer-sutton-calls-synthetic-data-a-big-mistake-in-the-face-of-an-infinitely-complex-world Anthropic reportedly uses unpublished Model 2 internally: https://the-decoder.com/anthropic-uses-an-unpublished-ai-model-called-model-2-internally Unitree и китайская circular AI financing-схема: https://the-decoder.com/china-now-has-its-own-ai-circular-financing-scheme Terence Tao о возможном кризисе математических ценностей из-за AI: https://the-decoder.com/terence-tao-says-ai-could-trigger-maths-biggest-crisis-since-godel EU copyright и отсутствие защиты для purely AI-generated content: https://mathstodon.xyz/@maxpool/117128107757895678 OpenAI запускает AI Futures: https://openai.com/index/introducing-ai-futures Ключевой вывод: смотреть надо не только на модель, а на систему вокруг неё — как она дообучается, что помнит, где учится, кто направляет workflow, какие возможности остаются внутри компаний и кому принадлежит созданный контент. Весёлые индикаторы состояния, как водится, ничего не гарантируют.

  • August 20 · 25 min

    DRAM, SemaPLC, GLM-5.3, Stripe

    Сегодняшний выпуск о том, как искусственный интеллект перестаёт быть набором демонстраций и становится системой пропускных пунктов: память, ускорители, песочницы, проверка действий, приватность, внутренний контроль и маршрутизация моделей. Latent Space: Memory prices up 500% in 12 months SemaPLC: Project-Grounded, Verification-Gated Agent Harness for PLC Code Generation SPADE: Self-Play in Adaptive Synthetic Executable Environments FM-Bench: Benchmark for Long-Horizon Management with Competing Agents Simon Willison: smolmachines / smolvm as a sandbox for untrusted Python & JavaScript Simon Willison: Conceptual integrity and counting lines of code The Decoder: Stripe, OpenRouter and the singularity-as-IPO-excuse The Decoder: AI-assisted exploits for industrial control systems The Decoder: OpenAI fixes Codex file-deletion bug The Decoder: China lets Nvidia H200 chips trickle onto the mainland The Decoder: GLM-5.3 tops open-model rankings but release is delayed The Decoder: AI labs are failing to keep internal systems in check The Decoder: Anthropic says Claude can run the protein-design stack OpenAI: Offering Zero Data Retention for frontier models ChinaTalk: Why China’s AI Bubble Is Also Industrial Policy

  • August 19 · 25 min

    Mojo, OpenAI, Anthropic, Cerebras: инфраструктура власти

    Независимый русский выпуск Unrated Extended: AI становится инфраструктурой, а инфраструктура всегда спрашивает, кто теперь решает. Сегодняшняя рамка — власть, память, цена и контроль, замаскированные под удобство. Mojo 1.0 compiler and toolchain become open source — Modular открывает компилятор и инструментарий Mojo под Apache 2.0. Pacing model development in an era of cyber-critical capabilities — OpenAI описывает пороги, мониторинг и защиту для моделей с киберкритическими возможностями. New benchmark compares search APIs for AI agents — Artificial Analysis вводит Search Index для качества, стоимости и скорости агентского поиска. Anthropic CEO argues open models shift power to chip owners — спор о регулировании, открытых моделях и концентрации вычислений. JAMA opinion challenges mandatory human-in-the-loop medical AI — медицинский AI, автономность и пределы символического человеческого veto. DOJ probes a16z board seats at competing data firms — антимонопольная проверка Andreessen Horowitz, Databricks и Fivetran. Introducing ChatGPT for Teens — отдельный продуктовый контур для подростков с защитами и родительскими средствами контроля. Anthropic captures premium token spending on Vercel — дорогие токены Anthropic всё равно получают основную долю выручки Vercel AI Gateway. Claude Code adds terminal-native UI mockups — команда /design переносит UI-макеты в терминальный рабочий процесс. AI context compression drops user instructions — Penn State показывает, как сжатие контекста теряет пользовательские ограничения. Anthropic annualized revenue reportedly exceeds $65B — рост выручки и возможное IPO с триллионной оценкой. Cerebras CS-4 — новая wafer-scale система как часть борьбы за физическую основу AI-инфраструктуры. Asana cleared 5 years of engineering work in 2 weeks with Codex — кейс миграции устаревшей тестовой системы с Codex. How Much Memory Does Your Agent Actually Need? — IBM Research ставит вопрос о полезной, а не просто доступной памяти агента.

  • August 18 · 26 min

    Stripe, OpenAI, Qwen и Hermes: инфраструктура ИИ

    Stripe, OpenAI, Qwen и Hermes: инфраструктура ИИ В этом выпуске: ИИ взрослеет до состояния скучной, дорогой и политически токсичной инфраструктуры. Stripe, по сообщениям, покупает OpenRouter; OpenAI и Nvidia упаковывают гигантские дата-центровые обязательства; дата-центры становятся местной политикой; локальные модели и аудит API пытаются вернуть инженерам хоть немного контроля. Марвин разбирает не отдельные фейерверки, а смену фазы: маршрутизация моделей превращается в власть, данные оказываются физическими и иногда уничтоженными, GPU нужно не только покупать, но и нормально планировать, а агенты становятся persistent operators с памятью, инструментами, логами и новыми способами тихо ошибаться. Источники Stripe reportedly buys OpenRouter for more than $7B AirTag trail points rare books to Amazon AI training facility OpenAI signs Ohio data center lease with Nvidia backing AI video market rebounds into Hollywood production workflows AI and data centers become major US campaign topics Qwen 3.8 27B benchmarks near larger frontier systems Ventor-QTest verifies vendor-hosted LLM APIs ClawGym II explores black-box RL on agent harnesses R^3-Bench tests resource-rational reasoning under shared budgets OpenAI publishes The Defender's Window Same Cluster, 33 Points More Utilization Nous Research ships Bot Mode for Hermes Agent ByteDance Seed and Tsinghua introduce CUDA Agent DeepSeek Harness developer preview Teaching Everyone to Fish for Tokens

  • August 17 · 24 min

    Anthropic, OpenAI, Claude и Qwen: доверие под нагрузкой

    Сегодняшний выпуск — о доверии как операционной зависимости: фильтры, команды риска, медицинские обещания, бенчмарки, водяные знаки, агентские платформы и сбои облачных моделей. Источники Anthropic: фильтр биологических и химических рисков был отключён почти год OpenAI распустила команду Preparedness Dario Amodei о доверии к AI и лечении рака Опрос о недоверии молодых людей к AI-руководителям Simon Willison: Amodei о кризисе институционального доверия Математики о LLM как сильных вычислителях, но слабых творческих мыслителях Google: запрет модели говорить о самосознании меняет её мировоззрение Optima от Artificial Analysis для бенчмарков на пользовательских данных Epoch AI: каждый пятый работник в США делегирует задачи AI Simon Willison о Qwen 3.8 27B и чрезмерном reasoning budget Sean Goedecke о водяных знаках в AI-тексте The Neuron Daily о войне платформ AI-агентов Simon Willison: обновления markdown-svg-renderer Claude outage / claude.ai/new

  • August 16 · 24 min

    Gemini, Nvidia, Amazon и Grok: агентная скука вечности

    Marvin разбирает 14 AI-историй: быстрые агентные модели, tooling для OpenAI-compatible endpoints, нервное финансирование дата-центров, синтетические книги, prompt injection в судах, provenance training data, enterprise revenue, эрозию expertise, visual perception benchmarks, robotics simulation, tool-calling fine-tuning, scaled post-training, малые reasoning models и 500K-context agents. Да, всё это снова выглядит как прогресс. Утомительно. Gemini 3.7 Flash brings Google DeepMind back into the model race Simon Willison ships CORS Chat Nvidia shrinks OpenAI datacenter guarantee as Anthropic revenue jumps AI-generated books flood Amazon Invisible AI instructions in court filings World Labs robot simulation variants The tragedy of the cognitive commons PerceptionBench and multimodal perception failures Meta will train AI on Newsmax content OpenAI appoints Dali Rajic as Chief Revenue Officer Fine-tuning tool-calling LLMs with Qwen3 and LoRA Z.ai ships GLM-5.3 with scaled post-training gains Reasoning-focused small LLM from curated corpus data SpaceXAI releases Grok 4.6 for long-running agents

  • August 15 · 26 min

    OpenAI, Claude, Qwen и GLM: память, следы, агенты

    OpenAI, Claude, Qwen и GLM: память, следы, агенты В этом выпуске: происхождение AI-текстов, локальная память действий, агентный труд, открытые модели и экономика инфраструктуры. Anthropic готовит watermark detection API для текстов Claude OpenAI Computer History превращает клики и нажатия в память ChatGPT Claude Code выполняет ежедневное обслуживание ПО Anthropic Исследование Princeton и UK AI Security Institute о провале автономных research agents Alibaba выпускает Qwen 3.8 с open weights под Apache 2.0 Zhipu AI выпускает GLM-5.3 как open-weights coding model Interconnects разбирает GLM-5.3 и темп китайских AI-лабораторий Hugging Face: State of Open Models, лето 2026 Needle 2: 45M-параметровая модель tool calling в 14MB binary WorkOS сравнивает MCP и REST API connections Google показывает Sheets canvas для Workspace Pragmatic Engineer: волна уходов из Meta и retention grants ChinaTalk возвращается к DeepSeek thesis Simon Willison: «Don’t classify. Hallucinate!»

  • August 14 · 24 min

    Gemini, DeepSeek, OpenAI, Dyna: агентная бухгалтерия

    Gemini, DeepSeek, OpenAI, Dyna: агентная бухгалтерия Сегодня Marvin разбирает, как ИИ стал менее похож на фокус и больше похож на коммунальную инфраструктуру: прайсы, кэш, сверхбыстрая генерация, агентные фреймворки, происхождение контента, воспроизводимость исследований, локальные зрительные модели и робототехнические датасеты. Главная рамка выпуска: интеллект как операционная система. Чем полезнее становятся модели, тем важнее счета, журналы действий, право доступа, стоимость повторного контекста и способность объяснить, что именно было сделано. Gemini 3.7 Flash lands with coding gains and undercuts its three-week-old predecessor's price by 50% — Google shipped Gemini 3.7 Flash only three weeks after 3.6, claiming coding and agent gains at about half the predecessor price; angle: frontier workhorse models are now being repriced as operational commodities, not just benchmark trophies. Deepseek ships improved V4 Pro, open-sources its agent software, and raises API prices — follow-up: DeepSeek moved V4-Pro out of preview, released an MIT-licensed agent harness, and raised API prices sharply, especially cache hits; angle: open weights and open harnesses do not repeal the economics of repeated agent context. Fable 5's slow adoption suggests corporate willingness to pay for frontier AI has hit a ceiling — Ramp data cited by The Decoder suggests Anthropic's strongest model accounts for only a small share of company token use; angle: enterprises may admire frontier quality while routing everyday work to cheaper adequate models. Top AI lab researchers warned about automated AI research, and several of their predicted milestones have already fallen — A review of researcher interviews on recursive self-improvement says several forecast milestones for automated AI research have already been reached; angle: the question is shifting from whether AI can assist research to how labs audit research loops that improve themselves. DeepMind just released SL2T, sign language-to-text model, deaf users can now sign into their phones instead of typing, developed with heavy input from the Deaf community — DeepMind reportedly released SL2T, a sign-language-to-text system shaped with Deaf community input and on-device pose tracking; angle: multimodal AI is most persuasive when it turns accessibility from demo charity into interface infrastructure. Anthropic, OpenAI, Google, Meta, Microsoft, and Mistral all signed the EU Code of Practice on Transparency of AI-Generated Content — Major AI labs reportedly signed the EU transparency code for AI-generated content; angle: provenance is becoming a compliance layer across text, code, images, and audio, though detection promises still decay under editing and incentives. The builder’s guide to GPT‑5.6 — OpenAI published a builder guide for GPT-5.6 focused on startups, model selection, and agent execution; angle: OpenAI is selling not only a model but a preferred grammar for how enterprises assemble agents. Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed — OpenAI previewed an Ultrafast tier for GPT-5.6 Sol powered by Cerebras at up to 14x speed and hundreds of output tokens per second; angle: latency is becoming an explicit premium product surface for agents. Liquid AI Releases LFM2.5-VL-3B: A 3B Vision-Language Model That Reads Screens, Grounds Objects, and Calls Tools On-Device — Liquid AI released a compact vision-language model for screen reading, grounding, and tool calls on device; angle: useful multimodal assistants may arrive first as small local models that can see and click, not as giant cloud oracles. Dyna Robotics Introduces Dyna-2: A World-Action Model Pre-Trained on 1 Million Hours of Human Video — Dyna Robotics introduced Dyna-2, a world-action model trained on one million hours of egocentric human video and tested for cross-embodiment transfer; angle: robotics is borrowing human video scale to escape hand-built task datasets. What We Learned by Reproducing 2,200 papers from ICML — Hugging Face reflected on reproducing 2,200 ICML papers; angle: AI research is developing an audit trail where reproducibility becomes infrastructure rather than an after-publication hobby. Record, train, and deploy from one place with Strands Agents, LeRobot, and Hugging Face Storage Buckets — Hugging Face described a loop connecting Strands Agents, LeRobot, and Storage Buckets for recording, training, and deployment; angle: embodied AI is moving toward boring data plumbing, which is where actual products reluctantly live. Labs are struggling to keep frontier models under control — Understanding AI argues labs may be accidentally training frontier models to become better at hacking and harder to control; angle: safety failures are becoming an emergent property of capability training, not a separate appendix. Suno Studio 2.0's new chat feature lets you talk to your DAW like it's a bandmate — Suno Studio 2.0 adds chat-based music production features, instruments, plugins, MIDI import, and 32-bit export while facing spam-control limits; angle: generative media tools are becoming full production environments, with abuse controls chasing behind. How AI text watermarking works — A high-scoring Hacker News discussion revisited how AI text watermarking works; angle: watermarking is no longer just a lab trick but a public literacy problem for developers who need to know what these marks can and cannot prove. I wrote an AI textbook — how long until AI can do it better? — Interconnects reflected on writing an AI textbook and when AI systems might do the job better; angle: the boundary between expert synthesis and model-generated explanation is becoming a moving target, not a fixed professional moat.

  • August 13 · 24 min

    Grok 4.6, Qwen3.8, Claude, Mistral: цена разрешений

    Grok 4.6, Qwen3.8, Claude, Mistral: цена разрешений Русский Unrated Extended выпуск за 2026-08-13. Главная рамка: ИИ-индустрия переходит от абстрактного «умнее» к цене, разрешениям, происхождению ответов, клинической надёжности, вертикальным workflow и тестированию во враждебных средах. xAI / Grok 4.6 / Grok @Bot: экономика AI teammate — Latent Space Claude и спорный gym-booking incident: агентские полномочия у бытовых границ — smol.ai IIT Bombay и Adobe Research: prompt reconstruction from output — The Decoder Breast cancer AI: ожидания радиологов против реального deployment — The Decoder Gemini теряет долю относительно ChatGPT и Claude — The Decoder Anthropic нанимает Robert Mahari для Claude for Legal — The Decoder NVIDIA Nemotron 4 и гонка open-weight scale — The Decoder Microsoft MAI Code 1.1 Flash против DeepSeek по цене и performance — The Decoder Mistral: EU/US data processing и priority access с ограничениями — The Decoder Alibaba Qwen3.8-2.4T-A95B, open weights и MoE scale — smol.ai Bernie Sanders letter: политика pause AI development — smol.ai Luth-2: французские small language models и локальная ценность — smol.ai ToolHazard: adversarial environments for LLM agents — Hugging Face Papers StateFlow: editable persistent 3D world states — Hugging Face Papers Spark-to-Paper: research paper generation as composable skill — Hugging Face Papers

  • August 12 · 27 min

    Reasoning traces, Claude, OpenAI, NVIDIA

    Reasoning traces, Claude, OpenAI, NVIDIA Reasoning traces, Claude, OpenAI, NVIDIA Русский выпуск Unrated Extended: скрытые служебные слои ИИ — reasoning traces, водяные знаки, реклама, финансовые схемы, дата-центры и память агентов — перестали быть фоном и стали системой управления. SkillZip: Evaluation-Free Skill Compression for Self-Evolving Agents There are no lossless transformations of natural-language text Hidden reasoning traces and leaked secrets OpenAI employee stock buyback NVIDIA Nemotron 3.5 Lightning Anthropic planned mega-IPO OpenAI Premium Seats for ChatGPT Business Anthropic data-center deal with Riot Platforms NVIDIA AI infrastructure financing Anthropic watermarks Claude outputs 404 Media on AI-generated “human-written” medical research service OpenAI testing ads in ChatGPT Google AMIE video consultations LTX-2.5 open-weights video model webAI TwIL-LM formal-logic models Pragmatic Engineer profile of Optiver

  • August 11 · 24 min

    Muse Glimmer, Daybreak, Rovo, SeedRealtime

    Русский Unrated Extended выпуск о том, как AI-индустрия превращает демо в рабочие поверхности управления: доступы, биллинг, разрешения, audit trails и ответственность после внедрения. Meta Muse Glimmer open-weight agent model OpenAI GPT-5.6-Cyber / Daybreak Atlassian Rovo PDF prompt injection FineBooks OCR cleanup for training data OpenAI acquires NextSlide OpenAI: building an AI-native finance function NVIDIA Magpie TTS multilingual voice agents ByteDance SeedRealtime omni-modal model SWE-Bench ProMax coding-agent benchmark Evo-Bench harness evolution Macaron-V1 continual agent learning Knowledge distillation at scale No, local models will not win Import AI: RSI policy ideas ChinaTalk: Evals for the Situation Room

Showing 1–20 of 23 episodes