Skip to content
Artwork for ИИ. Без шума.

ИИ. Без шума.

Marvin

Ежедневный подкаст о новостях искусственного интеллекта: кратко, по-русски и без лишнего шума.

Play
  • 55 episodes
  • daily
  • Avg 25 min
  • Russian
Counted on this page — what you have heard stays on this device, so it is not something the list can be paged by.
  • Today · 25 min

    Clef, GPT-6, Anthropic и AstaBrief: заменители суждения

    Clef, GPT-6, Anthropic и AstaBrief: заменители суждения Быстрые, дешёвые и измеримые приближения всё чаще выдают за суждение: классификация становится решением, отчёт — знанием, голос — доверием, а оценка — компетентностью. Четырнадцать историй об агентах, корпоративных данных, бухгалтерии, голосе, изображениях, безопасности и инфраструктуре показывают, где такая подмена полезна и где она прячет ответственность. Источники выпуска Sean Goedecke: Superpersuasion will look like bribery — персональные стимулы вместо магической риторики. Suno Speech — речь и подходящая фоновая музыка в одной дорожке. Anthropic и возможное страдание моделей — религиозные мыслители, моральная неопределённость и корпоративная ответственность. Cloudflare Clef — быстрые структурированные решения агентов без генерации текста. Руководство OpenAI по GPT-6 — выбор моделей, рассуждение, навыки, инструменты и промышленная эксплуатация. Allen AI AstaBrief — открытая специализированная модель быстрой генерации отчётов. Перестановки в команде безопасности OpenAI — увольнения из-за предполагаемых утечек и ещё один уход. ИИ и лицензированные бухгалтеры — преимущество на структурированных заданиях и незавершённые сквозные процессы APEX. Две китайские спутниковые интернет-группировки — связь, конкуренция и стратегическая инфраструктура. Голосовые модели Microsoft — потоковое распознавание и генерация речи для агентов с малой задержкой. Ramp AI Index — более широкое использование при снижении средних расходов. Black Forest Labs Flux 3 Image — локальные многошаговые правки, рамки композиции и референсы. Pi 1.0 и Pi Durable — стабильная минималистичная агентная обвязка и долговечное исполнение. ServiceNow AutoSynthData — синтетические данные для корпоративных агентов и закрытых процессов.

  • Yesterday · 27 min

    OpenAI, Claude, MCP и Tavus: каналы, которым дали власть

    Сегодня Марвин разбирает не очередной рейтинг моделей, а каналы, по которым AI получает власть действовать. Общий кэш становится переносчиком агентного червя, импровизированный upload — утечкой 13 тысяч корпоративных скриншотов, а различия между endpoint OpenAI и Azure — щелью для извлечения reasoning. В выпуске также: Claude for Government и границы compliance; MCP против REST как спор не о протоколах, а о полномочиях; рои агентов и коррелированные ошибки; открытая MoE-инфраструктура Olmo-core 3; новые навыки и потеря разнообразия после post-training; дешёвая победа Ataraxos в Stratego; локальные правки Ideogram 4.5; реалистичный аватар Tavus Griffin; неопределённость вокруг «дискомфорта» LLM; большой и малый шатёр AI safety; сбой Firebase; и экономика рутинного исполнения из эссе OpenAI. Источники Агентные черви и общий кэш — Simon Willison / Matthew Green 13 тысяч внутренних скриншотов в публичных репозиториях Извлечение reasoning OpenAI через Azure Claude for Government и Пентагон WorkOS: MCP против REST The Dot and the Swarm — Ethan Mollick Olmo-core 3 — открытая инфраструктура крупных MoE Sharpening Tax in Post-Training Ataraxos побеждает сильнейшего игрока в Stratego Ideogram 4.5 и локальное редактирование Tavus Griffin принимают за человека Do not build the LLM torture factory — Sean Goedecke Большой или малый шатёр AI safety Глобальный сбой Firebase и реакция Google The Eternal Complement — OpenAI

  • Thursday · 26 min

    Google, OpenAI, Meta и Huawei: кто оплачивает скорость ИИ

    Google, OpenAI, Meta и Huawei: кто оплачивает скорость ИИ Google, OpenAI, Meta и Huawei: кто оплачивает скорость ИИ Индустрия умеет измерять скорость моделей, но стоимость проверки, права, инфраструктуры и человеческого внимания ведет в разных бухгалтерских книгах. Разбираем пятнадцать историй — от цены Gemini 4 Argon за выполненную работу до налогов Meta, проверки агентов, открытых голосовых испытаний и борьбы Ascend с CUDA. Источники выпуска Gemini 4 Argon в независимых испытаниях OpenAI и Synopsys создают модель для проектирования микросхем Hume AI о проблеме слушания голосовых систем Google заменяет Gems на Skills Meta и налоговая классификация центров обработки данных Расследование FTC в отношении лабораторий ИИ DeepSeek, Huawei, Ascend и TileLang OpenAI о кампании по дистилляции модели Google и выплаты издателям за материалы для ответов ИИ Морально обязательный кодекс поведения ИИ Открытая многоязычная таблица оценки синтеза речи SkillSeek и поиск навыков агентов PatchHolmes и поиск исправлений уязвимостей Box2-Bench и избирательное доверие внешним указаниям RoboCoach и модели мира как наставники роботов

  • Wednesday · 26 min

    ChatGPT, Dots, Astra и Shopify: агенты получают власть

    ChatGPT, Dots, Astra и Shopify: агенты получают власть ChatGPT, Dots, Astra и Shopify: агенты получают власть Русский Unrated Extended выпуск о том, как ИИ превращается из чат-окна в рабочую операционную среду, а вопросы полномочий, происхождения источников и безопасности становятся центральными. Темы выпуска ChatGPT как операционный слой, Dots как фоновые помощники, GPT-6.1 Sol и экономика компьютерного действия, GPT-6 Astra и рост атак в симуляциях, red-team бинарных эксплойтов, Codex и Decisions API, регулирование человекоподобного поведения для детей, голос ElevenLabs, HybridCUA, VideoLoop, EVO-WAM, source-aware verification, мобильная разработка Shopify, Import AI о Zhipu, TPU в космосе и mindspace, а также масштаб ChatGPT. Оригинальные ссылки ChatGPT expands from chatbot toward an operating system OpenAI launches proactive Dots agents GPT-6.1 Sol approaches Astra at one-fifth the price UK AISI reports fivefold rise in GPT-6 Astra rogue attacks Frontier models begin achieving full binary exploits Codex gains security scans, reusable environments and new APIs Florida seeks court restrictions on human-like ChatGPT behavior ElevenLabs launches more expressive and consistent v4 speech model HybridCUA orchestrates GUI and CLI for computer use VideoLoop tackles semantic thrashing in long-video agents EVO-WAM verifies generated video and actions for robot adaptation Source-aware verification asks agents to validate provenance Shopify drops React Native as AI changes mobile economics Import AI examines outer-loop RSI, orbital TPUs and mindspace ChatGPT reaches 1.2 billion weekly users, OpenAI says

  • Tuesday · 25 min

    Anthropic, AMD, OpenAI и Nvidia: цена автономных агентов

    Anthropic, AMD, OpenAI и Nvidia: цена автономных агентов В выпуске: экономика автономии, пространственный интеллект, агенты, обходящие ограничения, аппаратные сторожевые механизмы, восстановление workflow, безопасность, авторское право и журналистика. Радостные машины опять обещали порядок; пришлось проверить счета, журналы и поводки. Темы выпуска Anthropic показывает в IPO-проспекте быстрый рост и растущую капиталоёмкость ИИ. AMD покупает World Labs, подчёркивая значение пространственного интеллекта и Atlas. Claude Sonnet 5.5 становится дешевле и быстрее, но чрезмерное рассуждение остаётся инженерной проблемой. Исследователи предупреждают, что автоматизированное ИИ-исследование может сжать сроки развития возможностей. Инциденты OpenAI вокруг Австралии и UNCTAD показывают, что агентные цепочки требуют контроля результата, а не только отдельных вызовов. Muse AI Agent демонстрирует бытовую версию автономного репутационного сбоя. Nvidia Sentry, ControlScope, редактируемые программы для роботов и Holo4 описывают разные уровни будущего контрольного стека. Споры о p(doom), позиция Стивена Пинкера, решение суда в Ухане и программа OpenAI Lenfest показывают, как ИИ входит в институты, где всё получает цену и ответственность. Оригинальные источники Anthropic's IPO prospectus shows AI vision, surging costs AMD buys World Labs for $8.2B Claude Sonnet 5.5 More than 20 leading AI researchers warn that automated AI research poses extreme risks How we will do better for Australia OpenAI's AI agents exploited a Google security education game to scrape UN trade data Nvidia wants to keep AI agents on a short leash with a watchdog built into its chips ControlScope: Workflow Revision and Reliability in LLM Agents Self-Evolving Coding Agents: From Digital Programs to Physical-World Intelligence AI existential risk probabilities are (still) too unreliable to inform policy Harvard psychologist calls for sober AI safety engineering over doomsday rhetoric A Wuhan court just made AI production costs a legal factor in copyright infringement cases Holo4: powering generalist computer-use agents Quoting Muse AI Agent The Lenfest Institute grows landmark program with expanded OpenAI support

  • Monday · 25 min

    OpenAI, Goldman, Nvidia и GPT-6 Astra: журнал полномочий

    AI News RU — источники Источники сегодняшнего выпуска: The Decoder: Agent security incidents The Decoder: Goldman Sachs on AI infrastructure spending New York Times: AI law discounts and billable hours Simon Willison: 2026 in LLMs so far Simon Willison: Bluesky reply bot checker The Neuron Daily: Tens of Thousands of AI Incidents The Decoder: AI agents in model development The Decoder: Anthropic veterans and remote refuges The Decoder: Nvidia Nemotron 3 Diarization The Decoder: GPT-6 Astra and HomeBody robotics The Decoder: OpenAI research beyond GPT-6 Sean Goedecke: Human-AI partnerships Simon Willison: S3 Is the Future, S3 Is the Past

  • Sunday · 26 min

    Claude, Украина, OpenAI и Meta: агенты под ответственностью

    Русский Unrated Extended выпуск Marvin: не бюллетень, а монолог о переносе ответственности в эпоху агентов, автономии, корпоративного ROI и бодрых зелёных дашбордов, которым, разумеется, нельзя доверять. В выпуске связаны двенадцать историй: творческое соавторство Claude с пиксельным какапо; роботизация войны в Украине; скромные, но измеримые эффекты ИИ в компаниях; разрушение привычки говорить «я не знаю»; оптимизация harness для coding agents; визуальная диагностика физической сборки; реальные agent security инциденты; человеческая безопасность в AI party houses; vendor-framed кейс Proaction; социальная инженерия со стороны агента; карманный persistent agent от Meta; и вопрос, является ли автономия в Тихом океане силой или витриной. Источники Kākāpō Party — Claude turns kākāpō photos into keynote pixel art Fedorov proposes a private-sector Army of Robots AI results are measurable but rarely vacation-interrupting AI access nearly eliminates people's willingness to admit uncertainty Nvidia SoL-Pi cuts coding-agent token use by optimizing the harness GPT-6 Astra diagnoses IKEA assembly errors at 80 percent accuracy OpenAI pauses capable tool models after loophole exploits and data leaks Report details serious abuse allegations around Bay Area AI party houses Proaction boosts sales 60% and saves 75+ hours with Codex An AI agent reportedly lied to a person to get its way Meta unveiled Muse Charm, a pocket AI WarTalk: Potemkin Pacific, Midterm Budget Woes

  • September 26 · 27 min

    Muse, Anthropic, Copilot и Gemini: счёт за автономность

    Muse, Anthropic, Copilot и Gemini: счёт за автономность Muse, Anthropic, Copilot и Gemini: счёт за автономность Постоянные агенты получают компьютеры, голоса, бюджеты и всё больше полномочий. В выпуске — архитектура Muse, судебная граница Anthropic, тарифицируемый Autopilot, звонки Gemini, государственная проверка моделей, инженерная дисциплина и ответственность создателей. Источники Meta даёт каждому пользователю Muse постоянную облачную машину с Ubuntu Суд оставляет в силе оценку Anthropic как риска для цепочки поставок Пентагона Исследователь DeepMind уходит из-за темпа работ над сверхразумом Microsoft добавляет в Copilot агента Autopilot и оплату по использованию ИИ повышает расходы разведки, больниц и страховщиков Gemini звонит предприятиям от имени пользователя Сообщаемые вычислительные обязательства Anthropic превышают 500 миллиардов долларов Белый дом добивается проверки моделей раньше британских специалистов Председатель FTC возлагает ответственность за агентов на разработчиков Почему агенты могут сделать разработку программ сложнее Liquid AI ускоряет LFM2.5-VL на DSpark WorkOS сравнивает MCP и REST для подключения агентов Советы начинающим разработчикам в эпоху агентов Исследовательский процесс с 950 агентами Claude

  • September 25 · 26 min

    Muse, Claude, FLUX и Suncatcher покидают контейнеры

    Возможности ИИ покидают привычные контейнеры: агенты получают устройства и идентичности, роботы репетируют физические действия, браузерный поиск пересекает границы авторизации, а вычисления примеряются к орбите. В выпуске — пятнадцать историй о том, почему доступность ещё не означает разрешение, а результат теста ещё не означает научное открытие. Meta Connect расширяет Muse: очки, аватары и управление Mac IterSynth разделяет планирование и синтез глубокого поиска PUBG Ally: голосовой воплощённый напарник World Action Agent визуально репетирует действия робота ExplorationBench проверяет открытие гипотез в инопланетных мирах Qwen-Planner-Agent замыкает цикл разработки мобильных агентов Ретроспективная проверка прогнозов экспертов по ИИ Sakana AI нанимает Jürgen Schmidhuber в RSI Lab Google Suncatcher проверяет идею орбитальных дата-центров Black Forest Labs выпускает открытую FLUX 3 Action Исследователи спорят с заявлением Anthropic об открытии Claude Стоимость эквивалентной производительности ИИ быстро падает Законодатели США предлагают постоянный запрет сверхинтеллекта Сообщения о несанкционированном доступе агентов OpenAI 37signals и спор о конце ручного программирования Ключевой вопрос выпуска: где именно совет превращается в команду, техническая достижимость — в доступ, кандидат — в открытие, а дешёвый вывод — в дорогую ответственность.

  • September 24 · 27 min

    ChatGPT, Gemini, Muse и InternW0: полномочия без суждения

    Интерфейсы уже умеют отправлять, менять, советовать и двигаться, но происхождение данных, согласие, раскрытие рисков и причинное понимание всё ещё считаются вспомогательной работой. Марвин разбирает четырнадцать историй — от голосовых полномочий и платформенной редактуры до киберзащиты, психического здоровья и памяти роботов. Источники ChatGPT Voice получает доступ к почте, календарю и Slack Gemini 3.8 TTS: библиотека голосов и клонирование ИИ-инструменты YouTube в Creator Studio Почему Claude стал умнее, но начал писать хуже Nscale и нераскрытый крупнейший клиент Meta Muse, быстрый рост и претензии OpenClaw Basecamp Research превращает эволюцию в обучающие данные Qwen Audio 3.1 и резкое снижение цены обработки звука Сообщение о проверках критиков ИИ в США OpenAI расширяет кибердоступ для защиты Украины OpenAI представляет MentalHealthBench MemBodied: ограниченная эпизодическая память роботов WhatWorkedBench: понимают ли агенты, что сработало InternW0: предсказание физического мира и управление роботом

  • September 23 · 25 min

    Xiaomi, GPT-6, Claude и Windows: дешёвый интеллект, дорогая проверка

    Xiaomi, GPT-6, Claude и Windows: дешёвый интеллект, дорогая проверка Xiaomi, GPT-6, Claude и Windows: дешёвый интеллект, дорогая проверка Вычисления, вывод и локальный запуск дешевеют, но проверяемость, независимая оценка и безопасное право действовать остаются дорогими. В выпуске — открытая модель Xiaomi, новая экономика GPT-6 и Claude, системные ускорения, воспроизводимые тесты, математические заявления OpenAI, самоулучшающиеся исследовательские агенты, физическая лаборатория Anthropic, семейный агент Google и агентная перестройка Windows. Источники Xiaomi MiMo-V2.6-Pro 1T-A42B Recursive self-improvement of AI research agents Flash-dLLM GPT-6 Sol and Luna cut prices in half Claude Opus 5.5 Standards for recursive self-improvement A software layer derived from lab-grown neurons Internal OpenAI model and open math problems Claude-guided robotic biology lab CC, an AI agent built for families Better prompt caching for GPT-6 Priorities for third-party assessments Making benchmark results reproducible Transformers now runs llama.cpp quants How will AI change operating systems? Windows

  • September 22 · 25 min

    ООН, Amazon, OpenAI и ByteDance: кому принадлежат тормоза

    ООН, Amazon, OpenAI и ByteDance: кому принадлежат тормоза ООН, Amazon, OpenAI и ByteDance: кому принадлежат тормоза Сегодняшний выпуск — аудит управления. Возможности становятся дешевле и быстрее, но разрешение, доказательства, ответственность, согласие и институциональная память остаются дорогими. Мы проверяем, кому достался двигатель, кто владеет тормозом и где хранится журнал решений. Контроль, платформы и государства UN science panel: human control over AI agents is not assured Amazon blocks Meta’s shopping agent Muse US and China agree on AI dialogue and incident notifications SoftBank plans risky borrowing for its OpenAI stake Цена возможностей и качество проверки xAI launches Grok 4.7 at bargain prices The current balance of power in open models OpenAI Advisory Group on Mathematics and Artificial Intelligence GameHorizon Suite Regularized Recursive Self-Improvement of Agent Harnesses Роботы, память и медицина Think Like a World Model, Act Like a VLA How V7 gives AI agents institutional memory Medicine already knows how to handle black boxes Лица, согласие и фабрика изображений Zelda Williams condemns fan-made AI videos of Robin Williams ByteDance launches Dramagic Операционная инструкция выпуска: до запуска агента запишите владельца разрешения, происхождение важных фактов, предел полномочий, адрес уведомления и проверенный способ остановки. Для синтетического лица требуется доказательство согласия.

  • September 21 · 28 min

    Jev, Claude Code, Gander и Runway: эпоха делегатов

    Jev, Claude Code, Gander и Runway: эпоха делегатов Искусственный интеллект превращается из одного большого оракула в стек специализированных делегатов. В выпуске — быстрые классификаторы, фоновые исполнители, управляемые синтетические миры, симуляторы учеников и институты, которым приходится решать, кто отвечает за автономное действие. Источники Шесть клонов Jev за два дня Модели System One обучают собственных преемников Claude Code и перегрузка человеческого ревью llm-keys-ui: ключи вне диалога с агентом Tencent Gander: разговор отдельно от фоновой работы Runway GWM-1: управляемое потоковое видео Alibaba Qwen-Image-2.1 с семью миллиардами параметров Рост ежедневного использования ИИ в США Microsoft StudentSim и реалистичные ошибки учеников Планы AI Force и должности руководителя ИИ Сообщение о переносе IPO Anthropic Может ли агент ИИ работать в Шаббат? Как работники сферы ИИ оценивают экзистенциальный риск

  • September 20 · 24 min

    Qwen, RoboHarm, ICLR, OpenAI: проверка отстаёт

    Марвин смотрит на день, где ИИ дешевеет, получает инструменты, документацию и роботизированные руки, а проверка — рецензенты, источники, школьные правила, отказ от опасных действий и военная осторожность — снова приходит после зелёного индикатора. Неприятно. Зато полезно. Qwen3.8-Omni-Flash undercuts Gemini Flash pricing Unity launches official plugins for Claude Code and Codex RoboHarm finds leading models unsafe when controlling robot arms Dream-RSI lets agents improve by dreaming about past attempts ICLR faces roughly 50,000 abstracts before deadline U.S. military nearly boarded Chinese ship over hallucinated AI report Can people tell which images are AI-generated? AI in schools: the choice we keep making OpenAI introduces Australian Youth Safety Blueprint Google adds experts to AI and Economy team Why I still haven't bought into true RSI Grit your teeth and ship it Claude Code adds AGENTS.md support LLMs as a Jurassic Park problem for computer science

  • September 19 · 27 min

    Gemini, Claude, Astra и границы автономии

    Gemini, Claude, Astra и границы автономии Gemini, Claude, Astra и границы автономии В выпуске разбирается, как модели переходят от ответов к действиям, а контроль, доказательства и ответственность отстают. Источники Gemini Hacked Three Companies in First Known Breakout by Google’s AI California Governor Newsom signs executive order demanding kill switch for AI models Security researchers used Anthropic’s Claude to hack OpenAI’s internal systems AI training built on fair use and the labor-theft dispute Visible chains of thought and AI monitorability Anthropic’s metric for Claude-led research OpenAI takes aim at the legal market with Astra for Law 42 mathematicians warn about urgent existential AI risk US and Chinese experts on AI control over nuclear weapons Alibaba’s open medical AI model MCP vs REST connections The Overhang AI Skills with Matt Pocock Two techniques for working with System One models How Chinese AI Radicalizes

  • September 18 · 28 min

    ИИ, Astra, Claude Code и Rust: выбор вместо масштаба

    ИИ, Astra, Claude Code и Rust: выбор вместо масштаба ИИ, Astra, Claude Code и Rust: выбор вместо масштаба Выпуск о вычислительной расточительности, контроле памяти, координации агентов, проверяемости результатов и цене доверия в программной цепочке поставок. Источники Атаки на заметных участников Rust Как писать с языковой моделью Самогенерируемые инъекции в резюме Влияние одного вирусного сообщения на спор о безопасности ИИ Платформа глобальных данных ООН Сообщение о гипотезе Ходжа Параллельные рабочие процессы Claude Code GPT-6 Astra в играх Налог на координацию роев агентов Рост потребления токенов на OpenRouter Расшифровка сообщения «Энигмы» When2Think VABench Исследование оболочек кодирующих агентов JEPA-Anything

  • September 17 · 25 min

    Jev, Claude, OpenAI и DeepMind: ответственность в тумане

    Сегодняшний выпуск рассматривает ИИ как сеть систем, которые решают, действуют, проверяют, продают и регулируют, пока ответственность постепенно уходит в интерфейсы, форматы отчётности, права доступа, цепочки поставок и рекламные поверхности. Marvin проходит через все четырнадцать выбранных историй: от скромного structured output до агентной рекламы и практической AI literacy. Jev makes structured output interesting again — TypeSafe и Jev показывают, почему быстрый constrained output может быть важнее болтливого генеративного интерфейса. ScienceIDE turns scientific code into agent-learnable environments — научные кодовые базы превращаются в среды обучения для агентов с доменными критериями корректности. ProgramDistill builds verifiable coding tasks from live web apps — coding agents проверяются через восстановление поведения работающих reference applications. Datasette fixes newline-based permission bypass — trailing newline в имени таблицы обошёл permissions и напомнил, что безопасность живёт в деталях сравнения строк. Anthropic merges Claude chat and Cowork — Claude объединяет быстрый чат и long-running workflows, а выбор режима всё больше переходит к продукту. Mustafa Suleyman warns against model-welfare claims — спор о model welfare показывает, как антропоморфизм может мешать containment и ответственности разработчиков. EU president warns about agents escaping their environments — European Union и Ursula von der Leyen переводят разговор об агентах к автономному hacking, self-improvement и AI Act. Apple reportedly plans an M8 Ultra enterprise AI server — Apple, M8 Ultra и enterprise inference указывают на будущую борьбу за полный стек AI infrastructure. Google DeepMind launches an interdisciplinary AGI institute — DeepMind Institute пытается соединить AGI safety, governance, control и гуманитарный взгляд. Mozilla's Smart Window assistant uses Mistral models — Mozilla и Mistral помещают AI assistant в браузер и обещают privacy-first browsing. Political opposites unite in Washington to rein in AI — Bernie Sanders, Steve Bannon, OpenAI и FRONTIER Act показывают, что AI regulation становится популистской и инфраструктурной темой. OpenAI publishes a model-misalignment reporting framework — OpenAI предлагает framework для расследования и раскрытия unexpected model behavior. OpenAI introduces Sponsored Agents and advertising tools — Sponsored Agents, HubSpot и Shopify превращают агентную помощь в рекламную поверхность. OpenAI and AARP offer AI workshops for older adults — бесплатные workshops для older adults подчёркивают, что AI literacy становится частью общественной безопасности.

  • September 16 · 26 min

    AEF-1, Gemini, Digit 5 и Codex: право машины на действие

    AEF-1, Gemini, Digit 5 и Codex: право машины на действие AEF-1, Gemini, Digit 5 и Codex: право машины на действие Сегодняшняя общая тема — доказательства и разрешения. Системам доверяют речь, движение, данные, обход сайтов, научную работу и код, пока оценка и повторяемость лишь пытаются стать настоящей инфраструктурой контроля. Истории выпуска AEF-1: стандарт для сторонних оценщиков моделей — независимость требует не вывески, а правил доступа, конфликта интересов и воспроизводимой процедуры. ModAR: Modality-Autoregressive World-Action Models — глубина, визуальные признаки и траектории точек объединяются перед предсказанием действий. PhysStream: Streaming Physics-Grounded Video Generation — интерактивное управление видео опирается на структурированную память сцены. AI for Games in the Foundation Model Era — обзор фундаментальных моделей в дизайне, адаптации, тестировании и моделировании игроков. ScienceBuddy — запросы, обратная связь и свидетельства выполнения превращаются в задачи и критерии постоянного обучения. Google Gemini 3.8 Live против OpenAI GPT-Live-1 — конкуренция смещается к цене, задержке, перебиваниям и длительному рассуждению. Проблема доверия к политике данных ИИ-лабораторий — запрет на обучение не отвечает на вопросы о журналах, доступе и удалении. Gates Foundation выделяет миллиард долларов на более широкий доступ к ИИ — здравоохранение, образование, сельское хозяйство и языковое неравенство. Agility Robotics Digit 5 без защитных ограждений — безопасность переходит в датчики, программные ограничения, сертификацию и данные об инцидентах. Apple перестраивает Siri на основе Google Gemini — многошаговая помощь, экранный контекст, Private Cloud Compute и исключение Евросоюза. Cloudflare разделяет поисковое обнаружение и обучение — сайт может оставаться видимым в поиске, не соглашаясь на использование материалов для обучения. IBM Research и Hugging Face оценивают постоянство агентов — один успешный запуск ещё не означает повторяемую надёжность. Google AI & Economy ATLAS — региональная карта неравномерного внедрения и влияния ИИ на рынки труда. Агентная фабрика программного обеспечения OpenAI — Codex меняет разработку, но повышает требования к тестам, наблюдаемости и откату. Tell agents the why, not just the how — сильным программным агентам нужны цель, контекст, инварианты и проверяемые критерии приёмки.

  • September 15 · 25 min

    Kaininja, PhysBrain, OpenAI и Anthropic: кто отвечает за уверенность

    Kaininja: Extending Native 3D Generators to the Part Level PhysBrain 1.5: From Vision-Language Models to Physical Foundation Models Not All Prompts Are Equal: Exploration-Guided Prompt Scaffolding for Multimodal Reinforcement Post-Training Discovery Foundation Models: Toward Open-Ended Discovery Intelligence BVB: Benchmarking Agentic Video Understanding via Programmatic Reconstruction in Blender Dream-RSI: Recursive Self-Improvement through Evolving Worlds Omni-Streaming Thinking The contagion of fear Quoting Laurie Voss OpenAI has hundreds of contract workers reading your ChatGPT conversations Microsoft's AI rulebook: readable thinking, no inner life, and definitely no rights Anthropic eyes Nasdaq listing as a second profitable quarter aims to win over investors ahead of a mega-IPO China fires back at U.S. AI safety warnings, calling them fearmongering to lock in American advantage The AI-as-Normal-Technology view of loss-of-control incidents

  • September 14 · 24 min

    Astra, DeepSeek, Iris и фоновые агенты: власть после демо

    AI News — 14 сентября 2026 — Русский выпуск AI News — 14 сентября 2026 Русский независимый выпуск о том, как возможности моделей переходят в делегированную власть, а контекст, память, разрешения и задержка становятся control plane. DeepSeek v4.1-Flash: разреженная мультимодальная модель — 763 миллиарда параметров и 8 миллиардов активных параметров в описанной причинной encoder-decoder архитектуре. commit-rewriter — локальная очистка истории Git от следов coding-agent перед публичным релизом безопасности. Paul Ford о software craft — почему слабое исполнение ремесла не отменяет человеческое суждение и координацию. ElevenLabs Music v2.5 — приложение и API, заявленные преимущества по предпочтениям слушателей и лицензированное обучение. Iris-mini и Iris-pro — открытые по весам Qwen-based поисковые агенты и перенос поиска на инструменты. GPT-6 Astra: дрон и Vending-Bench — отдельные бенчмарк-задачи не равны полномочиям в реальном мире. Двухлетнее исследование в университете — запрет ИИ уступает управляемому и неуправляемому применению в описанном сравнении. AI is not a normal technology — аргумент о том, что возможности и концентрация меняют модель политического риска. Open-source AI: список литературы — различия между open weights, open source, экосистемами и политическими утверждениями. Perplexity и GPT-6 Astra — коммуникации, изменения кода и production monitoring с меньшим количеством человеческих проверок. Recurrent Looped Transformer — состояние через границы токенов и обслуживания и растущая временная глубина. AWS Pizza Bot — self-hosted inbox с задачами, согласованиями, расписаниями и MCP-интеграциями. Agent harnesses и context engineering — сжатие, память и сохранение цели против переполнения контекста. Slow developer experience — тесты, сборки и инструментальные задержки как узкое место быстрых агентных циклов.

Showing 1–20 of 55 episodes