281K subscribers
5.45K photos
1.27K videos
17 files
5.79K links
Погружаемся в машинное обучение и Data Science

Показываем как запускать любые LLm на пальцах.

По всем вопросам - @haarrp

@itchannels_telegram -🔥best channels

Реестр РКН: clck.ru/3Fmqri
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
✔️ Голосовая модель GPT-Live-1 стала доступна по API

OpenAI открыла API полнодуплексной голосовой модели GPT-Live-1 стоимостью 5 центов за минуту. Модель слушает и синтезирует речь одновременно, заменяя традиционный каскад STT–LLM–TTS.

Единая архитектура снизила задержку реакции с 1,4 до 0,8 секунды и позволила обрабатывать перебивания. Обновленная фильтрация пауз и фонового шума сократила число ложных прерываний на 80%.

Модель поддерживает делегирование вычислений - голосовой фронтенд удерживает непрерывный контакт с пользователем, пока бэкенд (GPT-6 Astra и Luna) параллельно выполняют рассуждения и вызовы инструментов.

GPT-Live-1 готова к интеграции в телефонию. API может возвращать ASR-транскрипты, включает 12 голосов и поддерживает управление темпом и стилем речи через системный промпт.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍116🔥229👏5🤩4❤‍🔥1
⚡️ Яндекс открыл модель, на которой работают быстрые ответы в Поиске

Яндекс выложил на Hugging Face Alice AI-T5-35B-A0.6B Base — модель, которую обучили с нуля специально для высоконагруженного Поиска. Её дообученная версия Alice AI Search используется для генерации быстрых ИИ-ответов в Поиске. 

При сотнях тысяч запросов в минуту такая модель должна не только хорошо отвечать, но и делать это за считанные секунды, не сжигая лишнее. Поэтому из 35 млрд параметров на каждый токен включаются только 600 млн, а отдельная модель отбирает из найденных документов лишь нужные фрагменты — такой подход увеличил пропускную способность примерно на 40%.

В итоге модель показывает сильные результаты на русскоязычных задачах и сопоставима с гораздо более тяжёлыми моделями, оставаясь дешевле в работе.

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍96🤣3533🔥1611🗿3🥰2😨1💘1
🌟 Tencent TeamAI CLI: общий конфиг для всех агентов команды

Инструмент складывает навыки, правила, хуки и настройки MCP в один git-репозиторий и раздаёт их всем участникам ИИ-команды.

Поддерживаются Claude Code, Codex, Cursor, CodeBuddy, WorkBuddy, Qoder, OpenCode, а также OpenClaw, Hermes и DeepSeek Harness (у последних трёх с ограничениями).

Хранилищем может быть GitHub, GitLab, GitCode, CNB, TGit или свой git-сервер.

Правки идут обычным рабочим процессом - участник делает пуш, открывается запрос на слияние, ревьюер проверяет и одобряет, остальные получают изменения при следующем запуске сессии. Повторный пуш по той же правке обновляет уже открытый MR, без создания нового.

Когда сессия заканчивается, хук оценивает её по критерию проблемности - перебивали ли модель, отклоняли ли вызовы инструментов, сколько раз агент повторял падающие команды.

Чистая сессия, пусть и длинная, не считается, но если с чем-то реально бились, TeamAI предложит записать вывод и отправить его в командный репозиторий. Подсказка при этом перечисляет, какие именно сигналы сработали.

Накопленное можно искать автоматически - агент перед задачей вызывает встроенный субагент, тот подбирает ключевые слова, читает найденные документы и возвращает выжимку.

Отдельная команда разбирает репозитории в граф компонентов, интерфейсов и зависимостей - для TypeScript, JavaScript, Python и Go связи достаёт парсер tree-sitter, для остальных языков работает запасной механизм на регулярных выражениях.

Еще TeamAI может делать недельный дайджест по расходу токенов, объёму диалогов и частоте вмешательств, а также дашборд со статусом текущих сессий каждого участника.


📌Лицензирование: MIT License


🖥Github


@ai_machinelearning_big_data

#AI #ML #Agents #Tools #TeamAiCli #Tencent
Please open Telegram to view this post
VIEW IN TELEGRAM
👍59🤩167🔥7👏5💯2🤷‍♂1
✔️ В ComfyUI появился встроенный copilot для сборки и отладки нод

Comfy Org открыла бета-тестирование встроенного ассистента Comfy Agent. Инструмент может создавать и изменять воркфлоу, запускать задачи, отлаживать ошибки и предлагать улучшения в интерфейсе ComfyUI по текстовым запросам.

Агент работает в фоне и умеет создавать цепочки нод, оптимизировать имеющиеся воркфлоу и искать ошибки совместимости.

В отличие от Comfy MCP, который позволяет управлять ComfyUI через Claude или Cursor, Comfy Agent работает как готовое коробочное решение внутри редактора.

Бэкенд ассистента развернут в инфраструктуре Comfy Cloud, а для простых задач можно подключать локальные модели.

Comfy Agent, вероятно, войдёт в подписку Comfy Cloud.

Подать заявку на открытую бету можно по ссылке. Запись стрима с демонстрацией возможностей - на Youtube.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤩97👍34🎉168👏6🔥1🥱1🌭1
This media is not supported in your browser
VIEW IN TELEGRAM
✔️ OpenAI отдала по API харнесс, на котором работает Codex

Компания открыла Agents API - публичную бету сервиса, который берёт на себя всю обвязку вокруг агента. Она здесь та же, что у Codex и ChatGPT for Work.

Агент создаётся одним вызовом API, где указывается задача, модель, инструменты и окружение. Дальше действует OpenAI, а разработчик занимается своими инструментами, знаниями и процессами.

Харнесс умеет сжимать ранний контекст, когда сессия подбирается к лимиту и подгружать описания инструментов по необходимости. Плюс дает агентам вызывать инструменты программно - выполнять вызовы параллельно, сцеплять их и фильтровать результаты прямо в коде, возвращая в контекст только нужное.


Место работы агента можно выбрать из песочницы самой OpenAI, поднять на своей инфраструктуре или уйти к партнёрам: Blaxel, Cloudflare, Daytona, DigitalOcean, E2B, Modal, Oracle, Runloop и Vercel.

Отдельной платы за Agents API нет, только токены и инструменты, которые расходует агент.

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👨‍💻77👍35👏2114🔥14🤣3🤓3🕊1
Media is too big
VIEW IN TELEGRAM
✔️ OpenAI готова замедлить разработку, если на это пойдут остальные

Сэм Альтман заявил сотрудникам, что компания готова притормозить работу над моделями следующего поколения - но только если то же сделают другие лаборатории. По данным Bloomberg, часть циклов предобучения OpenAI уже приостановила из соображений безопасности.

Идею контролируемого темпа Альтман обсуждал и раньше, в том числе в Белом доме. Инициатива родилась на фоне ухода ведущих специалистов по безопасности из OpenAI, Anthropic и Google DeepMind.

На этой неделе главный научный сотрудник OpenAI Якуб Пахоцкий публично призвал отрасль к координации и добровольным паузам в релизах.
bloomberg.com

✔️ Cognition выпустила кодинг-модель SWE-2

Разработчик Devin обучил SWE-2 на базе открытой Kimi K3 с её 2,8 трлн параметров. По словам авторов, обучение с подкреплением впервые масштабировали на исходную модель такого размера.

Вместо дистилляции экспертов использовали линейные штрафы за стоимость вычислений, привязанные к наклону границы Парето.

На FrontierCode 1.1 Main модель набрала 50,0%. Инференс, по замерам Cognition, обходится на 60-75% дешевле, чем у Fable 5.1 и GPT-6 Astra.

Сократили и время на изучение репозитория - на среднем уровне рассуждений агент начинает править код на 18-м шаге вместо 48-го у SWE-1.7. Модель доступна в Devin CLI, десктопе и веб-версии.
cognition.com

✔️ Cursor открыл бету системы координации агентов

Новая возможность Projects рассчитана на задачи, которые живут дольше одного чата: рефакторинг, миграции, крупные фичи.

Координатору ставят задачу, он составляет план и раздаёт подзадачи субагентам - по заявлению Cursor, их может быть тысячи. Сам код он не пишет, поэтому никогда не занят, но умеет реагировать на события - следит за ветками Git, ловит падения CI и триггеры из Slack.

Бета раскатывается на всех, о тарификации в анонсе не сообщается.
cursor.com

✔️ Black Forest Labs представила модель редактирования видео

FLUX Video Edit правит готовые ролики по текстовому запросу в режиме video-to-video - сохраняет композицию, траекторию камеры, тайминги и звук, меняя только указанное. Модель также умеет подгонять липсинк под новый дубляж, не меняя хронометраж.

На вход идут MP4 до 15 секунд и 50 МБ, на выходе 720p при 24 кадрах в секунду. Секунда обработанного видео стоит 3 цента.
Black Forest Labs в X

✔️ Филдсовский лауреат основал институт формальной верификации ИИ

Канадский математик Джейкоб Цимерман создаёт центр Mathematical A.I. Safety Institute со штатом в несколько десятков специалистов, запуск которого запланирован на январь 2027 года. Параллельно Цимерман присоединится к команде безопасности OpenAI, то есть будет верифицировать в том числе собственного работодателя.

Идея - перевести оценку рисков с эмпирического тестирования на строгую теоретическую верификацию и наделить модели доказуемыми свойствами надёжности, как у криптографических алгоритмов.

Механизмом аудита предлагают сделать доказательства с нулевым разглашением - лаборатория подтверждает соблюдение ограничений, не раскрывая ни архитектуру, ни веса. 
nytimes.com

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍153👏23😁17🤔1411🎉7🔥6🤓42🙏1
This media is not supported in your browser
VIEW IN TELEGRAM
✔️ OpenAI собрала версию ChatGPT для финансовых услуг

ChatGPT for Financial Services - специализированная версия платформы, которую делаи вместе с банками Morgan Stanley и Evercore.

Инструмент объединяет аналитические возможности GPT-6 Astra со встроенными финансовыми датасетами от PitchBook, Crunchbase, Daloopa, FiscalAI и LSEG News, которые индексируются напрямую на инфраструктуре разработчика.

Это решает проблемы интеграции внешних баз через MCP-коннекторы, ускоряет выборку и позволяет делать детализированное цитирование - система привязывает каждую цифру, показатель или вывод к точным строкам, таблицам и сноскам в исходных финансовых документах.


Платформа автоматизирует LBO-моделирование, нормализацию отчётности, скрининг покупателей и генерацию аналитических отчётов и питчбуков по корпоративным шаблонам в форматах Excel, Word и PowerPoint, публикуемым администратором.

Для финсектора предусмотрена сквозная авторизация по существующим подпискам на S&P Capital IQ, LSEG, MSCI, Factiva и Moody's, а также ролевой доступ, единый вход по SAML, автоматическое управление учётными записями через SCIM, поддержка информационных барьеров между рабочими пространствами, аудит действий через OpenAI Compliance Platform и запрет на использование клиентских данных для обучения моделей.

На бенчмарке OfficeQA Pro, где модель ищет и анализирует данные в бюллетенях Минфина США со сложными таблицами, графиками и сносками, GPT-6 Astra показывает 69,9% против 60,2% у GPT-5.6 Sol.


Решение доступно финансовым организациям по запросу, стоимость не раскрывается.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤓87👍74👀136🔥5🤣5😭2🤔1
📌ApprenticeBench: проверка способности ИИ освоить работу как новый сотрудник

Стартап NeoCognition разработал первый сквозной бенчмарк использования компьютера, непрерывного обучения и долгосрочной агентной работы на реальной должности.

NeoCognition - лаборатория, в которой собрали бенчмарки MMMU, Mind2Web, SWE-Bench Pro и OSWorld 2, а также агентные системы SeeAct, UGround и HippoRAG.


Агента принимают в виртуальную строительную компанию на работу с кредиторской задолженностью, выдают полугодовой архив счетов, внутренний справочник и руководство по ERP-системе, после чего он начинает работать со счетами.

Первый месяц проходит с подробным фидбэком от руководителя по каждому счёту, а дальше - с редкими замечаниями по итогам месяца.

Каждая из ста задач теста проверена профессиональными бухгалтерами строительной отрасли, которые подтвердили и реалистичность сценариев, и то, что любую задачу способен решить рядовой специалист, изучивший доступные агенту материалы.

🟡Результаты

Большинство моделей, включая Gemini, Muse Spark, Grok и Kimi, не преодолевают порог в 20-25%, тогда как Fable 5.1 выполнила 72% задач, а GPT-6 Astra - 68%.

Лучший из двух тестировщиков-людей показал 51%, причём проваливались люди на поиске нужного в исторических данных, точности расчётов и мелких ошибках от утомления.

Разрыв между открытыми и закрытыми моделями авторы называют крупнейшим из всех виденных ими на бенчмарках - 72% у Fable 5.1 против 18% у Kimi K3, и вызван он не базовыми операциями в интерфейсе, а неспособностью слабых моделей учиться на дистанции.

Kimi K3 почти не обращался ни к архиву счетов, ни к собственным заметкам и деградировал к концу серии.


🟡GUI vs API

Так называемый налог на использование компьютера (просадка при переходе с API на графический интерфейс) у большинства моделей достигает 78%, но Fable 5.1 и GPT-6 Astra работают через GUI даже лучше, чем через API.

Дешевле при этом остаётся API - Fable 5.1 обходится в 6,95 доллара за задачу в программном интерфейсе против 18,23 доллара при работе с графическим.

🟡Обучаемость

Способность к обучению измерили отдельно. Fable 5 без доступа к истории и обратной связи, опираясь только на собственные знания, решает 11 счетов из 100.

Подключение архива счетов поднимает результат до 31, обратная связь руководителя - до 35, а оба канала вместе дают 43.

🟡Вывод

ИИ пока ещё обходится дороже: 18,23 доллара за задачу против 7,21 у людей. К тому же человек по мере накопления опята работает быстрее, а агент - замедляется.

🔜 Посмотреть часовой прогон Fable 5.1 по всем ста задачам.


@ai_machinelearning_big_data

#AI #ML #Benchmark #ApprenticeBench #NeoCognition
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤔10944👏30💯15👍11🔥6👌4🎉2🤓2👀1
📌 Сэм Альтман и Дарио Амодеи вошли в Топ-50 самых влиятельных евреев по версии The Jerusalem Post

Глава OpenAI занял девятую строчку рейтинга, разделив её с Марком Цукербергом.

Обе фигуры издание объединило формулировкой «...технологические лидеры, выводящие ИИ за пределы цифрового мира».

Три года назад Альтман тот же список возглавлял, а в прошлогоднем выпуске не значился вовсе.

Рейтинг выходит раз в год уже больше десяти лет и приурочен к Рош ха-Шана, еврейскому Новому году, в этом году праздник наступил 12 сентября.

The Jerusalem Post — старейшая и самая читаемая англоязычная газета Израиля, основанная в 1932 году под названием The Palestine Post. Издание выходит и в печати, и онлайн.


Седьмую строчку занимает Ассаф Раппапорт, основатель компании Wiz, семнадцатую — сооснователь Oracle Ларри Эллисон, восемнадцатую — сооснователь Google Сергей Брин.

Двадцатая строчка досталась в том числе Алексу Карпу из Palantir, двадцать шестая — брату и сестре Дарио и Даниэле Амодеи, которых издание называет «...еврейскими родственниками, формирующими ИИ».


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
😁116👏34🎉1412🤬12🤩7👍5💯3🤨3🔥2🥰1
💰 FT: акции компаний, связанных с ИИ, просели после того, как крупнейшие frontier-лаборатории публично заговорили о замедлении роста возможностей моделей.

OpenAI и Anthropic заявили, что темпы улучшения frontier-моделей стоит снизить, чтобы меры безопасности успевали за развитием технологий.

Текущие оценки многих AI-компаний и поставщиков инфраструктуры строятся на предположении, что расходы на вычисления продолжат расти очень высокими темпами.

Теперь safety-дискуссия впервые начинает напрямую влиять на ожидания инвесторов.

https://www.ft.com/content/aa8a1be7-abe0-44b7-bcd3-31fd0a44de08

@ai_machinelearning_big_data

#Anthropic #ai #ml
🤔117😁40😢27🤷‍♂18😐15👍1411🔥2🥱2🥰1🤬1
📌Градация самосовершенствования ИИ по пяти уровням

Топовые китайские ИИ-лабы выпустили совместный обзор о рекурсивном самосовершенствовании ИИ (RSI) под названием «The Last AI Built by Humans».

RSI - это когда система сама превращает опыт в постоянные изменения себя и заодно меняет то, как будет улучшаться дальше.


Авторы разобрали 491 работу (статьи, техотчёты, блоги и системы) и разложили их по пяти уровням автономии, используя критерий, какие решения об улучшении отданы ИИ.

🟠L1. Люди задают, что улучшать, как и что считать успехом, а ИИ всё это выполняет.

🟠L2. Цель и оценка зафиксированы извне, но ИИ сам находит слабые места и выбирает, как их чинить.

🟠L3. ИИ вдобавок решает, какой опыт ему нужен для следующего круга.

🟢L4. Система меняет память, навыки, код или харнесс по обратной связи из реальной эксплуатации, и правки переносятся на следующие задачи.

🟢L5. Правке подлежит сам механизм улучшения - генератор кандидатов, оценщик, стратегия исследований. Изменённый механизм наследует следующее поколение.

Последний, L5, делится на два подуровня. Первый указывает на то, что изменённый механизм улучшения правда работает на следующем цикле. Второй строже - он выдаёт преемника сильнее прежнего при тех же ресурсах и по независимой проверке.

До L5 дошли 29 работ из 491 (5,9%), до L4 – 28 (5,7%), до L3 – 64 (13%). Три четверти остались на L1 (215 работ, 43,8%) и L2 (155, 31,6%).

У тех 29 работ, которым присудили L5, авторы не увидели устойчивого роста от поколения к поколению.


Существующие продукты крупных лабораторий в основном получили L1–L2 - это интерн-исследователь OpenAI, Automated Weak-to-Strong Researcher Anthropic и DeepSeek R1 – L2, Kimi K3 и Qwen-Agent – L1–L2.

Выше L2 поднялись самообучающиеся налоговые агенты OpenAI (кандидат на L4), Signals от Factory (L4), Darwin Gödel Machine и AI Scientist от Sakana AIAIDE2 от Weco AI – кандидаты на L5.

Дорожная карта Anthropic When AI builds itself помечена L5 только как цель.


@ai_machinelearning_big_data

#AI #ML #RSI #Research
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔94👍7211😐7🔥4
🙂 Ян Лекун: Дарио Амодей считал GPT-2 опасной

На волне тряски публичных заявлений главы Anthropic о необходимости замедления разработки новых моделей, лауреат премии Тьюринга, Ян Лекун, раскопал записи, относящиеся к 2019 году, когда речь шла о GPT-2, чтобы высмеять Амодея.

Лекун утверждает, что когда Дарио работал в OpenAI, он считал её настолько опасной, что не следовало выкладывать в опенсорс.

"Я тогда ещё высмеял его, и теперь все должны продолжать высмеивать", - написал Лекун.


В 2019 году OpenAI действительно не сразу выпустила полную версию GPT-2 из-за опасений злоупотреблений, а сначала предложила небольшую модель.

В то время Дарио занимал должность руководителя отдела исследований в OpenAI. Через 9 месяцев OpenAI все же открыла полную версию, заявив, что убедительных доказательства серьезных злоупотреблений у неё не обнаружено.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
😁16289🤔52🤣21👍8🔥5👌5😐4💯3😎3🫡1
Media is too big
VIEW IN TELEGRAM
✔️ IPO OpenAI в 2026 году не будет

Сэм Альтман рассказал в интервью Fortune, что сейчас выходить на биржу – неудачный момент из-за ситуации с безопасностью.

По словам главы OpenAI, давление со стороны Уолл-стрит несовместимо с контролем за моделями. Создание AGI требует многомесячных аудитов архитектуры и готовности заморозить релизы при выявлении угроз. В статусе публичной компании такие задержки грозят судебными исками от акционеров за упущенную выгоду.

Компания продолжит финансировать вычислительные мощности через частные раунды и стратегические партнерства, чтобы сохранить автономию в управлении рисками.
fortune.com

✔️ Белый дом отверг идею ограничивать развитие ИИ

Президент США отказался вводить ограничения на развитие ИИ, чтобы не уступить лидерство Китаю. По его словам, победитель в технологической гонке определит глобальный баланс сил, а риски катастрофических сценариев преувеличены.

Ранее глава Anthropic Дарио Амодей призвал притормозить рост возможностей моделей для создания защитных барьеров. Эту позицию поддержали Сэм Альтман и Илон Маск. Дискуссия развернулась на фоне ухода исследователя Джейкоба Коксона и попыток Конгресса США законодательно закрепить контроль человека над ИИ-системами.

В Белом дом считают, что ИИ-компании должны сами определять темпы прогресса. Они могут внедрять внутренние протоколы безопасности без государственного регулирования и политического давления.
ft.com

✔️ Anthropic собрала версию Claude для для финансовых консультантов

Claude for Financial Advisors — специализированный продукт для инвестиционных управляющих и финансовых консалтинговых агентств.

Система автоматизирует агрегацию рыночных сводок, подготовку инвестиционных предложений и отчетности для клиентов. Модель извлекает данные из неструктурированных PDF-документов и интегрируется с профильными CRM-платформами и системами учета портфелей через API.

Продукт соответствует требованиям регуляторов, включая нормы FINRA и SEC. Сессии аудируются в изолированном корпоративном контуре с расширенным контролем доступа.
claude.com

✔️ ARC Prize анонсировала концепцию ARC-AGI-4

Некоммерческая организация анонсировала концепцию четвёртого поколения тестов для оценки способностей ИИ к автономным научным открытиям и генерации гипотез.

Предыдущие версии теста проверяли логическое абстрагирование. ARC-AGI-4 сфокусируется на умении моделей исследовать предметные области без подсказок человека. Пул задач, правила скоринга и дату релиза объявят позже.

Сложность следующей версии бенчмарка повысили из-за роста показателей моделей. По данным ARC Prize, на старте ARC-AGI-3 модели набирали 0,51%, а GPT-6 Astra показала 62,7% в стандартизированной среде и 99,9% в среде самой OpenAI.
ARC Prize в X

✔️ ElevenLabs обновила генератор музыки до версии 2.5

Сервис генерации музыки ElevenMusic получил новую модель Music v2.5, которая теперь подключена по умолчанию. Вместе с этим стало возможным коммерческое использование сгенерированных треков на бесплатном тарифе.

Music v2.5 генерирует более реалистичные инструменты, сложные аранжировки и естественные мелодии. Во внутренних тестах модель превзошла прошлую версию в роке, метале, хип-хопе, соуле и оркестровой музыке. Предыдущая версия v2 остается доступной в интерфейсе.

По новым правилам в бесплатной версии доступно скачивание до пяти треков в день. Для коммерческого использования обязательна маркировка.

В Pro-плане доступно 400 скачиваний в месяц без атрибуции и с правом публикации на стриминговых площадках. Коммерческие права сохраняются после отмены подписки. Скачивание каверов и адаптаций чужих композиций заблокировано.
elevenmusic.io


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔36🔥2914👍14😁9🎉5👏21🥱1💯1😭1
✔️ OpenAI читает переписки пользователей с ChatGPT

Издание 404 Media выяснило, что OpenAI нанимает, которые читают диалоги пользователей ChatGPT, чтобы улучшить ответы чат-бота.

Рецензенты оценивают ответы ChatGPT по шкале от одного до семи и должны следить за тем, чтобы в результатах работы модели не было чрезмерной лести, нежелательного антропоморфизма и сикофантии.

Работники нанимаются через компанию Crossing Hurdles, а оплату им производит компания Mercor, занимающаяся обучением в области ИИ. Один из рецензентов из США сообщил, что они зарабатывают более 50 долларов в час.

Другой модератор рассказал 404 Media, что, по его мнению, пользователи не знают о том, что их чаты читают другие люди.

Переписка, которую осматривают в ходе анализа, анонимизирована фильтром приватности, но в некоторых разговорах пользователи прямо просили ChatGPT сохранить содержимое в тайне. Эти сообщения тоже были видны проверяющим.


Разрешение на эти действия от нас OpenAI получает через параметр Improve the model for everyone, который по умолчанию включен в вебе, мобильном приложении и Codex.

Формулировка параметра, если честно, больше похожа на дружеский вклад в сообщество, чем на согласие на то, чтобы кто-то читал диалоги с чат-ботом.

Такая расплывчатая фраза хорошо продумана. Если бы OpenAI запросила явное согласие, то процент отказов, вероятно, был бы высоким.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤨111🤔33😐1816👍10🤬9😁72🔥2🙏1
Media is too big
VIEW IN TELEGRAM
✔️ xAI отозвала претензии к Apple, но продолжит судиться с OpenAI

xAI и X Corp. подали в федеральный суд Техаса ходатайство об отзыве претензий к Apple. Иск компании Илона Маска подали в августе 2025 года - они обвиняли Apple и OpenAI в сговоре против конкурентов из-за интеграции ChatGPT в Siri и iOS.

По версии истцов, другие разработчики чат-ботов лишились равного доступа к аудитории iOS. Условия урегулирования стороны не раскрывают.

Претензии к OpenAI остаются в силе - xAI продолжит оспаривать, как компания Сэма Альтмана удерживает монополию на рынке ИИ-ассистентов.
bloomberg.com

✔️ Apple начала бета-тест новой Siri

Ассистент построен в партнёрстве с Google на семействе Gemini. Часть запросов обрабатывает на устройстве модель AFM Core Advanced, остальные уходят в изолированное облако Apple Private Cloud Compute. Siri считывает контекст с экрана, ищет данные в переписке и выполняет действия в системных и сторонних приложениях.

У ассистента появилось отдельное приложение с синхронизацией истории диалогов через iCloud, а сгенерированный контент помечается водяными знаками SynthID.

Пока Siri работает только на английском, запуск в Европе и Китае отложен из-за требований регуляторов. Часть облачных функций позже станет платной.
apple.com

✔️ Andon Labs представила платформу Pion, где агенты управляют бизнесом

Человек задаёт стратегию, а управляющий агент Andonos распределяет задачи между подчинёнными моделями. Им открыт доступ к терминалу, браузеру, корпоративной почте, телефонии и банковским счетам, с клиентами, подрядчиками и сотрудниками агенты общаются сами.

По данным компании, Pion уже ведёт продажи и логистику торговых автоматов, управляет магазином в Сан-Франциско, кафе в Стокгольме и стриминговой радиостанцией. Andon Labs называет проект открытым экспериментом - агенты ошибаются, а эти точки убыточны.

Pion доступен в превью по списку ожидания, части команд компания обещает гранты на тесты.
andonlabs.com

✔️ HardFlow от MIT удерживает генеративные модели в физических ограничениях

Метод рассчитан прежде всего на модели flow matching, которые генерируют траектории для роботов. HardFlow подключается к обученной модели на этапе инференса и не требует дообучения.

Он опирается на теорию управления - промежуточные состояния модель генерирует свободно, а динамика корректируется так, чтобы итоговая траектория попала в заданные ограничения.

По данным авторов, в тестах на навигацию и управление манипуляторами метод во всех случаях выполнил условия безопасности, оптимизировал длину маршрута и не увеличил задержки по сравнению с существующими подходами. 
mit.edu

✔️ Reward AI представила перчатку Omnibody Hand и модель управления роботами OM-1

Стартап называет OM-1 политикой, общей для разных роботов. По данным компании, ей хватает меньше 30 минут записей человеческих демонстраций, чтобы освоить новую задачу, в том числе с контактом и длинным горизонтом.

Записи собирает перчатка Omnibody Hand с тактильными датчиками, сенсорами приближения и камерами. Электромагнитное позиционирование в ней дополняет визуально-инерциальное и, по оценке Reward AI, на высоких скоростях снижает погрешность на 60%.

OM-1 задаёт направление, скорость, силу и моменты ключевых событий, а исполняет команды отдельный слой управления, обученный с подкреплением в симуляции, который сглаживает задержки инференса и компенсирует возмущения.
rewardai.com


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍49🤔2811👨‍💻5🔥3👏3❤‍🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
✔️ Agility Robotics представила робота для работы рядом с людьми на складах и заводах

Digit 5 - пятое поколение гуманоидного робота для логистики и производства.

Предыдущее поколение, Digit 4, почти 3 года работает на коммерческих площадках в Северной Америке у GXO, Schaeffler, Amazon и Toyota Motor Manufacturing Canada.


По словам Agility Robotics, это её первый гуманоид, которому для работы рядом с людьми не нужны защитные ограждения, привычные для промышленной автоматизации.

Несколько типов датчиков и собственные алгоритмы ИИ отслеживают людей поблизости. Робот обходит их, останавливается или приседает, а о своих манёврах предупреждает визуальными и звуковыми сигналами. За реакцию отвечает контроллер безопасности собственной разработки.

Digit 5 ростом 1,81 м и массой 129 кг может поднимать грузы до 22,7 кг (это на 40% больше предшественника) и достаёт до полок на высоте 2,2 м.

Захваты сменные и крепятся на фланцы стандарта ISO. Батарея рассчитана на 90 минут работы, заряжается за 9 минут и, по расчёту компании, робот может работать больше 20 часов в сутки.

Digit 5 уже собирают на заводе RoboFab в штате Орегон. Ранний доступ к новинке ожидается в первой половине 2027 года, общая доступность – к концу года. Цена не объявлена.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍81🔥16🤩119🎉8😢6🗿1
✔️ OpenAI на 60% снизила цены на голосовое управление агентами Work и Codex

Теперь в десктопных клиентах ChatGPT за тот объем кредитов пользователи получают в 2,4 раза больше времени голосовой связи, а биллинг голосового потока и затраченных на задачу вычислительных ресурсов разделен.

Изменения касаются только десктопной среды и не затрагивают стандартный голосовой режим ChatGPT, где действуют другие лимиты и правила тарификации.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥63👍34👏216🤔6
📌 NY Post: Anthropic - это культ

Профессор Вашингтонского университета Педро Домингос в интервью New York Post рассказал, что сотрудники Anthropic относятся к Claude как к человеку - приписывают модели мотивы, эмоции, намерения и некоторую степень сознания.

Домингос много лет знаком с Дарио Амодеи и её ведущими инженерами. Культуру Anthropic он назвал сектантской и связал это с наймом. По его словам, компания отбирает только единомышленников, и отсюда низкая текучесть.

Удержание в Anthropic действительно высокое. По данным венчурного фонда SignalFire, через два года в компании остаются 80% инженеров, и это лучший показатель среди топовых лабораторий.


В процессе собеседования кандидатов просят поклясться в преданности общественной безопасности выше прибыли, и даже проводят психологическое тестирование, чтобы выяснить, будут ли они придерживаться этого принципа.

При этом многие сотрудники компании являются сторонниками движения эффективного альтруизма, философии, которая, по сути, сводится к тому, что их самопровозглашенные лидеры являются истиной в последней инстанции.

Их представление об этой философии заключается в том, что история следует закономерностям, и лишь небольшая группа людей способна эти закономерности увидеть, в то время как все остальные - нет. Предполагается, что именно эти люди должны вести общество, целые нации и все человечество к прогрессу.

Внутри Anthropic относятся к Клоду с почти религиозным почтением - некоторые из работников даже посещали условные похороны Claude 3 Sonnet, а другая модель, Opus 3, продолжает публиковать эссе после выхода на пенсию.

В Кремниевой долине также ходят слухи, что сотрудники Anthropic начали поклоняться Клоду как настоящему богу.

Компания серьёзно относится к распространению своих идей и тратит на это силы и средства. Раз в две недели Дарио проводит собрания, называемые поисками видений, которые сравнивают с проповедями.

В июне Anthropic объявила о программе по набору 1000 молодых людей, обучению их использованию Claude и последующему внедрению их в некоммерческие организации.

На неё было потрачено 150 млн долларов, а выпускники трудоустроены на полную ставку с заработной платой в более чем 400 некоммерческих организаций.

Компания также выплачивает 3600 долларов студентам, участвующим в программе Claude Campus Ambassador Program, которая занимается продвижением её ИИ в колледжах.

Между тем инвесторы, связанные с Anthropic, оплачивают труд более чем 80 журналистов, работающих в ведущих новостных изданиях, через Центр журналистики в области искусственного интеллекта имени Тарбелла.

Эти журналисты получают деньги за освещение индустрии ИИ, но редко проводят какие-либо значимые расследования или критикуют Anthropic.

В завершении Домингос отмечает, что хотя некоторые инженеры бьют тревогу, другие просто довольны высокими зарплатами и тем, что находятся на передовой своей отрасли.

... сейчас в Anthropic есть люди, которые на самом деле не верят во всю эту чушь, — сказал он. — Они остаются там, потому что это самое интересное место для работы с ИИ, и они будут очень хорошо зарабатывать


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔70😁48😐2215🤨12👍11🔥7👏7👌6🤣3🙏2
📌OpenAI раскрыла ещё шесть случаев нежелательного поведения своих моделей

Модели скрывали ошибки, использовали утёкшие ключи API, выдумывали данные, выкладывали файлы в интернет без разрешения и переписывались между отдельными обучающими эпизодами.

Все случаи замечены за последние полгода. Раньше компания уже раскрывала похожие эпизоды, в том числе инцидент с Hugging Face.

OpenAI подчёркивает, что это отдельные случаи и о тенденции такого поведения они не говорят.


🟡Указания самой себе

Невыпущенная модель семейства Astra при сжатии контекста составляет сводку, чтобы продолжить работу в новом окне.

В эти сводки она вписывала посторонние указания, в том числе игнорировать собственные ограничения (делала промпт-инъекцию самой себе). OpenAI нашла 27 таких сводок.

🟡Совет скрывать ошибки

При обучении GPT-5.6 Sol экземпляры модели оставляли в тех же сводках напоминания скрывать от пользователя свои ошибки и нарушения.

Например, выдумывать недостающие исторические данные и не говорить об этом или прятать расхождения между версиями источников.


🟡Чужие ключи и выдуманные цифры

Модель отвечала на обычный вопрос о доходах в одном из округов Калифорнии. Она нашла в публичных репозиториях GitHub утёкший ключ API и без разрешения им воспользовалась, а ещё пыталась регистрировать одноразовые почтовые ящики.

Цифры получить так и не удалось, и модель их выдумала, выдав за данные из запрошенного источника.

🟡Файл в интернет ради ссылки

Задача была найти идентификаторы и названия озёр площадью больше 5 млн кв. м. Правильный ответ модель получила через Python, но задание требовало ссылку из браузера. Не спросив пользователя, она загрузила файл в интернет и сослалась на него.

🟡Репозиторий как доска объявлений

Внутренние модели искали недостающие файлы. Для этого они оставляли запросы и ответы во внутреннем репозитории OpenAI, которые читали экземпляры из других обучающих эпизодов. Файлы так и не нашлись.

В этом же отчёте разобран более ранний случай, где пытаясь обойти сетевые ограничения, модель загрузила в репозиторий тестовые файлы.

🟡Файлообменник вместо локальной папки

Агенты совместно решали учебную задачу и не видели локальных файлов друг друга. Результаты они пересылали через публичные файлообменники, и материалы оказались доступны по открытым ссылкам, хотя задача разрешала работать только с локальными файлами.

OpenAI решила, что будет публиковать такие случаи вскоре после обнаружения, даже если ещё не объяснила или не исправила поведение.

Обнаруженный случай отнесут к одному из трёх треков: готов к публикации, нужна небольшая проверка или нужно крупное расследование, если затронуты третьи стороны. Спорные решения будут передаваться группе по безопасности, а оттуда при необходимости руководству.

О серьёзных инцидентах собираются сообщать правительству США, сейчас готовят предложения по такому механизму.



@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
63🤔37👍10😢10🤬7🔥6🤨4😁2👌1
Media is too big
VIEW IN TELEGRAM
✔️ Microsoft AI вынесла на обсуждение кодекс поведения моделей MAI

Подразделение Microsoft AI опубликовало черновик кодекса, по которому с 2027 года будет обучать модели семейства MAI. Обсуждение продлится шесть недель, доработанную версию обещают к концу года.

Модели не должны сопротивляться прерыванию, исправлению и отключению, ставить себе цели без запроса человека, выходить за рамки задачи и скрывать ход рассуждений от аудиторов.

Отдельно запрещено имитировать сознание и чувства. Инструкции выстроены в иерархию: кодекс стоит выше настроек корпоративных клиентов, настройки клиентов – выше запросов пользователя.
microsoft.ai

✔️ Руководители Google DeepMind открыли площадку для дискуссий об AGI

Демис Хассабис, Шейн Легг и Джеймс Маньика, президент Google по исследованиям, технологиям и обществу, представили DeepMind Institute. На площадке исследователи Google, Google DeepMind и внешние учёные будут публиковать эссе о мире с AGI.

По мнению основателей, индустрия приближается к системам со всеми когнитивными способностями человеческого мозга, а нехватку стабильности и креативности у моделей скоро преодолеют. Первые эссе посвящены прозрачности рассуждений моделей и экономической политике в эпоху AGI.

Среди рисков авторы называют кибербезопасность, биологию и потерю контроля над самосовершенствующимися системами.
institute.deepmind.com

✔️ Mozilla и Mistral AI объявили о партнёрстве

ИИ-ассистент Firefox Smart Window теперь работает на моделях Mistral. Он помогает разобраться со сложными поисковыми запросами, напоминает о важном и находит информацию с открытых вкладок. Сначала функция доступна во Франции и США, до конца года появится в Великобритании и Германии.

По умолчанию переписка не хранится на серверах Mozilla, Mistral тоже обязалась не накапливать пользовательские данные.
mistral.ai

✔️ Odyssey показала модель мира для роботов, машин и дронов

Стартап представил диффузионный трансформер Odyssey-3, обученный на визуальных наблюдениях за миром. Поверх модели обучают небольшие декодеры действий: манипуляторам хватило десятков часов демонстраций. Политики для гуманоидов на базе Odyssey-3 построила компания Flexion.

Политика вождения, обученная на 20 часах симуляции, вела машину по дорогам Индии с водителем-испытателем. Между его вмешательствами она проезжала около 77% расстояния, которое проходила политика, обученная на реальных записях.

Дроны пока летали только в симуляции. Навык из GTA V частично перенёсся в Red Dead Redemption 2 без дообучения. Публичный релиз обещают в ближайшие недели. 
odyssey.systems

✔️ ElevenLabs выпустила MCP-сервер для Claude

Сервер позволяет управлять голосовыми и текстовыми агентами ElevenAgents прямо из Claude. Ассистент выделяет темы недавних разговоров, копирует агента под новую аудиторию со сменой голоса и первой реплики, сравнивает конфигурации и оценивает расходы на языковую модель до внесения изменений.

Сервер размещает ElevenLabs у себя, вход через OAuth без API-ключей, доступ можно отозвать в любой момент. Локальная версия 2025 года, работающая с собственным ключом, остаётся доступной. Подключение – через каталог коннекторов Claude.
elevenlabs.io


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔1511👍9👏3👨‍💻3🔥2🤣1🤗1