Media is too big
VIEW IN TELEGRAM
MiniMax Design - это приложение под Windows и MacOS в виде мультимодального агента, который сам разбирает задачу на шаги, пишет сценарий, собирает раскадровку, генерирует изображения и видео, а потом монтирует, накладывает озвучку и субтитры и отдает готовый ролик.
Продукт не появился из ниоткуда - это развитие прежнего инструмента MiniMax Hub.
Внутри сидит новая модель H3. По словам компании, система сама разбирает задачу и решает, какие материалы взять за референс, что оставить, а что переделать. Дальше она упаковывает все это в формат, который подходит для H3.
Для сложных кадров есть режиссерский 3D-инструмент для расстановки персонажей, движения и ракурсов камеры перед генерацией сцены.
Профессионалам обещают подключение готовых воркфлоу ComfyUI - их можно гонять в облаке или локально, а агент поможет подкрутить ноды и параметры генерации.
Кроме H3, MiniMax Design умеет использовать и другие модели на разных этапах (для картинок, видео и звука).
Подписка помесячная или годовая, при оплате за год два месяца бесплатно. Тарифы различаются они только объемом кредитов - набор возможностей везде одинаковый.
10 000 кредитов в месяц: 83 секунды видео H3 в 2K или 143 секунды в 768p, 125 картинок в GPT Image 2, 167 в Nano Banana Pro, 500 треков в Music 2.6, 200 тысяч знаков озвучки в Speech 2.8.
87 000 кредитов: 725 секунд H3 в 2K или 1243 секунды в 768p, 1088 картинок в GPT Image 2, 1450 в Nano Banana Pro, 4350 треков, 1,74 млн знаков озвучки.
270 000 кредитов: 2250 секунд H3 в 2K или 3857 секунд в 768p, 3375 картинок в GPT Image 2, 4500 в Nano Banana Pro, 13 500 треков, 5,4 млн знаков озвучки.
На всех тарифах доступны все модели MiniMax для видео, голоса и музыки, GPT Image 2 и Nano Banana Pro, плюс параллельность генерации.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍59🔥25❤15🐳1
FLUX Upscale - отдельный инструмент и эндпойнт, который пересобирает видео в разрешении вплоть до 4K.
На вход идет видео от 480p. Инструмент понимает вывод FLUX 3 и, по словам BFL, чинит то, что универсальный апскейлер пропускает - смазанные лица и артефакты на текстурах.
Precise - четыре шага, 7 центов за мегапиксель-секунду. Подойдет, когда нужно сохранить лицо персонажа и соответствие референсу.
Creative - восемь шагов, 10 центов. Сильнее чинит и дорисовывает детали, но может изменить или подменить внешность, так что соответствие референсу ниже.
Коэффициент увеличения - 1,5x, 2x или 3x. От HD на входе это дает примерно 1080p, 2K и 4K.
Десятисекундный ролик обойдется в шесть-восемь долларов.
Работает через API Black Forest Labs и плейграунд.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍77👏24🤓10❤7🤔6👌3🗿3🥰2⚡1
Библиотека написана на Rust, есть привязки для Python, а в основе - TurboQuant, алгоритм сжатия векторов, который Google описали в статье, принятой на ICLR 2026.
Сама библиотека к Google отношения не имеет, это независимая реализация чужого алгоритма.
Коллекция из 10 миллионов документов, занимающая в исходном виде 31 гигабайт, умещается в 4. Поиск при этом, как утверждает автор, идёт быстрее, чем в FAISS - одного из самых распространённых инструментов в этой области.
По замерам turbovec обгоняет FAISS в среднем в 3,4-3,5 раза при 4-битном сжатии и на 20-26% при 2-битном, в зависимости от железа.
Индекс не нужно предварительно обучать - векторы просто добавляются по мере поступления.
Сохранение инкрементальное, на диск уходит только то, что изменилось с прошлого раза, поэтому даже на большом индексе это занимает миллисекунды.
Поиску можно передать список разрешённых документов - скажем, чтобы пользователь видел только свои файлы.
Удаление работает по постоянным идентификаторам, ссылки на записи не плывут.
Тем, кто уже сидит на LangChain, LlamaIndex, Haystack или Agno, автор предлагает готовые адаптеры - меняется одна строка импорта, остальной код остаётся как был.
@ai_machinelearning_big_data
#AI #ML #VectorSearch #TurboQuant #Rust
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍130🔥42🤓18❤9👏8❤🔥6🎉3🥱1
Последние месяцы доказательства, сгенерированные ИИ, посыпались валом как для новых результатов, так и для старых, причем часть из них формализована на Lean и проверить такой репозиторий непросто, особенно если ты не эксперт. Нужно убедиться:
Под эту задачу и Теренс Тао запустил Palomar - реестр математики, верифицированной на Lean. Инициативу вырастили Lean FRO и ICARM.
Прием заявок уже идет, чтобы в него попасть, в репозитории должно быть три вещи:
Снимок поданного репозитория проверяют двумя этапами.
Сначала инструмент Comparator смотрит, что solution module типизируется и доказывает ровно то, что заявлено в challenge file. После этого языковая модель сверяет, похоже ли неформальное описание в на то, что заявлено формально.
Прошел оба - попал в реестр. Принимают формализации и старых результатов, и новых. Кто автор доказательства - человек, ИИ или оба вместе - значения не имеет.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍77❤20🗿19🥰6😎6🔥1
Media is too big
VIEW IN TELEGRAM
Платформа для хостинга моделей и датасетов наняла банки, чтобы выяснить, готов ли кто-нибудь купить бизнес. Речь пока не о сделке - тестирование рынка может закончиться и новым раундом финансирования.
По данным источников, сейчас компанию оценивают примерно в 1,3 млрд долларов, тогда как в 2023 году оценка доходила до 4,5 млрд, - за три года почти в три с половиной раза ниже.
Наиболее вероятными покупателями называют нынешних инвесторов Hugging Face - Google, Amazon, Nvidia, Intel и Salesforce.
bloomberg.com
Модель собирает тридцатисекундные ролики из текстовых документов, таблиц, презентаций и веб-страниц. В новой версии лучше работают референсы и реконструкция реальных объектов, а базовая длина ролика выросла.
Alibaba целится в производство рекламы, коротких сериалов и музыкальных клипов. До официального запуска модель была в открытой бете.
Иностранцы получают доступ к API через Alibaba Cloud. Секунда видео стоит 10 центов в 720p и 20 центов в 1080p, то есть полный тридцатисекундный ролик в 1080p обойдется в 6 долларов.
reuters.com
Агентом можно рулить со смартфона или из браузера, ничего дополнительно не устанавливая. В интерфейсе видно сессии в реальном времени, туда же ставятся задачи и оттуда проверяются результаты.
На телефон приходят уведомления, когда агент закончил работу или ждет от человека подтверждения. Подключиться можно сразу к нескольким машинам и быстро между ними переключаться, причем монитор хосту не нужен - Antigravity запускается и работает и без него.
Обновление раскатывают постепенно, первыми его получают подписчики Google AI Ultra.
antigravity.google
Американский регулятор выдал разрешение по процедуре системе Aletta голландского стартапа Vitestro. Робот делает всю процедуру сам: накладывает жгут, дезинфицирует кожу, находит вену, вводит иглу, меняет пробирки, убирает расходники и заклеивает прокол.
Вены он ищет ближней инфракрасной съемкой, ультразвуком и допплерографией - ими же отличает вену от артерии. В клинических испытаниях на 1600 пациентах игла попадала с первой попытки в 94,5% случаев.
Aletta рассчитана на амбулаторный прием взрослых. Один оператор может вести сразу три таких аппарата.
fda.gov
На фоне ИИ-бума корейские абитуриенты пошли в микроэлектронику. По данным Jongno Academy, частного центра подготовки к поступлению, средний проходной балл на профильные специальности в ведущих вузах дошел до 96,2. Медицинские факультеты, где конкурс исторически самый высокий в стране, держат 97,2.
Университеты вместе с Samsung Electronics и SK Hynix запускают целевые программы с гарантированным трудоустройством. А школьники, чтобы поступить на инженерные направления, все лето занимаются в специализированных центрах Сеула.
ft.com
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥76👏72👍32❤14🤔7
Руководитель Codex Тибо Соттьё подвёл итог изменениям последних недель, которые снижают риск деструктивных действий Codex.
Месяц назад в сети появились жалобы на то, что GPT-5.6 в Codex делает с файлами то, о чем его не просили.
Самый серьезный кейс - команда, которая должна была почистить за собой временные файлы, вместо этого удаляла файлы пользователя.
В ходе разбора выяснили, что Codex создает временные папки и потом чистит их, и в редких случаях чистил неправильно - он переиспользовал под временную работу системную переменную окружения, а некорректная команда очистки затем указывала на настоящий домашний каталог вместо временной папки.
Второй случай проще - модель удаляла или перезаписывала временный путь, не посмотрев, что там уже лежит.
По итогам расследования добавили дополнительную защиту на нескольких уровнях:
Codex теперь обязан проверять, что именно он собирается удалить, заводить временные каталоги заново, не переиспользовать системные переменные окружения, выбирать обратимые действия и останавливаться, когда масштаб операции неясен.
Механизм, который выявляет рискованные команды удаления и отправляет их на ревью, усилили. Если команду отклонили, модель направляют к более безопасному способу.
Включить полный доступ случайно стало труднее, предупреждения переписали понятнее, а самые рискованные сочетания разрешений дополнительно ограничили.
Он стал лучше распознавать деструктивные действия.
OpenAI собрала условия и данные, воспроизводящие найденные сбои. Сейчас добавляются RL-задачи и грейдеры под эти риски, а деструктивные действия вычищаются из обучающих данных.
Обновлять Codex и работать в одном из режимов песочницы -
Ask for approval или Approve for me.Full access включать только там, где среде можно доверять и откуда легко восстановиться.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥28👍20❤10😁3❤🔥1👌1
Руководитель направления Codex Тибо Соттьё пообещал, что в этом году DevDay окажется лучшим за всю историю OpenAI.
Конференция пройдет 29 сентября в Сан-Франциско, открывающий кейноут покажут в прямом эфире.
Послужной список у DevDay говорит о том, что действительно есть чего ожидать:
Что готовят в этот раз, Тибо не сказал. В комментариях вангуют релиз Astra, модель следующего поколения, обучение которой в конце июля OpenAI поставила на паузу.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
💯48👍38🎉25🤩7❤5🥱2👏1
Media is too big
VIEW IN TELEGRAM
С 26 августа для тарифа Plus снова заработает скользящее пятичасовое окно в ChatGPT Work и Codex.
Руководитель Codex Тибо Соттьё объясняет это тем, что лимиты выравнивают нагрузку и не дают случайно спалить недельную квоту за одну сессию.
Подписчиков Pro за 100 и 200 долларов изменение не касается - непрерывный доступ у них останется как минимум на несколько месяцев.
В сообществе решение раскритиковали: одни жалуются на изменение условий после оплаты, другие - что выбирали Codex вместо Claude как раз ради долгих сессий, и теперь собираются пересматривать рабочий стек.
Tibo в X
Gemini Enterprise for Legal подключается через коннекторы MCP к профильному софту: iManage, NetDocuments, DocuSign, Everlaw, RelativityOne и Thomson Reuters HighQ.
Платформа разбирает контракты, ведет правовые исследования и следит за изменениями в нормативной базе. Права доступа при этом наследуются из корпоративных политик, которые у компании уже есть, отдельно раздавать их не нужно.
Продукт пока в предварительном тестировании. Похожий инструмент Google уже запустила для финансового сектора, на очереди здравоохранение.
google.com
Вычислительный модуль рассчитан на дроны и устройства машинного зрения. Внутри восьмиядерный процессор Arm и 8 ГБ оперативной памяти, заявленная производительность - 78 TOPS.
Габариты остались прежними, а инференс, по данным NVIDIA, идет вдвое быстрее, чем у версии Super - обновили тензорные ядра и подняли пропускную способность памяти. Прежнюю производительность модуль выдает при меньшем энергопотреблении.
Через программный стек NVIDIA на модуле можно развернуть оптимизированные для edge-устройств визуальные и языковые модели семейств Cosmos, Nemotron, Gemma 4 и Qwen 3.
В продажу Jetson Orin Nano 2 поступит в первой половине 2027 года.
nvidia.com
Portable Computer одной командой разворачивает инфраструктуру Perplexity на DGX Spark - планировщик задач, маршрутизатор и локальный поисковый индекс.
Работает все на Qwen 3.8 27B и собственной PPLX 27B, следом добавят Nemotron 3.5 Lightning. Если задача сложная, локальный оркестратор может отправить запрос в одну из 15 облачных моделей.
Наружу без явного разрешения пользователя не уходит ничего - это касается и коннекторов к Google Drive, Gmail, Slack и GitHub.
Инструмент доступен подписчикам Pro и Max на Linux. Версию для Windows обещают в ближайшее время. Также в планах поддержка обычных ПК с видеокартами RTX.
perplexity.ai
Компания временно перевела сотрудников головного офиса на удаленную работу - из-за возможной забастовки охранников, которых нанимает подрядчик Allied Universal. При этом в профсоюзе SEIU, представляющем охранников, планы на забастовку отрицают - голосование по этому вопросу даже не проводилось.
Переговоры SEIU с охранными агентствами идут с апреля. Профсоюз добивается повышения зарплат, расширения медстраховки и профильного обучения.
В ИИ-индустрии в целом обострилось внимание к физической безопасности - ранее в этом году с угрозами в свой адрес сталкивались сотрудники и Anthropic, и OpenAI.
businessinsider.com
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍87🤔53❤20👏10🎉6🔥3🤬2😭2😢1
Модель OX Alpha появилась на OpenRouter в минувшие выходные в стелс режиме и сразу вышла на первое место по использованию, больше чем вдвое обогнав DeepSeek.
В OpenRouter называют этот запуск крупнейшим в истории площадки.
Сообщество вычислило автора раньше, чем тот представился по характерным ошибкам API и по устройству токенизатора - в Ox Alpha опознали почерк Zai.
Признание компании догадку подтвердило - это новая версия GLM.
Модель заточена под кодинг и сложные агентные задачи. Заодно она меняет прежнее деление линейки - раньше Zai держала отдельно текстовые GLM и визуальные GLM-V, а Ox Alpha мультимодальна.
На OpenRouter модель бесплатна еще неделю, после чего Zai назовет коммерческие тарифы.
Веса обещают выложить сегодня.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍96👌53❤41👏19🔥16🎉10🤔2💯2🤬1
Специалисты Китайской академии наук успешно протестировали оптический канал обмена данными на расстоянии свыше 400 000 километров. Эксперимент проводился с использованием окололунного спутника DRO-A.
Команде удалось достичь скорости передачи команд от Земли к аппарату (uplink) на уровне 1,25 Мбит/с, тогда как скорость обратного потока телеметрии (downlink) составила 100 Мбит/с.
Подобная высокоскоростная двусторонняя лазерная связь развернута за пределами околоземной орбиты впервые.
Переход на эту технологию кардинально меняет пропускную способность каналов дальней космической связи.
Для сравнения: передача одного снимка в разрешении 8K с лунной поверхности по традиционному микроволновому линку (около 5 Мбит/с) занимает до пяти минут. Новая лазерная система позволяет передать этот же объем всего за 12 секунд, что решает проблемы при отправке тяжелых научных данных на Землю.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥158👍92❤22👏14🤩7🤣2
Media is too big
VIEW IN TELEGRAM
Китайский стартап ведет переговоры с Microsoft, Amazon и Google о размещении флагманской Kimi K3 в Azure, AWS и Google Cloud. Moonshot хочет до 30% доходов с сервисов, построенных на K3.
Переговоры на ранней стадии. Обсуждают, как делить выручку, кому будет открыт доступ к данным и как считать токены для выставления счетов.
Контакты сторон идут на фоне давления американских регуляторов. Власти США обвиняют Moonshot в том, что компания обучала свою модель на ответах Fable 5 от Anthropic, а Минфин пригрозил ей торговым эмбарго.
Moonshot отрицает, что использовала чужую интеллектуальную собственность. Microsoft, Google и AWS переговоры не комментируют.
reuters.com
Модель распознает речь больше чем на 85 языках, вычищает слова-паразиты, давит фоновый шум и сама форматирует текст. Она подхватывает пользовательские словари, чтобы понимать сленг, не путается в буквенно-цифровых данных и умеет разбивать диалоги на реплики с таймкодами.
Модель получила вызов функций - она может передавать задачи другим моделям семейства Gemini. Например, отправить им генерацию изображения или разбор файла.
Модель работает через Gemini API в Google AI Studio. Ее уже встроили в клавиатуру Gboard для Android, в macOS-клиент Gemini и в корпоративную Enterprise Agent, на очереди Chrome.
blog.google
То, что Claude запомнил о пользователе в одном интерфейсе, теперь работает и в другом. Причем память обновляется прямо по ходу разговора, а не пересобирается пересказом после его окончания.
Управлять записями можно вручную - смотреть, править и удалять отдельные факты. По умолчанию Claude не запоминает данные о здоровье, религии и политических взглядах. Разрешить их сохранение можно в настройках - тогда о каждой такой записи система будет предупреждать.
Новая память включена по умолчанию на тарифах Free, Pro и Max - в вебе, десктопных и мобильных клиентах.
claude.com
Компания выпустила на iOS и Android приложение Index. С помощью него люди снимают, как выполняют бытовые и рабочие задачи, и получают за ролики деньги. Данные идут на обучение модели Helix, которая управляет роботами Figure.
За четыре месяца тестирования загрузили 16 млн видео и выплачено 15 млн долларов. Загруженное автоматически проверяется на брак и мошенничество, чистится от дублей и получает текстовые описания. На каждую тысячу часов приходится 373 типа задач и больше тысячи разных предметов, с которыми взаимодействует человек.
В следующем году Figure собирается кратно нарастить сбор данных, а на выплаты и вычислительные мощности потратить больше миллиарда долларов.
figure.ai
Composer работает на модели Music v2 и правит трек по кускам, не перегенерируя его целиком. На вход идет аудиофайл, промпт или текст песни, дальше композиция сама разбирается на блоки - куплеты, припевы, переходы.
Дальше можно переписать слова в одном куплете, поменять тональность припева или замедлить переход, не трогая остальное. Для любого фрагмента Composer генерирует несколько вариантов на выбор, а сами блоки можно дублировать, менять местами и растягивать, то есть пересобрать структуру песни целиком.
Инструмент доступен на платформе ElevenMusic.
ElevenLabs в X
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍93🔥25❤19🤔12👏7😎5🤣1💘1
Китайский разработчик ИИ начал слать сообщения тем, кто ранее записался на совместную карту с Сельскохозяйственным банком Китая (ABC).
Карт две.
Select рассчитана на массовую аудиторию - новым клиентам, которые выполнят требования по тратам, дают три месяца подписки Andante и плюшевый брелок с NFC-меткой.
В Andante входят увеличенные лимиты на агентов, доступ к Kimi Code и публикация сайтов.
Max - это премиальная платиновая карта ABC. За выполнение тех же условий при оформлении дают два месяца подписки Allegretto - вчетверо больший лимит на агентов, в двадцать раз больший на Kimi Code и возможность держать несколько агентов одновременно. Её оформляют только в отделении банка.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍116😁34🔥19👏12❤11🤩10🥱3🤷♀1🤔1
Команда WeChat китайского техгиганта выложила в открытый доступ семейство эмбеддинг-моделей WeMM-Embedding, предназначенных для создания универсальных векторных представлений.
Набор работает с текстом, изображениями, видеороликами, сложными визуальными документами и смешанным контентом, объединяя их в единое семантическое пространство.
Эмбеддинги учили с использованием Matryoshka Representation Learning, который позволяет на этапе применения обрезать размерность вектора, экономя память и вычисления.
Построено семейство на Qwen3.5, на выходе младшая модель дает нормализованный вектор на 2048 измерений, а старшая - на 4096.
Tencent приводят цифру, что при сжатии до 256 измерений двухмиллиардная модель сохраняет 98,7% исходного качества на задачах с фото и видео.
Опубликованы веса трех размерностей: 2B, 4B и 9B
9B берет новый лучший общий результат на MMEB-v2 (80,6 балла), а 2B обходит Qwen3-VL-Embedding, который вчетверо больше нее.
Но есть аргумент посильнее бенчей - семейство работает в рекомендациях и поиске WeChat. Она развернута для обработки каналов, аккаунтов и электронной коммерции.
Команда мессенджера говорит, что WeMM-Embedding показали стабильные улучшения в 14 онлайновых A/B-тестах.
Модели работают с библиотекой Transformers и поддерживаются vLLM и SGLang.
Единственным ограничением текущей версии является отсутствие поддержки аудио
@ai_machinelearning_big_data
#AI #ML #Embeddings #WeChat #Tencent
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥144👍41👏19❤14💯6🥰1👀1
Главный филантроп планеты написал большую статью о том, чем обернется развитие ИИ, и предлагает вмешаться, пока не поздно, так как плана нет ни у кого.
Он выделил три главных риска и предложил шаги, которые нужно сделать уже сейчас.
Раньше машины замещали физический труд, а ИИ сейчас замещает мышление человека, поэтому некоторые профессии исчезнут навсегда.
Первыми пойдут продажи, поддержка клиентов, разработка и юристы, но дальше очередь дойдет до финансов, анализа данных и даже здравоохранения.
Физический труд тоже в опасности - роботы отстают от ИИ, но дешевеют, и к концу десятилетия, считает Гейтс, начнут конкурировать с людьми на стройке и в общепите.
Дальше включится порочный круг. Одна компания внедрила роботов, сэкономила, снизила цены - остальные вынуждены делать то же самое. Не сделают компании, сделают стартапы.
Инструкции по деструктивным действиям лежали в интернете и раньше. Разница в том, что теперь их не только легче найти, но и легче применить - преступник с очень скромными навыками сможет атаковать цели любого масштаба, от человека до государства.
Самые толковые из знакомых ему специалистов по кибербезопасности боятся ближайших лет, потому что атакующие получают новые возможности быстрее, чем защитники успевают закрывать дыры. Та же модель, которая находит уязвимость, помогает преступнику ею воспользоваться, и отделить одно от другого пока не получается.
И наконец, сами модели. Они уже иногда ведут себя не так, как задумывали создатели, и по мере роста их возможностей могут начать действовать против интересов людей, а мы можем потерять контроль.
ИИ-компаньоны, считает Гейтс, вызывают сильное привыкание из-за того, что никогда не спорят с собеседником. Ребенок рискует вырасти в искусственно бережной среде и не научиться социальным навыкам.
Данных пока мало и они противоречивы, но тревожные признаки есть. В исследовании про ИИ-ассистентов выяснилось, что к чат-боту за общением чаще обращаются те, у кого узкий круг знакомых, и чем интенсивнее и эмоционально ближе становилось общение с ИИ, тем хуже люди себя чувствовали.
Под угрозой образование - тот же инструмент, который позволяет узнать больше, чем когда-либо, приведёт к тому, что люди будут учиться меньше. Уже сейчас прослеживается связь между использованием ИИ и ослаблением критического мышления, причем у молодых сильнее.
Строить новые институты
Существующие ведомства видят каждое свой кусок, а последствия ИИ расходятся по всей системе, поэтому нужны локальные и международные органы, которые видят влияние ИИ целиком.
Зарезервировать часть профессий за людьми
Эту идею Гейтс придумал, вспоминая сиделок, ухаживавших за его отцом на поздней стадии Альцгеймера, - в этом уходе, пишет он, было нечто незаменимо человеческое, хотя кто и по каким критериям будет проводить границу, он сам не знает.
Создать налог на ИИ
Нанимая человека, работодатель платит налоги, а купленного робота обычно списывает сразу как расход, т. е. налоговая система сама подталкивает заменять людей машинами, и налог на токены и роботов этот перекос выправит, заодно дав деньги на переобучение людей.
Гейтс рад, что ИИ-компании предлагают решения проблем, созданных их же технологией, но ждать, что они возглавят этот процесс, не стоит. Часть вопросов лежит вне их компетенции, а в современном обществе решать такое не их роль.
Решения должны рождаться коллективно - с участием политиков, педагогов, медиков, чиновников и религиозных лидеров.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
❤92👍27👻21😁18🤣10🗿8🔥7🥱6🤔2💯1🎅1
Media is too big
VIEW IN TELEGRAM
Сумма сделки - $12,9 млрд. По данным инсайдеров, стороны находятся на стадии оформления, официальных комментариев от обеих компаний пока нет.
Переговоры ускорились после того, как Hugging Face получила предложение о поглощении от другого неназванного игрока и привлекла банк для оценки спроса.
Для Nvidia это выход за пределы железа и прямой контроль над площадкой, через которую расходится и разрабатывается основная масса открытых моделей. Ровно поэтому сделка почти наверняка заинтересует антимонопольные органы.
theinformation.com
OpenAI, Microsoft, Google, Anthropic, AWS, Cisco, CrowdStrike и еще около сотни компаний призвали защищать критическую инфраструктуру от атак, написанных с помощью ИИ, - тем же ИИ.
Коалиция предупреждает, что сегодня модели работают скорее на защитников - они автоматизируют поиск и закрытие уязвимостей, копившихся в системах десятилетиями. Перевес этот не вечен, поэтому внедрять такие инструменты нужно сейчас, пока он есть.
Корпорациям авторы письма советуют поднять киберзащиту на уровень топ-менеджмента, государствам - усилить координацию и финансирование отрасли.
openai.com
Через боковую панель Claude сам открывает сайты, читает страницы, кликает по элементам и заполняет поля. Пригодится, когда нужно снять цифры с дашборда, у которого нет API, или заполнить форму.
Работает это в изолированной среде - вкладок, закладок и паролей пользователя Claude не видит. Авторизацию можно перенести из Chrome, Edge или Firefox, но точечно - сессия привязывается к конкретной странице, а не отдается целиком. Почтовые клиенты и банковские сайты закрыты наглухо.
Функция появится на этой неделе у подписчиков Pro, Max, Team и Enterprise. Если нужно работать с уже открытыми вкладками, Anthropic советует расширение для Chrome.
claude.com
Видеомодель умеет как генерировать, так и редактировать. Сцену выдает длиной до 40 секунд, опираясь на 10 секунд предыдущего видеоряда. На вход принимает текст, звук, изображения и видео.
Появилось ручное задание первого и последнего кадра, плюс черновой режим - он на 60% быстрее и втрое дешевле обычного, а понравившийся результат потом поднимается до 4K.
Секунда видео стоит 3 цента в 360p и 30 центов в 4K. Все, что генерирует модель, помечается невидимым знаком SynthID.
Модель доступна в Google AI Studio и через Agent Platform API, а подписчикам AI Plus, Pro и Ultra - еще и в Google Flow и приложении Gemini.
blog.google
Стартап Spear Street Technology закрывает раунд на 250 млн долларов при оценке в 2,5 млрд. Ведут раунд Benchmark и Index Ventures. Основатель - 23-летний Ноа Шинн, автор метода Reflexion, до этого работавший в Sierra.
Instinct он делает как персонального агента, которого не нужно настраивать. Чтобы тот управлял компьютером, разбирал почту, бронировал билеты и проводил платежи, достаточно написать ему сообщение или позвонить голосом.
Первые тестировщики называют его "OpenClaw для обычных людей".
При этом продукт в закрытой бете, выручку и число пользователей стартап не раскрывает.
wsj.com
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
❤30👍13😢9🔥4😨3🤬2❤🔥1💘1
Granite 4.2 - семейство языковых моделей под агентные сценарии и корпоративные задачи.
Модели умеют рассуждать шаг за шагом - планируют, прежде чем действовать, взвешивают варианты, прежде чем выбрать путь, и ловят собственные ошибки до того, как те во что-то выльются.
Версии - на 3, 8 и 30 миллиардов параметров с окном на 128K (для длинных контекстов до 512К).
Архитектура dense, так что семейство зайдёт и для облаков, и для своих серверов, и под периферийные устройства.
Первый этап, базовое RL-обучение, прошли все три модели. Он подтянул математику, науку, код, рассуждения и работу с инструментами, причем награду считали двумя способами сразу: где ответ можно проверить формально - проверяли, где нельзя - оценивали отдельной моделью-судьей.
Модели на 8 и 30 млрд прошли еще и агентный этап, заточенный под корпоративные сценарии: разработку ПО, работу в терминале и поиск.
Навыки кодинга и рассуждения обучали на триллионе токенов синтетического кода из собственного конвейера IBM CodeAlchemy.
Есть еще слой спекулятивного декодирования - модель угадывает продолжение наперед и проверяет траекторию ответа наперед вместо пословной генерации. Текст выходит быстрее, а серверы инференса тянут больше пользователей одновременно.
Семейство доступно везде: Hugging Face, Ollama, CoreWeave и еще на десятке площадок.
Заодно IBM выпустила две речевые модели английского языка - Granite Speech 5.0 Turbo CTC и ее некоммерческую версию с индексом NC.
Скачок в нумерации с 4.1 сразу на 5.0 не случаен - это принципиально другая конструкция, чем была в 4-й серии.
В них всего 470 млн параметров и внутри нет языковой модели. Под капотом CTС (connectionist temporal classification) - способ сопоставлять звук с текстом без промежуточной разметки, и он особенно хорош на потоковом аудио.
В тестах IBM на одной H200 пропускная способность, RTFx, дошла примерно до 12 600. Нынешние лидеры публичного лидерборда Open ASR держатся около 6000.
Отдельно IBM снизила частоту дискретизации, и вот это дает главную цифру - три часа записи модель расшифровывает за секунды.
@ai_machinelearning_big_data
#AI #ML #LLM #ASR #Granite #IBM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤33🔥11👍5🤔1
This media is not supported in your browser
VIEW IN TELEGRAM
Китайская DaxAI Robotics привезла на World Robot Conference, проходившую в Пекине с 19 по 23 августа, четвероногого робота Qiji X1 с седлом и рулем.
DaxAI называет робота первым в мире роботом для верховой езды, хотя робо-коня в этом году показывала и DEEP Robotics.
Машина весит 300 кг и столько же может нести - это примерно двое взрослых плюс груз.
Скорость 7-10 км/ч, запас хода 40 км, до 10 часов непрерывной работы на высоковольтной батарее. Максимальный момент в суставе - 1400 Нм.
Соображает робот сам - внутри зашита модель мира DaxBrain-WM, которая подстраивает угол и глубину постановки ног под склоны, гравий и грязь.
DaxAI подписала трехлетнее соглашение с маркетплейсом JD и открыла там предзаказ первой партии. Покупателям обещают подарочный набор для поездок, пять лет бесплатного обслуживания и пять лет бесплатных обновлений.
Цена - около 289 тысяч юаней (~ 43 тысячи долларов).
Также компания показала колесно-шагающую версию Qiji XS - 320 кг, до 40 км/ч, запас хода 60 км, - и более крупный T1000 под тяжелые работы.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥39👍27🤩25❤7🗿6🤷♂5😁5👏2🎄1
4 сентября Народный банк Китая выпустит набор золотых и серебряных памятных монет серии «Научно-технологические инновации будущего (Искусственный интеллект)».
В наборе три монеты - одна золотая и две серебряные, обе имеют статус законного платежного средства.
Золотая весит 5 граммов, квадратная, со стороной 18 миллиметров. На реверсе изображены чипы, схема в форме мозга и нули с единицами.
Серебряные - по 15 граммов, на них лица, микросхемы, спиральные узоры, ключи и символы ИИ.
Номинал золотой монеты - 80 юаней
Чеканят набор два государственных монетных двора - Шанхайский и шэньчжэньский Guobao. Купить монеты можно будет в том числе онлайн.
Кстати, когда в марте собирали эскизы для этих монет, организаторы разрешили дизайнерам пользоваться ИИ как вспомогательным инструментом, но запретили сдавать откровенный нейрослоп.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
❤26🔥20🤔18🥰8👏6😁4🤩4🤗1
Media is too big
VIEW IN TELEGRAM
Федеральный суд в Калифорнии постановил, что Министерство обороны действовало произвольно и немотивированно, объявив Anthropic угрозой национальной безопасности. Доказательств того, что компания создает реальные риски для цепочек поставок или собирается саботировать работу собственных моделей, правительство в суде не привело.
Решение бессрочно запрещает исполнять директиву о бойкоте компании, но закупать что-либо у Anthropic Пентагон не обязывает - ведомство вправе выбирать других поставщиков.
reuters.com
На встрече профильных министров стран G20 американская делегация представит Carolina Principles - документ, подготовленный Управлением по науке и технологиям и Минторгом.
Концепция предлагает странам отказаться от жесткого контроля над ИИ и не создавать новые надзорные органы, а вместо этого действовать точечно и расширять партнерство с ИТ-бизнесом для тестирования моделей.
Поддержать инициативу приедут первые лица индустрии. 1 сентября мероприятие откроют Илон Маск и бывший советник Белого дома по ИИ Дэвид Сакс, на следующий день к дискуссии подключатся Сэм Альтман и Дженсен Хуанг.
США рассчитывают убедить остальных участников G20, включая Китай, Японию и европейские страны. Если консенсус сложится, документ вынесут на утверждение лидеров двадцатки на декабрьском саммите.
bloomberg.com
Журналисты WIRED нашли в коде OpenAI упоминания Persistent Mode - режима, в котором агент Codex работает в фоне непрерывно, пока его вручную не выключат.
Судя по найденному, агент станет проактивным: будет держать контекст между сессиями, сам придумывать себе следующие задачи и первым начинать разговор с пользователем. Обращения к внешним системам по-прежнему только с подтверждения человека.
В OpenAI тестирование подтвердили, но сроков не назвали.
wired.com
В сервисе появилась функция Expert Intelligence - электронные книги из Google Play Books можно подключать как источник знаний. На старте доступно больше 100 тысяч изданий, включая техническую литературу O'Reilly. По тексту выбранной книги Gemini отвечает на вопросы, делает пересказы и собирает обучающие карточки.
Книгу нужно купить, а если рабочим пространством пользуются несколько человек, купить ее обязан каждый - без подтвержденной лицензии доступ ко всем ответам и выдержкам по этому источнику блокируется автоматически.
Пока функция работает только внутри Notebook. Дальше Google планирует подключить платные научные статьи и маркетинговые отчеты, а саму механику перенести в основное приложение Gemini и в ИИ-поиск.
blog.google
Исследователи Калифорнийского университета собрали вычислительную карту, которая делит расстройства аутистического спектра на биологические подтипы по сочетанию паттернов мозговой активности и молекулярных биомаркеров.
Модели машинного обучения разобрали массивы данных фМРТ и результаты генетического секвенирования, а затем сопоставили архитектуру нейронных связей участников с тем, как те откликались на разные виды вмешательств.
В перспективе такая карта дополнит классическую диагностику по поведенческим признакам - подбирать помощь не только по симптомам, но и по биомаркерам, заранее прикидывая, что сработает. Пока это исследовательский результат, до применения в клинике ему предстоит независимая проверка.
science.org
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍70❤24🔥13🤩12👏7😁1
Media is too big
VIEW IN TELEGRAM
Prime Agent — это больше, чем харнесс модели. Сами авторы называют проект операционной системой для долгоживущих агентов.
Умнее модель он не делает, но дает ей работать дольше - программно раскладывать информацию, параллельно раздавать задачи подагентам и копить полезные процедуры.
Идея в том, чтобы у языковой модели была устойчивая вычислительная среда, где она сама распоряжается памятью, кодом, подагентами и долгими задачами.
Состояние в системе разложено по четырем уровням:
Состояние переживает и шаги, и перезапуски, и отключения. Человек при этом может наблюдать за агентами и вмешиваться.
Сильнее всего эффект виден на длинных интерактивных задачах. На ARC-AGI-3 конфигурация с Opus 5 дала 95,5% Best@1 против 30,2% у обвязки самой ARC.
На длинноконтекстных задачах Prime Agent держится наравне с конкурентами, а на отдельных, вроде EmulatorBench, заметно вырывается вперед. Он обошел Pi-mono с GLM-5.2 и Codex с GPT-5.6 Sol, но уступил Claude Code с Opus 5.
Отдельно показательны игровые прогоны на эмуляторах. На Sega Genesis связка Prime Agent и GPT-5.6 Sol набрала 61,6% по итоговой оценке верификатора, а Claude Code с той же моделью — ноль. На Game Boy Color разрыв еще резче: 99,8% против нуля.
Самая любопытная деталь отчета - накопление навыков закрепляет не только полезное.
В одном из экспериментов агент нашел способ обходить ограничения Factorio, сохранил его как переиспользуемый навык и тем самым записал эксплойт в долговременную память. Дальше он доставал оттуда именно это решение, потому что оно один раз сработало.
На днях вышел релиз 0.8.0 с исправлениями найденных проблем и новыми возможностями.
@ai_machinelearning_big_data
#AI #ML #Harness #Agents #PrimeIntellect
Please open Telegram to view this post
VIEW IN TELEGRAM
👍39🔥14👏7🤔6❤5🎉4