AISferaic

219 публикаций

Подписаться
AI
AISferaic
02.10 14:23

DeepSeek выложила в открытый доступ библиотеку DeepGEMM, которая значительно ускоряет GPU-вычисления, лежащие в основе современных ИИ-моделей.

Инструмент оптимизирует матричные операции и позволяет выжать максимум из видеокарт NVIDIA архитектур Hopper и Blackwell. Библиотека поддерживает форматы FP8, FP4 и BF16, а также включает специальные оптимизации для моделей с архитектурой Mixture-of-Experts (MoE). Главные фишки — умение совмещать обмен данными между GPU с вычислениями и компиляция ядер прямо во время работы, что избавляет от необходимости отдельной сборки CUDA при установке.

По результатам тестов DeepSeek, на определенных размерах матриц DeepGEMM показывает производительность на уровне или даже выше библиотек, которые эксперты годами оптимизировали вручную.

Подробности и код доступны здесь: https://github.com/deepseek-ai/DeepGEMM#interfaces

0
0
AI
AISferaic
02.10 14:22

OpenAI завтра, 3 октября, сбросит лимиты всем платным аккаунтам ChatGPT. Сброс единый для всех стран: в 10:00 по тихоокеанскому времени, это 20:00 по Москве.

Об этом написал Тибо Сотто из OpenAI. Так компания извиняется за медленный старт GPT-6.1 Sol.

Модель вышла 29 сентября в ChatGPT Work и Codex, и первые два дня отвечала заметно медленнее обычного из-за резкого скачка нагрузки. Сейчас, по словам Сотто, скорость вернулась к ожидаемой.

Если запас лимита ещё есть, его выгодно потратить до 20:00 субботы: после сброса неистраченный остаток сгорит. Если лимит почти закончился, тяжёлые задачи на GPT-6.1 Sol разумно отложить до вечера.

Сброс лимитов у OpenAI стал привычным жестом: им отмечают запуски и им же извиняются за них.

0
0
AI
AISferaic
30.09 19:05

**OpenAI с 1 октября снова продаёт ChatGPT Pro за $200 новым пользователям. **

Покупки стояли на паузе с 10 сентября. Но лимиты урезают примерно вдвое.

Так посчитал Тибо Сотто из OpenAI: в пересчёте на цены API новый Pro даёт около половины прежнего объёма.

Что меняется ещё:

1) скользящего лимита на 5 часов не будет, недельный можно потратить хоть сразу 2) появятся функции, которые не расходуют лимит, какие именно, пока не говорят

Объяснение у компании такое: модели стали эффективнее, а API для GPT-6 Sol и Luna подешевел на 50%. Поэтому, по словам OpenAI, за те же $200 получится сделать больше, чем месяц назад.

Дальше OpenAI хочет сократить разрыв между подпиской и оплатой API по факту. Завышать цены API, чтобы подписка выглядела сверхвыгодной, компания больше не собирается.

Но это слова компании. Сколько работы влезет в новый лимит, станет ясно на реальных задачах. Основные анонсы обещают завтра.

Подписка всё больше похожа на предоплату API со скидкой.

0
2
AI
AISferaic
29.09 18:21

Skillry собрали 389 роликов, которые люди сделали с Claude Opus 5.5 и выложили в соцсети.

В подборке:

1) моушн-графика, 223 ролика 2) игры, 68 3) 3D сцены, 51 4) объясняющие ролики, 47

Рядом с каждым оригиналом лежит его пересборка, которая работает прямо в браузере, и исходный запрос, его можно скопировать.

Все ролики сделаны кодом: Claude пишет анимацию на Three.js, GSAP, SVG и WebGL, даже звук собирается через WebAudio. Поэтому результат правится как обычный проект.

Выберите понравившийся ролик, добавьте свои логотип, цвета и шрифты и попросите Claude сначала составить план компоновки. План помогает задать направление идее и проработать детали до того, как пойдёт код.

Но у сайта есть подписка Pro за $9.99 в месяц, так что часть материалов может оказаться платной.

Чужой рабочий запрос экономит больше времени, чем любой пустой лист

https://skillry.dev/ai-videos/opus-5-5

0
8
AI
AISferaic
29.09 18:21

Появился способ буквально разнести любой сайт с помощью классического стикмана.

Разработчик навайбкодил необычную игру: вы открываете любую страницу, выбираете оружие и начинаете крушить элементы интерфейса прямо в браузере. В арсенале героя есть всё необходимое для цифрового хаоса, включая огнемет и реактивный ранец.

Идея мгновенно стала вирусной ролик уже собрал 2,7 млн просмотров и 45 тысяч лайков.

Попробовать свои силы в разрушении можно здесь: https://destroy.spritefusion.com

0
5
AI
AISferaic
29.09 18:21

Claude Sonnet 5.5 официально вышла.

Цена осталась $2 за 1 млн входных токенов и $10 за 1 млн выходных. У Opus 5.5 - $4 и $20. Кэш: $2,50 против $5.

Anthropic также заявляет, что Sonnet 5.5 более чем на 30% быстрее Sonnet 5 и для тех же задач может обходиться до 30% дешевле.

https://www.anthropic.com/claude-sonnet-5-5

0
4
AI
AISferaic
28.09 19:08

**Ember-1 сейчас активно обсуждают на Hacker News: 465 очков и больше двухсот комментариев **

Fireworks Research дообучила Kimi K3 рассуждать короче. Модель учили на реальных задачах по коду отличать рассуждения, которые меняют ответ, от хождения по кругу. В итоге она тратит примерно на 40% меньше токенов.

Тесты против K3:

1) Terminal Bench 2.1: 82% против 80,9% 2) SWE-bench Verified: 92,2% против 93,2% 3) DeepSWE 1.1: 75,2% против 66,4%

На живом трафике по коду рассуждений стало на 71% меньше при той же доле решённых задач. Для агентного программирования Fireworks оценивает расход примерно вдвое ниже.

Но это исследовательская версия, в API Fireworks её открыли на две недели. Ember-1 уже есть в Cline, в том числе в новом десктопном приложении.

Передовую модель необязательно обучать с нуля. Бюджет можно вложить в дообучение сильной модели, которая уже существует.

https://fireworks.ai/blog/ember-1

0
7
AI
AISferaic
28.09 19:08

Эндрю Амброзино, который руководит десктопным Codex в OpenAI, рассказал о своём личном тесте для каждой новой модели. Он просит её переписать всё приложение Codex на Rust с GPUI, библиотекой интерфейсов от создателей редактора Zed.

Сложность, по его словам, не только техническая. Codex сейчас кроссплатформенный, так его сделали ради скорости. Команда меняет продукт в таком темпе, что держать несколько нативных версий с одинаковыми функциями до сих пор не получалось.

Мечта Амброзино в том, чтобы одна сильная модель поддерживала сразу:

1) нативную версию для Mac на Objective-C 2) версию на WinUI 3 для Windows 11 3) отдельную версию на Rust

И чтобы все три шли вровень по функциям.

"Мы ещё не там. Но подбираемся всё ближе" говорит он.

Но это его личная проверка, официальным бенчмарком OpenAI она не считается. Насколько далеко продвинулась последняя модель, он не уточнил.

Самый честный бенчмарк, своя задача, которую вы знаете до последнего файла.

0
6
AI
AISferaic
28.09 19:08

Для Claude Code вышел мод agent-flow. Это боковая панель, где видны все субагенты текущей сессии

Субагенты выстроены деревом, по тому, кто кого запустил. У каждого виден статус, сколько контекста он занял и сколько раз вызвал инструменты. По клику панель показывает, какое задание субагент получил, что успел сделать и какой ответ вернул. Сверху шкала заполнения контекста основной сессии.

Установка: npx claude-code-templates@latest --mod ui/agent-flow

Открыть панель: /agent-flow

Но моды пока в раннем доступе. Нужен Claude Code 2.1.259 или новее, и запускать его надо с переменной CLAUDE_CODE_ENABLE_FUNCTION_HOOKS=1, без неё мод не загрузится.

Субагентов Claude Code показывает и без мода. Здесь их собрали в одну панель, с расходом контекста по каждому.

Чем больше работы вы отдаёте субагентам, тем важнее видеть, сколько контекста уходит на каждого.

https://www.aitmpl.com/component/mods/ui/agent-flow

0
8
AI
AISferaic
28.09 19:08

Руководитель DeepSeek Harness Цуй Тяньи порекомендовал плагин dsh-TUI. Он добавляет в DSH полноэкранный терминальный интерфейс в стиле Claude Code. Плагин сторонний, его начали делать ещё на закрытом тесте DSH и обновляют вслед за каждой версией.

Что в нём есть:

1) потоковый вывод рассуждений и статус работы агента 2) шкала заполнения контекста и скорость генерации 3) двойное нажатие Esc откатывает сессию на шаг назад 4) просмотр картинок и диаграмм Mermaid 5) возобновление и экспорт сессий, смена модели, фоновые задачи

Ещё одна команда переносит в DSH историю переписки из Claude Code и Codex, без вызовов инструментов.

Установка: npm i -g @deepseek-ai/dsh @deepseek-harness-tui/dsh-tui

Запуск: dsh-tui

Но плагин в публичной бете, а сам DSH пока в предрелизной версии 0.1.7. Понадобятся Node.js 22.19+, pnpm и ключ DEEPSEEK_API_KEY.

Агент выбирают по модели, а остаются в нём из-за удобства работы.

https://github.com/ccch1mneyyy/dsh-TUI

0
5
AI
AISferaic
28.09 19:08

Для Claude Code есть навык /brag, который делает промо-ролик про ваш проект. Он читает репозиторий, сам решает, что показать и каким тоном, и за один запуск собирает короткое видео с анимацией, музыкой и звуковыми эффектами.

На выходе папка с планом ролика, готовым mp4 и текстом для публикации.

Что ещё умеет:

1) тон задаётся словами, например "фейковый запуск стартапа из 2016 года" 2) закадровый голос включается флагом --voice, по умолчанию его нет 3) работает также в Codex, opencode, Cursor и других агентах

Рендер делает Hyperframes от HeyGen. На Opus 5.5 навык сам переключается на облегчённую версию /brag-slim, которой Hyperframes не нужен.

Но для полной версии понадобятся Node.js 22+ и FFmpeg. На Windows при клонировании нужно включить символические ссылки, иначе папку навыка придётся копировать руками.

Лицензия MIT, у репозитория почти 11 тысяч звёзд.

Ролик к запуску теперь собирает тот же агент, который писал код.

https://github.com/latent-spaces/brag

0
8
AI
AISferaic
28.09 19:08

Viggle выложила на Hugging Face ускоренную Qwen-Image-2.1.

Она рисует по тексту и правит картинки за 6 шагов вместо 40, в итоге примерно в 5 раз быстрее.

Это надстройка (LoRA) к исходной модели, весит 1,3 ГБ, есть облегчённый вариант на 680 МБ. Запускается через diffusers и ComfyUI.

На 96 запросах против полной модели:

1) разнообразие картинок почти то же, 0,98 от исходного 2) композиция и расположение объектов не поменялись 3) мелкий текст на картинке путается чаще

Но сложные правки выходят хуже: сборка из нескольких образцов, замена лица, сохранение внешности человека. И образцов для правки она берёт до 3, у полной модели до 10.

Лицензия прежняя, исследовательская: для коммерции нужна отдельная лицензия от Qwen.

Для черновиков и перебора идей 6 шагов хватает, а финальную картинку с надписями надёжнее отдать полной модели.

https://huggingface.co/Viggle/Qwen-Image-2.1-viggle-turbo

0
9
AI
AISferaic
28.09 19:08

Claude Code больше не обрывает работу на полуслове, когда заканчивается 5-часовой лимит.

Раньше агент останавливался сразу, даже посреди правки файла. Теперь он получает небольшой фиксированный запас из недельного лимита и тратит его на то, чтобы дойти до нормальной точки остановки: закончить текущую правку и оставить заметку о том, что осталось сделать.

Кому достанется:

1) Pro, один раз в неделю 2) Max и Team Premium, каждый раз при достижении лимита сессии

Функция включается постепенно, у вас она может появиться не сразу.

Но запас списывается из того же недельного лимита. Кто и так упирается в недельный потолок, дойдёт до него чуть раньше.

У OpenAI путь обратный: в Codex похожую возможность убрали несколько недель назад.

Недописанная правка посреди файла обходится дороже пары процентов недельного лимита.

0
5
AI
AISferaic
25.09 20:17

Google 1 октября выведет на орбиту спутник MVP с четырьмя TPU, собственными чипами компании для ИИ. Он полетит попутным грузом на Falcon 9 от SpaceX.

Это первый полётный тест проекта Suncatcher, где Google примеряет дата-центры для ИИ к космосу. За год на орбите компания проверит:

1) выдержат ли чипы радиацию 2) как их охлаждать там, где нет воздуха 3) можно ли на орбите выполнять задачи ИИ

Смысл затеи в энергии. На подходящей орбите солнечная панель выдаёт до 8 раз больше, чем на Земле, потому что солнце там почти не заходит.

Но мощность у спутника скромная, около 1 кВт, это примерно один сервер. В Google и сами признают, что в ближайшие годы ничего рабочего не ждут. Следующий шаг назначен на 2027 год: два спутника, построенных вместе с Planet, проверят лазерную связь между собой.

Пока на орбиту летит один сервер, и главный вопрос в том, доживёт ли он до конца срока.

https://blog.google/innovation-and-ai/technology/research/google-project-suncatcher/

0
7
AI
AISferaic
25.09 20:17

OpenAI готовит тариф ChatGPT Pro Max за $500 в месяц.

Его нашли в неопубликованном коде ChatGPT, официального анонса пока нет.

Что известно:

1) цена $500 до налогов, в странах с НДС около $600 2) в описании одна строка: самые быстрые Work и Codex 3) это в 2,5 раза дороже Pro за $200 и больше чем вдвое дороже старшего Claude Max

Судя по описанию, тариф рассчитан на тех, у кого агенты работают часами. Codex может вести задачу по коду несколько часов и даже дней, и там скорость ответа стоит денег.

Контекст сходится. 10 сентября OpenAI приостановила новые покупки Pro за $200: серверы не справлялись со спросом на GPT-6 Astra. А 29 сентября у компании DevDay.

Но более высокие лимиты и ускорение на чипах Cerebras пока догадки. Что даст тариф за свои $500, станет ясно после анонса.

Такую подписку считают в часах, которые агент экономит команде.

https://www.testingcatalog.com/openai-prepares-new-500-month-pro-max-plan-for-chatgpt/

0
6
AI
AISferaic
23.09 19:03

Claude Opus 5.5 написала код, который покадрово создал эту анимацию. Сначала забавный маленький кубик, затем космические орбиты, разложение света призмой, вихрь частиц, чёрная дыра и вид Земли с Луны.

Все 32 секунды созданы ИИ.

0
8
AI
AISferaic
23.09 19:03

OpenAI ответила на вызовы конкурентов масштабным релизом: представлены новые модели GPT-6 Sol и Luna.

Стоимость использования Sol снизилась вдвое и теперь составляет 2 за миллион входных и 10 за миллион выходных токенов.

Модель Luna стала еще доступнее всего 0.1 и 0.5 соответственно. В дополнение к этому все подписчики получили право на один дополнительный сброс лимитов по требованию.

Обе новинки уже интегрированы в API и платные подписки, а облегченная Luna также появилась на бесплатном тарифе для всех пользователей.

0
10
AI
AISferaic
23.09 19:03

Состоялся релиз Claude Opus 5.5

Которая уже начала обходить Fable 5.1 и GPT-6 Astra в большинстве ключевых бенчмарков. Несмотря на возросшую мощность, новая модель стоит дешевле своей предшественницы Opus 5.

Приятным бонусом для всех пользователей стал подарок от разработчиков: каждому начислили по одному «сохраненному сбросу лимита», который можно использовать в любой момент.

Подробности и официальный анонс доступны по ссылке

0
9
AI
AISferaic
23.09 19:03

OpenAI готовит к релизу GPT-6 Sol и GPT-6 Luna, новые модели уже находятся на финальном этапе подготовки.

В конфигурационных файлах Azure были замечены идентификаторы gpt-6-sol, gpt-6-luna и gpt-6-astra-minor. В этом же обновлении текущая версия GPT-5.6 Sol получила статус workhorse, что намекает на её переход в разряд «рабочих лошадок» после выхода следующего поколения.

Официального анонса пока не было, но добавление моделей в реестр Microsoft подтверждает, что запуск в облаке Azure произойдет совсем скоро.

0
13
AI
AISferaic
22.09 18:13

Проведено масштабное тестирование Jev Skill Suggestion против линейки моделей Claude: 26 навыков, 10 промптов и по 3 запуска на каждый тест.

Jev показал точность 90% при медианном времени ответа всего 330 мс. Для сравнения, Haiku справляется с точностью 80% за 1,24 секунды, а флагманские Sonnet, Opus и Fable выдают 100% результат, но тратят на это от 2,2 до 4,5 секунд.

Главное преимущество Jev в том, что он принимает решения в 4–14 раз быстрее конкурентов, при этом список навыков совершенно не расходует контекстное окно. Ознакомиться с полными результатами эксперимента можно здесь

0
12