Сервис развивается: тестируем формат, собираем идеи, улучшаем сервис. Есть идеи?

Написать
Войти
По 22 материалам из 6 источников
Иллюстрация к статье о Qwen 3.8 Max

Qwen 3.8 Max и тектонический сдвиг в сторону открытых языковых моделей

ЛонгридLLMOpen SourceAIКитайские LLM

Alibaba представила открытую языковую модель Qwen 3.8 Max с 2,4 трлн параметров и контекстом в 1 млн токенов. Анализ показывает, как появление архитектур класса MoE меняет экономику инференса, почему тариф за токен не равен стоимости работы и как правильно провести пилотную оценку TCO.

Иллюстрация к статье об инженерии ИИ-агентов

Практика инженерии ИИ-агентов: от отрицательных промптов до автоверификации и эвалов

ЛонгридИИ-агентыРазработкаАвтоматизацияТестирование ИИ

Систематизация инженерных практик разработки автономных ИИ-агентов на основе 5000 часов продакшен-опыта. Практическое руководство разбирает настройку ограниченных API-ключей, построение петель автоверификации через UI и вебхуки, создание золотых датасетов для эвалов и экономичную маршрутизацию моделей.

DeepSeek V4 Flash: качественный скачок эффективности при 274 млрд параметров

КраткоLLMOpen SourceОптимизацияЛокальный ИИ

DeepSeek представила модель V4 Flash на 274 млрд параметров с ростом точности с 7% до 54% на бенчмарке DeepSWE. Модель обучена методом подкрепления на задачах кодирования и безопасности, обеспечивая производительность уровня флагманских систем при существенном снижении стоимости инференса.

Hermes Agent v0.2: голосовое взаимодействие, под-агенты и фоновая автоматизация ОС

КраткоИИ-агентыАвтоматизацияГолосовой ИИОркестрация

Nous Research выпустила масштабное обновление открытой платформы Hermes Agent v0.2 под названием Herald. Система получила двустороннее голосовое общение с перебиванием, фоновое выполнение задач под-агентами Delegate и интегрированное управление интерфейсом ОС без блокировки пользователя.

Inkling-Small: дистилляция 12B-модели до уровня флагманских LLM

КраткоLLMOpen SourceНейросетиДистилляция

Thinking Machines анонсировала открытую модель Inkling-Small на 12 млрд активных параметров, сжатую из старшей архитектуры на 975 млрд параметров. Модель сохраняет до 80% производительности на SWE-bench и контекстное окно в 1 млн токенов при существенном снижении системных требований.

Orca ADE: открытый командный центр для параллельного запуска ИИ-кодеров

КраткоИИ-агентыРазработкаСреда разработкиКомандная разработка

Открытая среда Orca ADE от stablyai позволяет параллельно запускать нескольких кодирующих ИИ-агентов в изолированных git-ветках. Инструмент поддерживает работу Claude Code и Hermes, сочетая визуальный режим редактирования интерфейса с отслеживанием лимитов расхода токенов по проекту.

Генерация видео нового поколения: 3D-консистентность в Dreamina Seedance 2.5 и MiniMax H3

КраткоAIКонтентГенерация видеоМультимодальность

Модели Dreamina Seedance 2.5 от ByteDance и MiniMax H3 вывели генерацию видео на уровень 3-минутных россыпей кадров и 2K-разрешения. Технологии обеспечивают точностную 3D-консистентность персонажей, локальное редактирование объектов и прямую интеграцию с редакторами Maya и Blender.

GLM 5.2 и анонс 5.3: разреженное внимание DeepSeek и мультимодальное зрение

КраткоLLMOpen SourceКогнитивное зрениеРазреженное внимание

Разработчик Z.AI представил флагманскую модель GLM 5.2 на 753 млрд параметров с механизмами разреженного внимания DeepSeek и контекстом в 1 млн токенов. Компания также анонсировала следующий релиз GLM 5.3 с поддержкой когнитивного зрения для выполнения сложных многошаговых инженерных сценариев.

Сравнительное тестирование платформ Vibe Coding: лидерство Base44

КраткоРазработкаАвтоматизацияNo-CodeVibe Coding

Сравнительное тестирование современных платформ бесшовной разработки Vibe Coding выявило лидерство сервиса Base44 за счет встроенного AI-ассистента, автоматического проектирования баз данных и моментальной публикации PWA-приложений для мобильных устройств без написания сложного бэкенда.

Карьерная эмерджентность: почему принципы и энергия эффективнее 20-летнего плана

КраткоКарьераБизнесЛидерствоПринципы работы

Концепция карьерной эмерджентности от топ-менеджеров ИТ-индустрии предлагает отказаться от долгосрочных 20-летних планов в пользу локальных правил принятия решений и трекинга личной энергии. Систематический анализ недельной продуктивности помогает строить устойчивую профессиональную траекторию.