Сервис развивается: тестируем формат, собираем идеи, улучшаем сервис. Есть идеи?

Написать
Войти
По 23 материалам из 9 источников
Иллюстрация к статье

Kimi K3: открытая модель масштаба 3 триллионов параметров выигрывает тесты по кодингу

ЛонгридOpen SourceLLMРазработкаKimi K3

Модель Kimi K3 от китайской Moonshot AI задает новый ориентир для open-source: 2,8 трлн параметров, 1 млн токенов контекста и первое место в тесте фронтенд-кодинга Design Arena. Разбираем реальную стоимость локального хостинга, мультимодальные возможности и экономику работы с фронтирной моделью.

Иллюстрация к статье

Qwen 3.8 Max: 2,4 триллиона параметров от Alibaba в действии на 23 игровых бенчмарках

ЛонгридOpen SourceLLMБенчмаркиQwen

Alibaba анонсировала превью-версию супермодели Qwen 3.8 Max на 2,4 трлн параметров. Анализируем архитектуру Mixture of Experts, мультимодальную обработку видео и результаты 23 независимых тестов GoldyBench против моделей Fable 5, GPT-5.6 и Kimi K3 в генерации интерактивного UI и 3D-графики.

DeepSeek V4 Pro готов к релизу: утечки моделей GA и устаревание старых имен API

КраткоOpen SourceLLMРазработкаDeepSeek

Разработчики заметили на API компании DeepSeek утечки финальных сборок General Availability: DeepSeek-V4-Pro-202606 и Flash-202605. Уточняются детали показателя 80.6% на SWE-bench, оценивается интеграция в агенты и напоминается о полном отключении старых имен API с 24 июля 2026 года.

NVIDIA выпустила Nemotron-3 Embed 8B: новый рекорд качества поиска для ИИ-агентов

КраткоИИ-агентыRAGOpen SourceЭмбеддинги

NVIDIA представила семейство открытых векторных моделей Nemotron-3 Embed. Флагманская версия 8B заняла первое место в бенчмарке MTEB с результатом 78.46, решая главную проблему галлюцинаций ИИ-агентов — некорректный извлеченный контекст. Разбираем версии 8B, 1B и 1B NVFP4 для чипов Blackwell.

Иллюстрация к статье

Обновление экосистемы Gemini: облачный Python в Notebook и ИИ-аватары в Google Vids

ЛонгридИИАналитикаКонтентGemini

Google провела масштабное объединение инструментов вокруг Gemini: NotebookLM переименован в Gemini Notebook и получил возможность исполнять код Python над данными, а сервис Google Vids интегрировал модель Gemini Omni для текстовой генерации видео и создания персональных цифровых аватаров.

Grok получил встроенные автономии: фоновые задачи по расписанию и емейл-триггерам

КраткоАвтоматизацияИИ-агентыЧат-ботыGrok

Разработчики из компании xAI запустили в сервисе Grok функцию Automations. Теперь чат-бот может самостоятельно выполнять регулярные фоновые задачи по расписанию или автоматически запускаться при поступлении писем, избавляя пользователя от постоянного повторного ввода промптов в чат.

Оптимизация локального кодинга: локальный шлюз OmniRoute и вкладки в OpenCode Desktop

КраткоOpen SourceРазработкаПродуктивностьOmniRoute

Разработчики инструментария для кодинга выпустили обновления для бесплатного локального стека: локальный прокси-сервер OmniRoute маршрутизирует запросы к 90+ бесплатным тарифам LLM с компрессией до 95%, а OpenCode Desktop добавил вкладки для параллельного запуска нескольких сессий кодинга.

Автономный инженер Devin AI: решение задач до 3 часов и файл контекста AGENTS.md

КраткоИИ-агентыРазработкаАвтоматизацияDevin

Система Devin AI от Cognition переходит к автономному решению инженерных задач длительностью до 3 часов. Разбираем рабочий процесс в изолированной среде, интеграцию с коммуникациями команды и значение файла AGENTS.md как подробной инструкции для ИИ-агентов по сборке и тестам проекта.

Иллюстрация к статье

Тематический авторитет в эпоху AI-поиска: исследование 50 000 брендов от Semrush

ЛонгридSEOAI-поискМаркетингАналитика

Анализ данных Semrush по 1000 категорий в ChatGPT показал, что 89,3% поискового объема в AI не имеют владельца. Объясняем, почему тематический авторитет сохраняет устойчивость (90,4% удержания лидера), почему упоминания бренда важнее ссылок и как вести маркетинг при 64% выдачи без кликов.

Иллюстрация к статье

Корпоративная память ИИ-агентов: от концепции LLM-вики Карпаты до архитектуры Cerebras

ЛонгридRAGИИ-агентыДанныеВекторный поиск

Инженеры Cerebras и разработчики ИИ представили архитектуру долговременной корпоративной памяти. Вместо наивного сбора заметок предлагается дистилляция логов Slack, Confluence и GitHub с обогащением метаданными и временными весами, превращающая внутренние данные в надежный RAG-слой.

Иллюстрация к статье

Стратегия затрат на ИИ: использование автороутеров и ценовые войны лабораторий

ЛонгридБизнесСтратегияLLMОптимизация затрат

Рост потребления токенов заставляет компании переходить на автомаршрутизацию: 95% рутинных задач перенаправляются на дешевые модели, сохраняя флагманы вроде Fable 5 и GPT-5.6 Sol для сложных вычислений. Разбираем дефицит мощностей Anthropic и практическую стратегию сохранения бюджетов.

Снижение стоимости разработки: кодинг-агенты упрощают реверс-инжиниринг устройств

КраткоРазработкаАвтоматизацияИИ-агентыРеверс-инжиниринг

Наблюдения Саймона Уилисона показывают, как падение стоимости написания кода с помощью ИИ-агентов меняет экономику бытовой автоматизации: реверс-инжиниринг нестабильных протоколов умных гаджетов стал доступным, а последующая поддержка кода больше не создает психологического барьера.