Архив рубрики ‘ии’

Kimi K2.5 наступает на пятки GPT-5.4. И работает из России без VPN

Бенчмарков сейчас – как нейросетей: каждую неделю новый. GPQA Diamond тестирует PhD-знания. Lexometrica проверяет фактическую точность. LLM Persuasion Benchmark – способность убеждать в дебатах. Chatbot Arena – предпочтения живых людей. Резонный вопрос: зачем ещё один?

Я записываю таунхоллы фоном, пока делаю что-то полезное. И вам советую

Помните такое? :-) Или: как корпоративный софт вынудил меня написать своё приложение Представьте картину. Понедельник, 10:00. В календаре — ежеквартальный all-hands на час. CEO заходит в Teams с видом человека, которому есть что сказать. Первые пять минут — действительно интересно. Потом начинается.

Вайб-кодинг: конструктор для профи или магия для «чайников»? Разбираемся на реальном кейсе

5 ошибок при разработке продукта с LLM под капотом – разбор реальных болей живого проекта

Привет, Хабр! Примерно год назад наша команда загорелась идеей создать продукт, который позволил бы «поговорить с кодом». Мы, как и многие, находились под впечатлением от возможностей LLM. Казалось, что ещё немного – и нейросеть возьмёт на себя всю рутину по анализу легаси, аудиту систем и онбордингу новых разработчиков.

Flask + Claude API за 10 дней: как мы автоматизировали акты выполненных работ для самозанятых

Как мы запустили ИИ-сервис для генерации актов за 10 дней: Flask + Claude API TL;DR: сделали сервис для автоматической генерации актов выполненных работ с помощью Claude API. Расскажем про архитектуру, промпт-инжиниринг и подводные камни. Предпосылки Самозанятые и ИП вынуждены тратить 20–40 минут на оформление каждого акта выполненных работ. Существующие решения — либо тяжёлые бухгалтерские системы, […]

Горячие клавиши Claude Code: полный разбор

Недавно на просторах интернета попалась любопытная штука — компактная шпаргалка по Claude Code, собранная на одной странице. Среди слэш-команд, CLI-флагов и конфигурационных файлов там прячется раздел, мимо которого многие проходят: клавиатурные сочетания. А зря. Именно они отделяют «я пишу промпты в Claude Code» от «я живу в Claude Code». Давайте разберём каждое сочетание подробно — […]

Стадии принятия ИИ в разработке: почему команда саботирует его внедрение и что с этим делать

Сейчас в IT забавная ситуация. Одни компании отчитываются о кратном ускорении с ИИ и экономии миллионов рублей. Другие потратили бюджет на лицензии, обучение и евангелизм — и получили команду, которая тихо ненавидит Copilot и пишет код руками, как в 2019-м. Разница между первыми и вторыми не в технологии. Технология одна и та же. Разница — […]

«Цветы для Элджернона» и кривая Claude Code: путеводитель по эмоциональному циклу ИИ-зависимости

«Я не знаю, что со мной происходит. Каждый день я становлюсь умнее. Просто жалко, что мне так страшно.»

Хабр, спасибо! Я попал в Топ. Потом вы обрушили мне Карму. И вот что я Понял…

Я написал статью Застегните ширинки, мамкины киберпанки. Забудьте про ИИ. Она попала в Топ за сутки.

Мы протестировали 34 AI-модели на задачах менеджера. Вот что доступно в России без VPN

Каждый производитель LLM заявляет о лидерстве. OpenAI – «самая мощная модель». Anthropic – «самая безопасная». Яндекс – «лучше всех понимает русский». Проверить эти заявления, не потратив месяц на ручное тестирование, – задача нетривиальная. Мы решили попробовать. Обновление от 17 марта 2026. В первой версии статьи модели Grok (xAI) были отнесены к категории «доступны в России […]