Главная / Технологии

На что способен бесплатный Devin: тест на реальном проекте

Технологии01.09.2026· 1 мин чтения
На что способен бесплатный Devin: тест на реальном проекте
Реклама

Привет, Хабр! Меня зовут Завур, я фронтенд-разработчик в Selectel. Каждый день я работаю в привычной многим среде разработки VS Code. Однако в личных проектах, которые создаю для исследования новых инструментов и методов написания кода, часто использую Cursor.

Он классно ускоряет разработку, но мне давно хотелось проверить: способен ли искусственный интеллект самостоятельно воплотить сырую идею в полноценное рабочее приложение? Иногда хочется быстро увидеть прототип в действии, чтобы решить, стоит ли развивать проект дальше. Именно поэтому я не смог пройти мимо многообещающего сервиса Devin.

Реклама

Давайте посмотрим, как на практике выглядит реализация идеи с помощью Devin, и попробуем разобраться, действительно ли перед нами потенциальный конкурент Cursor.

Читать далее
Реклама
Похожие материалы
Беспилотный трамвай в Петербурге: что изменилось за 4 года промышленной эксплуатации
Технологии
Беспилотный трамвай в Петербурге: что изменилось за 4 года промышленной эксплуатации

Шесть лет назад мы уже писали на Хабре про беспилотный трамвай - тогда это был один экспериментальный вагон, который иногда выезжал на маршрут в Москве, а автопилот тестировался в основном на закрытой территории. С тех пор много воды утекло - в буквальном смысле, учитывая петербургскую погоду. Стоит сразу оговориться: та статья была про московский проект, и он на самом деле не имеет почти ничего общего с тем, что сейчас работает в Петербурге. Питерский проект стартовал в 2022 году фактически с нуля - с сильно обновленными составом команды, парка трамваев, другими протоколами и, чего уж там, без 2D-детекции и лидара, которые использовались в Москве. Поэтому эта статья - не столько «было/стало» одной и той же системы, сколько рассказ о том, куда доросла история, начавшаяся почти с чистого листа четыре года назад.

02.09.2026 · 1 мин
В ответах нейросетеей почти всегда есть ссылки. Но не по всем из них видно, что за источник за этим стоит
Технологии
В ответах нейросетеей почти всегда есть ссылки. Но не по всем из них видно, что за источник за этим стоит

Ответ нейросети с включённым поиском обычно приходит со списком источников, и этот список выглядит как готовый ответ на вопрос «где про эту тему пишут». Я собрал такой список по семи запросам одной темы из логов собственного прогона — получилось 359 уникальных адресов. Раскрыть удалось 199. За остальными 160 стоит редирект, за которым реальный сайт не виден ни из кода, ни глазами. Ниже — откуда берётся этот пробел, почему его нельзя закрыть локально, что из неё всё-таки вытаскивается бесплатно и как из-за неё врут метрики, если считать их наивно.

02.09.2026 · 1 мин
Qwen заняла первое место с пересекающимися интервалами
Технологии
Qwen заняла первое место с пересекающимися интервалами

2 сентября Qwen3.8-Max-0902 поднялась на первую строку общего зачёта Code Arena WebDev. На момент исходной новости модель набрала 1691 очко и опережала Claude Opus 5 Max на три пункта. Проблема скрывается рядом с красивой цифрой: результат Qwen помечен как предварительный, голосов у неё в несколько раз меньше, а доверительные интервалы двух моделей сильно перекрываются. Пока готовился этот материал, количество голосов и отрыв успели измениться. Разберёмся, что действительно произошло, как Code Arena строит рейтинг и достаточно ли первого места для смены рабочего инструмента. Собственного сравнительного теста я не проводил. Это разбор открытой методики, живой таблицы и документации Alibaba.

02.09.2026 · 1 мин
5,75 миллиарда токенов за полгода: как я перестал жечь контекст в Claude Code
Технологии
5,75 миллиарда токенов за полгода: как я перестал жечь контекст в Claude Code

Полгода назад я начал писать веб-лист персонажа для D&D 5e, и почти весь код в нём пишет Claude Code. В какой-то момент лимиты подписки стали заканчиваться к обеду, и я распарсил транскрипты сессий, чтобы понять, куда уходят токены. Выяснилось: ответы модели — полпроцента расхода, а две трети съели 22 длинные сессии, в которых контекст рос на каждом шагу. В статье — скрипт замера на тридцать строк, разбор того, почему одна длинная сессия дороже пяти коротких, и восемь приёмов, которые я после этого внедрил: лимит сессии в Stop-хуке, карта кода вместо разведки грепом, запрет на повторное чтение файлов, вынос браузерных проверок в сабагента и рутины — на дешёвые модели.

02.09.2026 · 1 мин

Комментарии

Войдите, чтобы оставить комментарий.

Пока нет комментариев — станьте первым.

Реклама