Поиск
    Дата публикации новости 16 сентября 2026

    Большая статья ведущего инженера DeepSeek: Мне пришлось похоронить свой талант во вчерашнем дне

    Большая статья ведущего инженера DeepSeek: Мне пришлось похоронить свой талант во вчерашнем дне

    Оригинальный материал: Wallstreetcn

    Лю Шэнъюй, инженер DeepSeek и бывший капитан суперкомпьютерной команды Weiming Пекинского университета, написал: «Человечество никогда не сомневалось в вопросах собственного уничтожения». Чем лучше он оптимизирует операторы, тем быстрее происходит инференс и обучение новых моделей; чем быстрее растут возможности моделей, тем скорее настанет момент, когда ИИ заменит ручное написание операторов. Однако он пояснил, что это не всплеск тревоги из-за возможной безработицы, а достойное прощание с ремесленной эпохой «ручного программирования». 14 сентября Лю Шэнъюй, молодой инженер, который только что завершил разработку ключевых операторов для DeepSeek V4.1, увидел, как его масштабное эссе о технологических переменах и личных размышлениях под названием «Мне пришлось похоронить свой талант во вчерашнем дне» стремительно разошлось по китайским и международным технологическим сообществам, вызвав широкую дискуссию о судьбе разработчиков в эпоху ИИ и об эволюции технологий.

    Хештег #Мне пришлось похоронить свой талант во вчерашнем дне# также поднялся на вершину трендов Zhihu.

    Являясь одним из ключевых создателей базовой инфраструктуры для больших моделей, инженер систем машинного обучения DeepSeek Лю Шэнъюй обладает выдающимся техническим бэкграундом. Он входил в состав «Класса Тьюринга» по информатике Пекинского университета выпуска 2021 года, был капитаном суперкомпьютерной команды Weiming Пекинского университета и представлял вуз на международных студенческих соревнованиях по суперкомпьютингу SC23. Придя в DeepSeek в апреле 2025 года, он взял на себя ключевые задачи по разработке низкоуровневых операторов и буквально на днях завершил сдачу кода основного оператора Attention (внимание) для DeepSeek V4.1 (MQA attention с head dim = 512).

    В своей статье Лю Шэнъюй откровенно признал: хотя он гордится успешно созданными базовыми операторами для DeepSeek V4.1, он в полной мере осознает необратимость технологического прогресса.

    «Еще через полгода или год операторы, написанные ИИ, скорее всего, будут столь же хороши, как и мои, или даже превзойдут их», — прямо заявил Лю Шэнъюй. «ИИ способен генерировать мысли со скоростью 300 токенов в секунду, набирать строку команды за полсекунды и писать фрагмент кода за двадцать секунд — я так не умею. ИИ может непрерывно наращивать глубину модели, интенсивность рассуждений, объем вызовов инструментов и даже параллелизм — я так не могу».

    Эта стремительная эволюция поставила разработчиков перед глубоким технологическим парадоксом: чем лучше он оптимизирует операторы, тем быстрее обучаются и выполняют инференс новые модели; чем быстрее растут возможности моделей, тем быстрее наступит момент, когда ИИ заменит ручное написание операторов.

    Перед лицом этой непреодолимой тенденции Лю Шэнъюй написал: «Человечество испокон веков никогда не сомневалось в вопросах собственного уничтожения... Конечно, я надеюсь, что меня не сметут революцией, но если уж этому суждено случиться, пусть тем, кто совершит эту революцию надо мной, буду я сам».

    «Я не останусь без работы, но мне придется сменить профиль»

    Отвечая на внешние опасения по поводу будущего программистов, Лю Шэнъюй дал трезвую оценку: инженеры как класс не столкнутся с безработицей в буквальном смысле, но им неизбежно предстоит глубокая переквалификация.

    «Смена профиля означает, что мне придется оставить проектирование, написание и оптимизацию операторов — сферу, которую я долго развивал и которую искренне люблю, — и вместо этого стать "пилотом мехи" для агентов (Agents)», — написал он. «Раньше мои интересы, мои сильные стороны и потребности индустрии в основном совпадали; теперь же запрос индустрии сместился с "людей, умеющих писать высокопроизводительные операторы" на "людей, способных с помощью ИИ быстрее создавать высокопроизводительные операторы"».

    Он сравнил эту утрату ремесла с тем, как автоматические вязальные машины вытеснили традиционных мастеров. Даже если накопленный опыт по-прежнему позволяет управлять станком лучше всех, прежняя «радость от возможности сидеть у окна, слушать шум дождя, продевать нитку в иголку и смаковать неспешный ход времени в конечном счете разбивается о грохот машин».

    «Мои руки приобрели шестеренки, но сердце потеряло ритм», — с грустью отметил он.

    Помимо личных карьерных изменений, Лю Шэнъюй также выразил в статье обеспокоенность снижением инженерных навыков у молодого поколения. Если студенты повсеместно полагаются на ИИ для выполнения сложных заданий по программированию за считаные минуты, в понимании системной архитектуры и абстрактного проектирования может образоваться пробел. «Человек с крайне слабыми инженерными навыками в связке с ИИ может плодить горы мусорного кода в разы быстрее, закладывая тем самым всевозможные скрытые угрозы в системы и превращая этот мир в еще более хаотичный балаган».

    Разъяснение замысла: достойное прощание с «эпохой ремесла»

    После того как публикация статьи вызвала на крупнейших платформах чрезмерные спекуляции относительно геополитики, конкуренции институтов и страха перед безработицей, Лю Шэнъюй опубликовал дополнительное заявление, разъясняющее истинные мотивы написания текста.

    Он подчеркнул, что цель статьи заключалась вовсе не в выражении тревоги за рабочие места и не в разжигании противостояния между DeepSeek и закрытыми компаниями вроде Anthropic. Главным посылом было лишь искреннее прощание со светлыми днями «написания операторов исключительно вручную».

    «Возможно, однажды в будущем "ручное написание операторов" или даже "программирование" станет скорее развлечением, чем производственной деятельностью, подобно тому как сегодня почти никто не охотится с копьем, а использует его лишь в спортивных состязаниях», — написал Лю Шэнъюй. «Это, по сути, вынуждает меня отказаться от того, что я когда-то любил, и силой повернуть в другое русло. Даже если новое направление окажется столь же увлекательным, это все равно неприятно. Как сказано в заголовке: мне пришлось похоронить свой талант во вчерашнем дне».

    Говоря о том, почему он решил остаться в DeepSeek, Лю Шэнъюй вновь подчеркнул свою позицию: передовой интеллект должен предоставляться обществу открыто и доступно, чтобы ключевые технологии не были полностью монополизированы узким кругом коммерческих олигархов.

    «Похоронив свой талант во вчерашнем дне, я все еще вижу свет завтрашнего дня, к которому стоит стремиться», — отметил он в завершение своих пояснений, добавив, что продолжит посвящать себя новому процессу внедрения ИИ-агентов для написания операторов и, осваивая новые технологические инструменты, будет искать свое место в новой эпохе.

    Оригинальный текст статьи:

    Несколько дней назад состоялся релиз DeepSeek v4.1, поднявший планку возможностей компактных моделей на новый уровень.

    Темпы развития ИИ превзошли все ожидания. От первой версии ChatGPT, которая могла лишь просто общаться в чате и имела контекстное окно всего в несколько тысяч токенов, до моделей с развитыми способностями к рассуждению вроде OpenAI o1, DeepSeek R1 и Kimi K1.5 Thinking прошло всего два года. А от появления рассуждающих моделей до сегодняшних агентов, способных слаженно исполнять команды в различных средах-обвязках (harness tools) и решать сложные задачи, прошел всего год с небольшим. Трудно даже вообразить, каким станет ИИ еще через год, два или три, какой мощью он будет обладать, обретет ли способность к саморазвитию и насколько глубоко проникнет в такие области, как воплощенный интеллект (embodied intelligence).

    ИИ все лучше справляется с написанием операторов

    В моей сфере деятельности — проектировании и написании операторов — ИИ также совершил гигантский скачок. Всего за один год он прошел путь от скромного ассистента, способного лишь проверять документацию, читать код и искать ошибки, до настоящего мастера, который самостоятельно читает код CUDA, PTX и SASS, анализирует задержки (stall time) каждой инструкции с помощью профессиональных инструментов, а затем автономно оптимизирует операторы. Я уверен, что в ближайшем будущем он сможет самостоятельно проектировать диспетчеризацию (scheduling) операторов, оценивать производительность различных схем, а также реализовывать и оптимизировать их.

    Безусловно, я горжусь успехом DeepSeek v4.1 — ведь основной оператор Attention (внимание) для нее был написан мной [1], и высокое качество модели служит прямым подтверждением качества моего оператора. Однако колесо времени неумолимо движется вперед, и никому не под силу остановить прогресс. Я прекрасно понимаю, что еще через полгода или год операторы, созданные ИИ, с высокой вероятностью будут столь же хороши, как и мои, или даже превзойдут их. ИИ способен генерировать мысли со скоростью 300 токенов в секунду, печатать строку команд за полсекунды и выдавать готовый фрагмент кода за двадцать секунд — я так не могу; ИИ может непрерывно масштабировать глубину модели, интенсивность рассуждений, частоту вызовов инструментов (интенсивность взаимодействия со средой) и даже параллелизм — я так не могу.

    Человечество испокон веков никогда не сомневалось в вопросах собственного уничтожения. Почему же я, прекрасно понимая, что «чем лучше я напишу операторы, тем быстрее будут обучаться и работать наши новые модели, тем быстрее вырастут их возможности и тем скорее меня заменят», все равно выкладываюсь на полную при их оптимизации? С одной стороны, написание операторов для меня сродни игре, приносящей огромное удовольствие. В тот миг, когда я нахожу новый технический прием или вижу прирост производительности своего оператора, восторг внутри меня не уступает чувствам спидраннера, побившего собственный рекорд. В то же время, когда мои операторы значительно превосходят официальные решения от вендоров, меня переполняет чувство гордости. Но помимо этого есть и более важная причина: даже если я стану «халтурить» или намеренно саботировать обучение моделей, модели других компаний продолжат развиваться в прежнем темпе и в итоге все равно вытеснят меня. «Конечно, я надеюсь, что меня не сметут революцией, но если уж этому суждено случиться, пусть тем, кто совершит эту революцию надо мной, буду я сам». Когда все вокруг столь одержимы саморазрушением, мне не остается ничего другого, кроме как включиться в эту беспощадную гонку вооружений.

    А что же я?

    Когда настанет день, и ИИ научится писать операторы действительно лучше меня, что тогда будет со мной?

    Мой вывод таков: я не окажусь «безработным», но мне придется «сменить профиль». Мой источник заработка сохранится, однако это может означать, что я больше никогда не смогу заниматься делом, которое когда-то искренне любил.

    В свое время я уже размышлял о духе времени и своем будущем: поскольку мир меняется стремительно (развитие ИИ — наглядный тому пример), я просто не могу предсказать, что произойдет через пять или десять лет. Но несмотря ни на что, я верю, что благодаря своему видению, суждениям, инициативности и интеллекту я смогу остаться за столом новой эпохи и вновь выйти в лидеры. Однако эта уверенность гарантирует лишь то, что я не останусь «без работы», но не спасает от необходимости «сменить профиль» — напротив, именно готовность сменить профиль и убережет меня от безработицы.

    Что же значит сменить профиль? Это значит отказаться от проектирования, написания и оптимизации операторов — направления, в которое я вложил столько сил и к которому питаю страсть, — и стать «пилотом мехи» для агентов (Agents). Раньше мои интересы, сильные стороны и запросы индустрии находились в гармонии; теперь же ИИ научился делать то, в чем я был хорош, еще лучше меня, и изменил требования индустрии с «людей, умеющих писать высокопроизводительные операторы» на «людей, способных с помощью ИИ быстрее выдавать высокопроизводительные операторы». Чтобы соответствовать потребностям рынка, мне неизбежно придется оставить любимое дело и уйти в неизведанную область. Я верю, что смогу по-прежнему качественно и эффективно создавать операторы, опираясь на свое понимание инженерных принципов, требований высокоуровневых моделей и низкоуровневого «железа». Я знаю, что могу полюбить это новое направление (а могу и нет), но чувство, когда у тебя отнимают любимое дело, едва ли можно назвать приятным. Та тихая радость, когда сидишь за рабочим местом и спокойно пишешь операторы на протяжении всего дня, этим летом рискует стать лебединой песней. Мне приходится похоронить свой талант во вчерашнем дне и стать пилотом мехи. В моих руках прибавилось шестеренок, но в сердце стало меньше биения.

    Приведу наглядную аналогию: представьте, что вы мастер вязания, виртуозно создающий сложные узоры и подбирающий цвета. Ваши свитеры отличаются великолепным качеством и красивым дизайном, состоятельные люди отовсюду обращаются к вам с заказами, что приносит хороший доход. Вместе с тем вы наслаждаетесь возможностью сидеть у окна, заварив чайник чая, смотреть на зеленые горы, реки, скот и дым из печных труб, спокойно посвящая вязанию целый день. Но однажды кто-то изобретает удивительный станок: достаточно заправить нити и задать узор, как он автоматически вяжет свитер, ничуть не уступающий по качеству и текстуре ручной работе, причем делает это в разы быстрее. Вы прекрасно понимаете, что любой ваш коллега с таким станком легко достигнет вашего прежнего уровня, и вам ничего не остается, кроме как тоже начать его использовать. Вы также понимаете, что благодаря двадцатилетнему опыту ваше мастерство позволит вам работать быстрее и качественнее остальных даже при наличии станков у всех. Но та радость от прослушивания дождя у окна, вдевания нити в иголку и неспешного течения времени в конечном счете безжалостно сметается грохотом механизмов.

    Я знаю, что это чувство бессилия неизбежно, и с этим ничего не поделать. Вы сохраните доход, но с былыми увлечениями, скорее всего, придется распрощаться. Я отношусь к людям, которые четко разграничивают рациональное и эмоциональное: когда нужно решать задачи логически, я предельно рационален, но порой во мне берет верх чувствительность. Помню, как при переезде из съемной квартиры, где я прожил год, я долго плакал, не желая отпускать воспоминания. И сегодня прощание с эпохой написания операторов вручную и оптимизации силой человеческого разума дается куда болезненнее.

    Не знаю, разделяет ли кто-то из читателей эти чувства, но, полагаю, так тому и быть.

    А что же люди?

    По мере развития ИИ меня тревожат определенные вопросы:

    · Станут ли современные студенты охотнее использовать ИИ для выполнения заданий, особенно практических лабораторных работ? Представьте, что есть два пути: первый — трудиться восемь часов над лабораторной, рискуя даже не получить высший балл; второй — запустить ИИ-модель, потратить пару центов и несколько минут, получив безупречный код. Что выберет большинство учащихся?

    · Описанное выше приведет к катастрофической нехватке инженерных навыков у многих студентов, включая умение структурировать код, проектировать системы, закладывать в архитектуру будущие требования, проводить абстракцию и так далее. Нужны ли будут эти «инженерные навыки» на фоне постоянного роста возможностей ИИ? Уйдут ли они в прошлое, подобно умению «виртуозно писать на ассемблере x86», или же навсегда сохранят ценность, как способность «понимать компьютерную систему целиком — от прикладного софта до системного уровня и аппаратной части»? Если верен второй вариант, то ситуация тревожная: человек со слабыми инженерными навыками в связке с ИИ начнет генерировать горы низкопробного кода с колоссальной скоростью, закладывая скрытые мины в системы и превращая мир в царство дилетантизма.

    · Станет ли власть в будущем обществе важнее технологий или интеллекта?

    Ответы на эти вопросы, возможно, предстоит дать самой эпохе.

    Заключение

    По мере развития ИИ будущее общество может качнуться к одной из двух крайностей: коммунизму либо сценарию Cyberpunk 2077. В первом случае производительность труда колоссально вырастет, а уровень жизни людей значительно повысится. Во втором — горстка технологических гигантов сосредоточит у себя подавляющую часть ресурсов, и лишь единицы смогут использовать передовой ИИ и технологии для достижения подобия «механического вознесения», в то время как большинству останется довольствоваться примитивным ИИ. Преодолеть классовые барьеры станет практически невозможно: чтобы подняться выше, необходим мощнейший ИИ, что порождает замкнутый круг.

    Попробуйте угадать: если An****pic навсегда монополизирует самый продвинутый в мире ИИ, к чему придет общество — к коммунизму или к 2077 году? Догадались? Именно поэтому я продолжаю считать, что передовой интеллект должен предоставляться каждому открыто и недорого. Я не верю, что Anthropic или OpenAI пойдут на это, и особенно не желаю, чтобы Anthropic контролировала самый совершенный искусственный интеллект или AGI. Выражаясь утрированно, по степени опасности это сопоставимо с тем, как если бы Ги*лер завладел яде*ным оружием раньше союзников. По этой же причине я выбрал DeepSeek и остаюсь здесь: мы исследуем мощный, быстрый и доступный искусственный интеллект и открываем его исходный код, надеясь удержать мир от сползания в сторону антиутопии 2077 года.

    Пусть мир будущего будет благополучным. Пусть все прекрасное будет сохранено.

    [1] «Основной оператор Attention» включает только MQA attention с head dim = 512 и не охватывает индексатор (indexer), используемый для выбора top-k важнейших токенов; эта часть была написана другими моими коллегами (которые также крайне сильны) (и их ИИ-агентами).

    Дополнительные примечания к статье «Мне пришлось похоронить свой талант во вчерашнем дне»

    Эта статья неожиданно вышла далеко за пределы профессионального сообщества. На официальных аккаунтах в WeChat она набрала более 100 000 прочтений, возглавила топ трендов Zhihu и вызвала оживленные дискуссии в X.

    Такой всплеск внимания стал для меня полной неожиданностью. К сожалению, фокус внимания аудитории разошелся с тем, что я действительно хотел сказать.

    Изначальная цель написания статьи заключалась не в том, чтобы выразить тревогу по поводу безработицы, и не в том, чтобы противопоставить открытость DeepSeek неприязни к Anthropic, а в том, чтобы проститься со временем, когда я писал операторы вручную. До появления агентов я набирал большую часть кода символ за символом. Этот, казалось бы, рутинный процесс приносил мне истинное удовольствие: я мог сосредоточиться и тщательно продумывать каждую деталь — от структуры модулей и распределения функций до логики кода и именования переменных. Мне нравилось ломать голову над схемами диспетчеризации и оптимизации операторов, повышать их производительность и в итоге превосходить признанные эталоны (такие как Flash Attention, официальные операторы от NVIDIA и даже задачи, ранее считавшиеся «не поддающимися оптимизации», вроде разреженного внимания на уровне токенов). «В тот миг, когда я изобретал новый прием или видел рост производительности своего оператора, восторг внутри меня не уступал чувствам спидраннера, побившего собственный рекорд». Но теперь эту радость забирает ИИ: ради эффективности разработки и производительности операторов (сегодняшний ИИ пишет быстрее меня, а будущий будет писать и быстрее, и качественнее) я обязан принимать реалии новой эпохи и учиться эффективнее использовать ИИ для написания операторов. В рабочее время у меня больше нет возможности неспешно и вдумчиво писать, настраивать и оптимизировать код своими руками. Вероятно, в будущем «ручное написание операторов» и даже «программирование» превратятся в хобби, а не в элемент производства, точно так же как копья сейчас служат лишь спортивным инвентарем, а не оружием для охоты. По сути, это вынуждает меня оставить то, что я любил, и принудительно двигаться в ином направлении. Даже если новое русло окажется столь же захватывающим, сам процесс расставания малоприятен. Как и гласит заголовок: мне пришлось похоронить свой талант во вчерашнем дне.

    Я очень дорожу воспоминаниями и способностью искренне сопереживать, однако воспоминания неизбежно стираются, постепенно засыпаемые снегом времени. Ранее я уже писал об этом материал: «Итоги 2025 года, часть вторая: Память». Поэтому эта статья задумывалась как подведение итогов и дань уважения прошедшим дням. Я надеялся запечатлеть в ней картины ручного написания операторов, чтобы сберечь эту живую память и искренние чувства для самого себя спустя десять или двадцать лет. Кроме того, этим текстом я хотел придать себе смелости отпустить прошлое, взять на вооружение новые инструменты и уверенно шагнуть в новую эпоху.

    ↑ Фрагмент, который мне очень понравился, из комментариев к публикации в WeChat

    Однако аудитория поняла мой посыл иначе... Изначально два последних раздела были просто свободными размышлениями: в предпоследнем я вскользь затронул социальные проблемы, порождаемые ИИ, не претендуя на глубокий анализ или готовые ответы; в заключительном поделился личными мыслями о том, что передовой интеллект должен «поставляться каждому открыто и дешево». Не будучи экспертом в гуманитарных дисциплинах вроде истории или социологии, я лишь поверхностно коснулся этой темы (заодно слегка уколов A/, которую я никогда не переваривал). Рассуждения о коммунизме и 2077 годе также не претендуют на абсолютную истину. Хотя слова «Одна из причин, почему я выбрал DeepSeek — нежелание видеть мир похожим на 2077 год» и «Пусть все прекрасное будет сохранено» искренни и отражают мои идеалы, они не были главной темой статьи. Этот фрагмент выражает исключительно мое личное мнение и не является официальной позицией компании, в которой я работаю. Возможно, когда-нибудь, лучше осмыслив эту тему, я посвящу ей отдельный материал.

    На практике же, хотя многие и разделили мою ностальгию по ушедшим дням, большинство комментаторов сосредоточились именно на последнем абзаце. Самые популярные ответы на Zhihu были весьма зрелыми (что доказывает высокий уровень понимания текстов у аудитории этой площадки), однако в комментариях WeChat развернулись бурные споры об отношении Anthropic и DeepSeek к открытому ИИ, а на Xiaohongshu и вовсе появились заголовки вроде «DeepSeek наносит ответный удар по Anthropic»... Меня поражает способность некоторых выпускников журфаков раздувать хайп, и подобные вещи вызывают лишь досаду... Хотелось бы, чтобы люди обращали больше внимания на основную суть публикации.

    Возвращаясь к главной теме: несомненно, в будущем ИИ станет еще сильнее. Даже в рамках текущей парадигмы «Agent + Harness + длинный контекст + CoT» возможности ИИ будут неуклонно расти за счет повышения качества данных, глубины моделей и размера контекстного окна. Не говоря уже о том, что впереди нас ждут воплощенный интеллект (embodied intelligence), RSI и другие пока неизвестные технологии. Я с оптимизмом смотрю на потенциал будущего ИИ и относительно уверен в своем положении в будущем обществе, однако испытываю пессимизм по поводу того, смогут ли люди в будущем спокойно и сосредоточенно отдаваться одному делу, а также сомневаюсь, удастся ли мне самому в дальнейшем совмещать работу и искреннее увлечение в чем-то одном.

    Но даже в таких условиях я продолжу писать операторы и привлекать ИИ-агентов для их создания. Во-первых, потому что «Конечно, я надеюсь, что меня не сметут революцией, но если уж этому суждено случиться, пусть тем, кто совершит эту революцию надо мной, буду я сам» (быть вытесненным другими куда хуже, чем эволюционировать самостоятельно). Во-вторых, потому что я по-прежнему надеюсь, что мы (или другие ИИ-компании, разделяющие идеалы открытости) сможем создать сильнейший интеллект на благо каждого раньше определенных корпораций. Я остаюсь при своем мнении насчет коммунизма и 2077 года и хочу, чтобы наш мир держался как можно дальше от мрачного финала в стиле 2077. Хобби — это одно, а идеалы и убеждения — другое, поэтому я продолжу исследования в этой области. В будущем я также постараюсь вновь синхронизировать свои интересы, навыки и вызовы времени, чтобы обрести свою тихую гавань в наступающей эре ИИ. Похоронив свой талант во вчерашнем дне, я все еще вижу свет завтрашнего дня, к которому стоит стремиться. Промокнув под холодным дождем на краю света, я согретым сердцем разгоню мрак и буду искать тот отблеск синевы, что постепенно проступает сквозь тьму ночи [1].

    [1] Адаптировано из текстов песен COP, в частности «Singer at the End of the World».

    Оригинальная ссылка