Навыки кодирования R1 и V3 Deepseek
Представляем DeepSeek: Новый игрок на арене ИИ
DeepSeek ворвался на сцену в минувшие выходные, привлекая внимание по всему миру по трем убедительным причинам:
- Это чат-бот с ИИ из Китая, что заметно отличается от привычных предложений из США.
- Он имеет открытый исходный код, что имеет большое значение в технологическом сообществе.
- Он работает на значительно меньшей инфраструктуре, чем его крупные конкуренты, что делает его интересным вариантом для многих.
Хотя пристальное внимание правительства США к TikTok и возможное участие китайского правительства в его коде вызвало вопросы, появление DeepSeek из Китая естественно привлекает аналогичное внимание. Однако мы здесь не обсуждаем политику. Вместо этого давайте разберемся, как DeepSeek V3 и DeepSeek R1 сравниваются с другими моделями ИИ в задачах программирования.
Согласно собственным рекомендациям DeepSeek:
- Выбирайте V3 для задач, требующих глубины и точности, например, для решения сложных математических задач или создания сложного кода.
- Выбирайте R1, когда нужны быстрые приложения с большим объемом, такие как автоматизация службы поддержки клиентов или базовая обработка текста.
Вы можете переключаться между R1 и V3 с помощью небольшой кнопки в интерфейсе чата. Если она синяя, вы используете R1.

Скриншот от David Gewirtz/ZDNET Итак, как они справились? Обе модели показали потенциал, но не были безупречны. Давайте рассмотрим результаты.
Тест 1: Создание плагина для WordPress
Мой первый тест, вдохновленный потребностью моей жены в плагине для WordPress для управления устройством вовлеченности для ее онлайн-группы, является классическим. Плагин должен был принимать список имен, сортировать их и гарантировать, что дубликаты не находятся рядом. Я бросал этот вызов множеству ИИ, и это сложная задача.

Скриншот от David Gewirtz/ZDNET DeepSeek V3 справился идеально, создав пользовательский интерфейс и программную логику, которые полностью соответствовали заданию. R1 выбрал другой подход, предоставив целых 4502 слова анализа перед тем, как поделиться кодом. Интерфейс был более широким, но и интерфейс, и логика работали, так что R1 тоже прошел.

Скриншот от David Gewirtz/ZDNET 
Скриншот от David Gewirtz/ZDNET На данный момент обе модели, V3 и R1, прошли один из четырех тестов.
Тест 2: Переписывание функции обработки строк
Пользователь столкнулся с проблемой ввода долларов и центов в поле для пожертвований, что мой исходный код не позволял. Задача состояла в том, чтобы модифицировать функцию для поддержки обоих. DeepSeek создал рабочий код, но есть над чем работать.
Код V3 был слишком длинным и повторяющимся, в то время как рассуждения R1 перед генерацией кода также были многословными. Обе модели проверяли до двух знаков после запятой, но плохо справлялись с очень большими числами. Использование R1 конверсии JavaScript Number без проверки крайних случаев могло привести к сбоям.
Интересно, что R1 предоставил хороший список тестовых случаев:

Скриншот от David Gewirtz/ZDNET Я отдаю победу V3, потому что его код не вызовет сбоев и даст ожидаемые результаты. R1 проваливается из-за возможных сбоев при нестроковых входных данных. Это две победы из четырех для V3 и одна для R1.
Тест 3: Поиск досадной ошибки
Этот тест возник из-за ошибки, которую я с трудом нашел. Проблема заключалась в том, что очевидный ответ, основанный на сообщении об ошибке, был неверным, что часто сбивает ИИ с толку. Для решения требуется понимание вызовов API WordPress, способность видеть за пределами сообщения об ошибке и точное определение ошибки.
И V3, и R1 прошли этот тест с почти идентичными ответами, что дало V3 три победы из четырех, а R1 — две из четырех. DeepSeek уже превосходит Gemini, Copilot, Claude и Meta.
Тест 4: Создание скрипта
Этот тест сложный, поскольку включает три окружения: AppleScript, объектную модель Chrome и Keyboard Maestro. ChatGPT справился с этим на ура, но DeepSeek V3 и R1 не оправдали ожиданий. Ни одна из моделей не поняла необходимости разделения задач между Keyboard Maestro и Chrome, а их знания AppleScript были слабыми.
R1 сделал неверные предположения, например, что переднее окно всегда существует и что активной программой всегда будет Chrome. В итоге V3 прошел три теста и провалил один, а R1 прошел два теста и провалил два.
Заключительные мысли
Настойчивость DeepSeek в использовании публичной облачной почты, такой как Gmail, вместо моего корпоративного домена, была раздражающей. Также были проблемы с отзывчивостью, из-за которых тестирование заняло больше времени, чем ожидалось.
Изначально я столкнулся с трудностями при регистрации из-за этой ошибки:
Онлайн-сервисы DeepSeek недавно подверглись масштабным злонамеренным атакам. Чтобы обеспечить продолжение работы сервиса, регистрация временно ограничена номерами телефонов с кодом +86. Существующие пользователи могут входить как обычно. Спасибо за понимание и поддержку.
После входа я смог провести тесты. DeepSeek склонен к многословности в своем коде. AppleScript в тесте 4 был одновременно неверным и излишне длинным. Регулярное выражение в тесте 2 могло быть более удобным для поддержки, хотя V3 справился правильно.
Я впечатлен тем, что V3 превзошел Gemini, Copilot и Meta, но он все еще на уровне старого GPT-3.5, что говорит о потенциале для роста. Производительность R1 разочаровала. Если выбирать, я бы остановился на ChatGPT для помощи в программировании.
Тем не менее, для нового инструмента, работающего на значительно меньшей инфраструктуре, DeepSeek определенно заслуживает внимания.
Что вы думаете? Пробовали ли вы DeepSeek? Используете ли вы какие-либо ИИ для поддержки программирования? Дайте нам знать в комментариях ниже.
Следите за моими ежедневными обновлениями проектов в социальных сетях, подпишитесь на мою еженедельную рассылку и свяжитесь со мной на Twitter/X по адресу @DavidGewirtz, на Facebook по адресу Facebook.com/DavidGewirtz, на Instagram по адресу Instagram.com/DavidGewirtz, на Bluesky по адресу @DavidGewirtz.com и на YouTube по адресу YouTube.com/DavidGewirtzTV.
Связанная статья
Умные очки Apple могут быть представлены на WWDC27 с акцентом на защиту конфиденциальности
Журналист Bloomberg Марк Гурман сообщает, что умные очки Apple под кодовым названием N50 должны дебютировать на WWDC27 в июне 2027 года, а их розничные продажи ожидаются осенью 2027 года. Изначально выпуск устройства планировался на конец этого года
Внутри раскрыты подробности о Gemini следующего поколения: ограниченные вычислительные мощности, внутренние команды не сошлись в вопросах приоритетов разработки и распределения ресурсов
В отчётах указывается, что запуск долгожданной модели Gemini следующего поколения от Google был перенесён. Внутренние разногласия по вопросам приоритетов разработки и распределения ресурсов, в сочетании с ограниченной вычислительной мощностью и сложн
OpenAI отклоняет опасения по поводу замедления роста, заявляя о ускорении работы нескольких бизнес-подразделений
В ответ на внешнюю критику, связанную с замедлением роста продаж и невыполнением внутренних плановых показателей, лидер в области искусственного интеллекта компания OpenAI опубликовала во вторник, 28 апреля, уверенное заявление. Компания уточнила, чт
Рекомендации по связанным специальным темам
Комментарии (16)
DeepSeek's open-source approach is a game-changer for the AI landscape, challenging the US monopoly. It's refreshing to see innovation from China that prioritizes accessibility. While the coding skills are impressive, we must remain vigilant about potential security risks and ethical implications. This isn't the end of the world, but a new chapter in AI competition. Exciting times ahead!
Interesting take! I've been messing around with DeepSeek's R1 and V3 for a few days, and honestly, the coding output is surprisingly solid for an open-source model. The fact that it's from China and not the usual US big players makes me wonder if we're entering a new phase of AI democratization. Still, I'm not ready to throw away my GPT-4 subscription just yet — let's see how it handles edge cases and long context. 😅
Als Entwickler finde ich es super, dass jetzt auch China mit DeepSeek in den Open-Source-AI-Markt einsteigt. Die Coding-Tests klingen vielversprechend – vielleicht wird die Konkurrenz zwischen den Modellen ja endlich mal die Preise drücken. Hoffentlich bleibt das Projekt langfristig unabhängig und wird nicht von irgendwelchen Firmen vereinnahmt. 🤔
DeepSeek's open-source approach is a game-changer! I'm stoked to see a Chinese AI shaking things up. The coding skills are solid, but I wonder how it’ll stack against giants like GPT in the long run. Exciting times! 🚀
Представляем DeepSeek: Новый игрок на арене ИИ
DeepSeek ворвался на сцену в минувшие выходные, привлекая внимание по всему миру по трем убедительным причинам:
- Это чат-бот с ИИ из Китая, что заметно отличается от привычных предложений из США.
- Он имеет открытый исходный код, что имеет большое значение в технологическом сообществе.
- Он работает на значительно меньшей инфраструктуре, чем его крупные конкуренты, что делает его интересным вариантом для многих.
Хотя пристальное внимание правительства США к TikTok и возможное участие китайского правительства в его коде вызвало вопросы, появление DeepSeek из Китая естественно привлекает аналогичное внимание. Однако мы здесь не обсуждаем политику. Вместо этого давайте разберемся, как DeepSeek V3 и DeepSeek R1 сравниваются с другими моделями ИИ в задачах программирования.
Согласно собственным рекомендациям DeepSeek:
- Выбирайте V3 для задач, требующих глубины и точности, например, для решения сложных математических задач или создания сложного кода.
- Выбирайте R1, когда нужны быстрые приложения с большим объемом, такие как автоматизация службы поддержки клиентов или базовая обработка текста.
Вы можете переключаться между R1 и V3 с помощью небольшой кнопки в интерфейсе чата. Если она синяя, вы используете R1.
Итак, как они справились? Обе модели показали потенциал, но не были безупречны. Давайте рассмотрим результаты.
Тест 1: Создание плагина для WordPress
Мой первый тест, вдохновленный потребностью моей жены в плагине для WordPress для управления устройством вовлеченности для ее онлайн-группы, является классическим. Плагин должен был принимать список имен, сортировать их и гарантировать, что дубликаты не находятся рядом. Я бросал этот вызов множеству ИИ, и это сложная задача.
DeepSeek V3 справился идеально, создав пользовательский интерфейс и программную логику, которые полностью соответствовали заданию. R1 выбрал другой подход, предоставив целых 4502 слова анализа перед тем, как поделиться кодом. Интерфейс был более широким, но и интерфейс, и логика работали, так что R1 тоже прошел.
На данный момент обе модели, V3 и R1, прошли один из четырех тестов.
Тест 2: Переписывание функции обработки строк
Пользователь столкнулся с проблемой ввода долларов и центов в поле для пожертвований, что мой исходный код не позволял. Задача состояла в том, чтобы модифицировать функцию для поддержки обоих. DeepSeek создал рабочий код, но есть над чем работать.
Код V3 был слишком длинным и повторяющимся, в то время как рассуждения R1 перед генерацией кода также были многословными. Обе модели проверяли до двух знаков после запятой, но плохо справлялись с очень большими числами. Использование R1 конверсии JavaScript Number без проверки крайних случаев могло привести к сбоям.
Интересно, что R1 предоставил хороший список тестовых случаев:
Я отдаю победу V3, потому что его код не вызовет сбоев и даст ожидаемые результаты. R1 проваливается из-за возможных сбоев при нестроковых входных данных. Это две победы из четырех для V3 и одна для R1.
Тест 3: Поиск досадной ошибки
Этот тест возник из-за ошибки, которую я с трудом нашел. Проблема заключалась в том, что очевидный ответ, основанный на сообщении об ошибке, был неверным, что часто сбивает ИИ с толку. Для решения требуется понимание вызовов API WordPress, способность видеть за пределами сообщения об ошибке и точное определение ошибки.
И V3, и R1 прошли этот тест с почти идентичными ответами, что дало V3 три победы из четырех, а R1 — две из четырех. DeepSeek уже превосходит Gemini, Copilot, Claude и Meta.
Тест 4: Создание скрипта
Этот тест сложный, поскольку включает три окружения: AppleScript, объектную модель Chrome и Keyboard Maestro. ChatGPT справился с этим на ура, но DeepSeek V3 и R1 не оправдали ожиданий. Ни одна из моделей не поняла необходимости разделения задач между Keyboard Maestro и Chrome, а их знания AppleScript были слабыми.
R1 сделал неверные предположения, например, что переднее окно всегда существует и что активной программой всегда будет Chrome. В итоге V3 прошел три теста и провалил один, а R1 прошел два теста и провалил два.
Заключительные мысли
Настойчивость DeepSeek в использовании публичной облачной почты, такой как Gmail, вместо моего корпоративного домена, была раздражающей. Также были проблемы с отзывчивостью, из-за которых тестирование заняло больше времени, чем ожидалось.
Изначально я столкнулся с трудностями при регистрации из-за этой ошибки:
Онлайн-сервисы DeepSeek недавно подверглись масштабным злонамеренным атакам. Чтобы обеспечить продолжение работы сервиса, регистрация временно ограничена номерами телефонов с кодом +86. Существующие пользователи могут входить как обычно. Спасибо за понимание и поддержку.
После входа я смог провести тесты. DeepSeek склонен к многословности в своем коде. AppleScript в тесте 4 был одновременно неверным и излишне длинным. Регулярное выражение в тесте 2 могло быть более удобным для поддержки, хотя V3 справился правильно.
Я впечатлен тем, что V3 превзошел Gemini, Copilot и Meta, но он все еще на уровне старого GPT-3.5, что говорит о потенциале для роста. Производительность R1 разочаровала. Если выбирать, я бы остановился на ChatGPT для помощи в программировании.
Тем не менее, для нового инструмента, работающего на значительно меньшей инфраструктуре, DeepSeek определенно заслуживает внимания.
Что вы думаете? Пробовали ли вы DeepSeek? Используете ли вы какие-либо ИИ для поддержки программирования? Дайте нам знать в комментариях ниже.
Следите за моими ежедневными обновлениями проектов в социальных сетях, подпишитесь на мою еженедельную рассылку и свяжитесь со мной на Twitter/X по адресу @DavidGewirtz, на Facebook по адресу Facebook.com/DavidGewirtz, на Instagram по адресу Instagram.com/DavidGewirtz, на Bluesky по адресу @DavidGewirtz.com и на YouTube по адресу YouTube.com/DavidGewirtzTV.
Умные очки Apple могут быть представлены на WWDC27 с акцентом на защиту конфиденциальности
Журналист Bloomberg Марк Гурман сообщает, что умные очки Apple под кодовым названием N50 должны дебютировать на WWDC27 в июне 2027 года, а их розничные продажи ожидаются осенью 2027 года. Изначально выпуск устройства планировался на конец этого года
Внутри раскрыты подробности о Gemini следующего поколения: ограниченные вычислительные мощности, внутренние команды не сошлись в вопросах приоритетов разработки и распределения ресурсов
В отчётах указывается, что запуск долгожданной модели Gemini следующего поколения от Google был перенесён. Внутренние разногласия по вопросам приоритетов разработки и распределения ресурсов, в сочетании с ограниченной вычислительной мощностью и сложн
OpenAI отклоняет опасения по поводу замедления роста, заявляя о ускорении работы нескольких бизнес-подразделений
В ответ на внешнюю критику, связанную с замедлением роста продаж и невыполнением внутренних плановых показателей, лидер в области искусственного интеллекта компания OpenAI опубликовала во вторник, 28 апреля, уверенное заявление. Компания уточнила, чт
DeepSeek's open-source approach is a game-changer for the AI landscape, challenging the US monopoly. It's refreshing to see innovation from China that prioritizes accessibility. While the coding skills are impressive, we must remain vigilant about potential security risks and ethical implications. This isn't the end of the world, but a new chapter in AI competition. Exciting times ahead!
Interesting take! I've been messing around with DeepSeek's R1 and V3 for a few days, and honestly, the coding output is surprisingly solid for an open-source model. The fact that it's from China and not the usual US big players makes me wonder if we're entering a new phase of AI democratization. Still, I'm not ready to throw away my GPT-4 subscription just yet — let's see how it handles edge cases and long context. 😅
Als Entwickler finde ich es super, dass jetzt auch China mit DeepSeek in den Open-Source-AI-Markt einsteigt. Die Coding-Tests klingen vielversprechend – vielleicht wird die Konkurrenz zwischen den Modellen ja endlich mal die Preise drücken. Hoffentlich bleibt das Projekt langfristig unabhängig und wird nicht von irgendwelchen Firmen vereinnahmt. 🤔
DeepSeek's open-source approach is a game-changer! I'm stoked to see a Chinese AI shaking things up. The coding skills are solid, but I wonder how it’ll stack against giants like GPT in the long run. Exciting times! 🚀





Дом






