Пост из Telegram-канала «Digital-Задроты в B2B»

Выкладываю результаты эксперимента. Сравнивал с данными 2 кастедвов. Суммарно ≈40+ хороших интервью.

Иллюстрация 1 из 2 к посту «Выкладываю результаты эксперимента. Сравнивал с данными 2 кастедвов. Суммарно ≈40+ хороших интервью.»
Иллюстрация 2 из 2 к посту «Выкладываю результаты эксперимента. Сравнивал с данными 2 кастедвов. Суммарно ≈40+ хороших интервью.»

На скринах:

  • — светлый это результат ChatGPT в думающем режиме.
  • — тёмный результат Gemini

По 0,5 отмечал когда есть не полное совпадение.

Отмечал только то что люди называли хотя бы 3 раза за исследование.

Конечно тут есть пункты, которые тоже важны клиентам, но про них на исследовании не говорят, т.к. это база для рынка.

Из интересных наблюдений:

1. Пробовал разные промты с разными фреймворками. Часть из них выдавали огромные доки с детальным описанием.
Там попаданий было около трети. Но если нет кастдева, то какая треть важная ты не поймешь :)

2. Лучше всех справился Gemini. Его меньше ChatGPT и Perplexity уносило в отрыв от реальности. Он единственный кто не предложил продвигаться на крупных производителей косметики. И сфокусировался на 2 действительно ключевых сегментов.

В целом есть еще один проект. Можно на нем тоже потестить. Сделать?

Оригинал

Пост опубликован в Telegram-канале 22 октября 2025. Комментарии и реакции — там.

Обсудить в Telegram