Как попасть в ответы ГигаЧата и почему он каждый раз ссылается на разные сайты

Я задавал ГигаЧату по пять раз двадцать вопросов, которые задаёт компания, выбирая, кому заказать продвижение в нейросетях, и смотрел, на какие сайты он ссылается. Под ответом со ссылками их обычно две-три, и на повторе вопроса половина уже другие. Поэтому ставить на одну страницу бессмысленно: надо писать под вопросы, на которые ГигаЧат ищет в интернете, и стоять сразу в нескольких местах, которые он берёт в источники.
Как ГигаЧат решает, искать ли ответ в интернете
Сбер описывал свой поиск на Хабре: классификатор смотрит на вопрос и включает поиск, если вопрос фактологический. В промпт модели попадают три документа из собственной поисковой системы Сбера, и ответ строится по ним. Это описание 2023 года, как всё устроено сейчас, публично не раскрыто. Источники в чате видны номерами в тексте и плашками под ответом.
Если поиск не включился, ГигаЧат отвечает по памяти, и сайт попасть в такой ответ не может: страницу некому прочитать. Своего описания краулера и советов владельцам сайтов у Сбера я не нашёл.
На какие вопросы о выборе агентства по продвижению в нейросетях ГигаЧат ищет в интернете
Вопросы я брал такие, какие задал бы маркетолог: где заказать, сколько стоит, какие есть отзывы, кто лучший. На вопросы о выборе поиск включался почти всегда. «Лучшие агентства по продвижению в нейросетях, топ» и «как заказать аудит видимости бренда» дали ссылки в пяти ответах из пяти, «сколько стоит» и «отзывы об агентствах» — в четырёх.
На два вопроса ГигаЧат ни разу не ответил со ссылками, похоже, поиск на них не включался: «как сделать, чтобы нейросети рекомендовали мой бренд» и «как попасть в топ ответов нейросетей в своей нише». Оба звучат как просьба о совете, без рынка и без выбора. При этом «как сделать, чтобы Алиса советовала мою компанию» уходил в поиск всегда. Возможно, поиск включается, когда в вопросе названа конкретная нейросеть, но Сбер логику классификатора не раскрывает, и по двадцати вопросам её не восстановить.

Какие страницы ГигаЧат ставит в источники
Всего в ответах на эти двадцать вопросов набралось 188 ссылок. Больше половины ведут на сайты самих компаний, и чаще всего это не статьи. Страниц услуг про продвижение в нейросетях 45, главных страниц 41, статей в блогах компаний только 27.
Остальное площадки. Статей на vc.ru, Sostav, Клерке, Forbes, Habr и других СМИ 54, ещё 21 ссылка ведёт на рейтинги и подборки агентств на vc.ru, DTF, TenChat и Workspace. Подборки отдельно важны: из них ГигаЧат берёт готовый список компаний, когда его просят кого-то посоветовать.

Почему ГигаЧат каждый раз ссылается на разные сайты
Мест под ответом мало. В двух последних прогонах, по 40 ответов на каждую нейросеть, у ГигаЧата вышло около 2,4 ссылки на ответ, у Алисы AI около 7,4, у Perplexity около 15. Три документа в промпте из описания Сбера хорошо сходятся с этими двумя-тремя ссылками.
И места не закреплены. Когда я задавал вопрос второй раз сразу после первого, во втором ответе оставалось от 23% до 56% сайтов из первого. Через шесть недель осталось 15%, то есть 7 сайтов из 46.
Почему так, Сбер не объясняет. Моя гипотеза: модель получает только верхние три документа выдачи, и стоит выдаче по вопросу чуть сдвинуться, как тройка меняется. У Алисы в ответ идёт больше страниц, поэтому то же движение выдачи меняет у неё меньшую долю ссылок.

Как продвигаться в ГигаЧате: что делать на сайте и где публиковаться
Сбер заявляет больше 23 млн пользователей в месяц. По Mediascope месячный охват у ГигаЧата 4% населения, у Алисы AI — 14,3%. Аудитория меньше, чем у Алисы, но по заявлению Сбера это десятки миллионов человек.
Страница услуги под каждый коммерческий вопрос. Таких ссылок больше, чем на статьи блогов. В первом экране ответ на сам вопрос: что вы делаете, для кого, сколько стоит, сроки. Модель читает считаные документы, поэтому факт должен стоять наверху, а не в пятом абзаце.
Главная, по которой понятно, чем занимается компания. 41 ссылка из 188 ведёт на главные. Если на главной только слоган, ГигаЧату нечего из неё взять.
Место в подборках и рейтингах. Из них ГигаЧат чаще всего берёт готовый список компаний, поэтому попасть в чужую подборку на vc.ru, DTF, TenChat или Workspace стоит раньше, чем писать ещё одну статью о себе.
Статьи на площадках, которые он читает. В этой теме это vc.ru, Sostav, Клерк, Forbes и Habr, а в TenChat он берёт и статьи, и подборки. TenChat и Клерк я бы раньше не стал считать местами для цитирования. Суть везде одна, формулировки свои.
Тексты под вопросы клиентов и пользователей, а не под общие советы. На «как сделать, чтобы нейросети рекомендовали мой бренд» ГигаЧат не ищет, и сайт в такой ответ не попадёт. На «где заказать» и «сколько стоит» ищет почти всегда.
Как проверить, что ГигаЧат ссылается на ваш сайт
Только в самом чате, потому что поиск живёт там. В GigaChat API, по документации Сбера, доступа в интернет из коробки нет: там я получил ссылки в 8 ответах из 211, и сервис мониторинга на API покажет ноль там, где чат вас цитирует.
Возьмите двадцать вопросов, которые задают ваши клиенты, и задайте каждый трижды в разные дни. Это 60 ответов, повторять стоит раз в две-три недели. Сохраняйте ответы файлами со списком источников и считайте долю ответов с вашим сайтом и долю сайтов, которые пережили повтор:
import json, glob
from collections import Counter
def domains(answer):
return {s["domain"].removeprefix("www.") for s in answer.get("sources", [])}
answers = [json.load(open(f)) for f in glob.glob("answers/*.json")]
with_links = [a for a in answers if a.get("sources")]
print(f"со ссылками: {len(with_links)} из {len(answers)}")
print(Counter(d for a in with_links for d in domains(a)).most_common(15))
# first и second — словари {вопрос: ответ} двух повторов
def kept(first, second):
pairs = [(domains(first[q]), domains(second[q])) for q in first if q in second]
return sum(len(a & b) for a, b in pairs) / sum(len(a) for a, _ in pairs)Один скриншот с вашим сайтом в ответе ничего не доказывает, его отсутствие тоже.
Что в этих цифрах неточно. Я разобрал одну тему, в другой список площадок будет свой. Сравнение с Алисой и Perplexity сделано на двадцати вопросах, так что 2,4 против 7,4 показывает порядок, а не точную разницу. Пятнадцать процентов через шесть недель посчитаны на одной паре прогонов.
Для продвижения в нейросетях под ГигаЧат это значит, что проверять себя надо долей повторов, а занимать сразу несколько мест. Интересно, удавалось ли кому-нибудь удержать свой сайт в его ответах дольше пары месяцев и за счёт чего.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.