Page Assist на практике: четыре повседневных рабочих процесса браузера с локальными и облачными моделями

AIHubMix9 мин чтения
Page Assist на практике: четыре повседневных рабочих процесса браузера с локальными и облачными моделями

Большинство инструментов AI-чата работают в отдельной вкладке. Вы копируете текст со страницы, вставляете его в окно чата и копируете ответ обратно. Page Assist устраняет эту круговую поездку: это расширение браузера с открытым исходным кодом, которое открывает модель в боковой панели рядом с любой страницей, которую вы читаете, а также полноценный веб-интерфейс для более длительных разговоров.

Сначала оно было интерфейсом для локальных моделей, работающих в Ollama, и это по-прежнему является значением по умолчанию. Но оно также принимает любую конечную точку, совместимую с OpenAI, что означает, что та же боковая панель может переключаться между небольшой моделью на вашем ноутбуке и фронтирной моделью в облаке. Этот гид описывает четыре рабочих процесса, для которых люди действительно используют его, и для каждого из них указывает, какие функции включить и какая модель — локальная или облачная — подходит лучше.

Page Assist в кратком обзоре

Данные ниже взяты из репозитория GitHub и списка в Chrome Web Store на 8 октября 2026 года.

  • Лицензия и стоимость: MIT, бесплатно. Создано независимым разработчиком (n4ze3m) с участием сообщества.
  • Принятие: около 8,200 звезд на GitHub; 300,000 пользователей и рейтинг 4.8 в Chrome Web Store.
  • Темп выпуска: еженедельно. Версия 1.5.86, выпущенная 8 октября 2026 года, добавила AIHubMix в список предустановленных поставщиков.
  • Браузеры: Chrome, Brave, Edge, Vivaldi, Firefox, LibreWolf, Zen. Opera и Arc получают веб-интерфейс, но не боковую панель.
  • Конфиденциальность: нет телеметрии. История чата, настройки и встраивания базы знаний остаются в хранилище браузера.

Установите его из Chrome Web Store (Firefox и Edge имеют свои собственные страницы дополнений). Два сочетания клавиш, которые стоит запомнить с первого дня: Ctrl+Shift+Y открывает боковую панель, Ctrl+Shift+L открывает веб-интерфейс.

Какой рабочий процесс требует чего

Рабочий процессФункцияТребуетсяПодходит модель
Чтение длинной страницыЧат с веб-сайтомМодель чатаОблако для длинных страниц
Переписать выделенный текстМеню помощникаМодель чатаЛокальной достаточно
Спросить о своих файлахБаза знанийЧат + встраиваниеЛюбая
Позволить модели действоватьДействие страницы / MCPМодель вызова инструментаОблако

"Подходящая модель" — это отправная точка, а не правило. Сильная локальная модель на хорошем GPU может охватить все четыре строки.

Однократная настройка: локальная модель и облачный провайдер

Локально: Ollama обнаруживается автоматически

Если Ollama работает на localhost:11434, Page Assist находит его без какой-либо настройки и перечисляет каждую модель, которую вы загрузили. Если вы видите ошибку 403 при отправке сообщения, это проблема CORS: либо включите опцию пользовательского источника в Настройках → Настройки Ollama, либо установите OLLAMA_ORIGINS=* и перезапустите Ollama.

Облако: выберите AIHubMix из списка поставщиков

AIHubMix является встроенным поставщиком в Page Assist: начиная с версии 1.5.86 он находится в выпадающем списке поставщиков рядом с OpenAI, DeepSeek и другими, так что URL вводить не нужно. Процесс следует руководству по поставщикам, совместимым с OpenAI:

  1. Создайте API-ключ в консоли AIHubMix (в быстром старте показано, где).
  2. В Page Assist откройте Настройки → OpenAI Совместимый API → Добавить поставщика.
  3. Выберите AIHubMix из выпадающего списка. Базовый URL https://aihubmix.com/v1 заполнен автоматически.
  4. Вставьте свой API-ключ и сохраните.
  5. Появляется список моделей, загруженный из AIHubMix. Найдите, отметьте модели чата, которые хотите, оставьте тип на Модель чата, и сохраните.

Если вы хотите проверить ключ перед вставкой его в расширение, одного запроса достаточно. Page Assist общается с AIHubMix через тот же конечный пункт Chat Completions:

curl https://aihubmix.com/v1/chat/completions \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "auto", "messages": [{"role": "user", "content": "ping"}]}'

auto — это реальное имя модели на AIHubMix: LLM Router выбирает модель для каждого запроса (по умолчанию с учетом стоимости, с вариантами по качеству и времени отклика) и выставляет счет за модель, которую фактически использовал. Добавление auto в качестве одной из ваших моделей Page Assist является разумным значением по умолчанию, если вы не хотите выбирать. Просмотрите список моделей в случае, если вы хотите выбрать конкретные модели и сравнить цены.

Модель встраивания: нужна для двух из четырех рабочих процессов

База знаний и режим по умолчанию Чата с веб-сайтом требуют модель встраивания. Установите ее в Настройках → Настройки RAG. Локально Page Assist рекомендует nomic-embed-text через Ollama. Через AIHubMix модели встраивания поступают из того же списка моделей, что и модели чата. Снова откройте список моделей поставщика, отметьте модель встраивания, такую как gemini-embedding-001, и сохраните ее с типом, установленным на Модель встраивания. Она затем появится в выпадающем списке Настроек RAG.

Рабочий процесс 1: Чтение длинной страницы, не покидая ее

Откройте боковую панель на статье, странице документации или в обсуждении проблемы на GitHub и включите Чат с веб-сайтом. Теперь вы можете спросить: "Каковы три основных аргумента здесь?" или "Какой параметр конфигурации исправляет ошибку в комментарии 14?" и модель ответит, основываясь на странице, на которой вы находитесь.

Существует два способа, как страница достигает модели, и разница имеет значение:

  • Режим встраивания (по умолчанию): страница разбивается на части, встраивается, и только соответствующие части отправляются модели. Работает с небольшими окнами контекста, но может упустить вещи, которые охватывают всю страницу.
  • Нормальный режим: текст страницы отправляется напрямую. В Настройках извлечения отключите "Включить встраивание и извлечение" и увеличьте "Максимальный размер контента для полного контекстного режима". Лучше для резюме и вопросов "сравните раздел A с разделом D", но требует модель с длинным контекстным окном.

Этот второй режим — это то место, где облачная модель оправдывает свое место. Длинная спецификация или обсуждение из 200 комментариев удобно помещаются в облачной модели с большим контекстом, в то время как маленькой локальной модели придется сократить страницу.

Три связанных функции, которые стоит знать:

  • @tab упоминания: введите @ для того, чтобы привлечь другие открытые вкладки в тот же вопрос, например, сравнение двух страниц с ценами. Сначала включите это в настройках.
  • Кнопка резюме YouTube: необязательная кнопка на страницах видео YouTube, которая открывает боковую панель и резюмирует видео, работая с транскрипцией страницы.
  • Зрение: для страниц, где контент в основном состоит из изображений или графиков, иконка глаза отправляет скриншот страницы в модель, способную к зрению. Модели без зрения могут использовать OCR, который в документации Page Assist описан как базовый.

Рабочий процесс 2: Выберите текст, щелкните правой кнопкой мыши, готово

Меню помощника — это самый быстрый рабочий процесс в расширении. Выберите текст на любой странице, щелкните правой кнопкой мыши и выберите действие в разделе Page Assist. Пять действий встроены: Резюмировать, Перефразировать, Перевести, Объяснить и Пользовательское.

Настоящая ценность заключается в Пользовательских подсказках помощника (Настройки → Управление подсказками → Пользовательский помощник). Каждая из них — это заголовок плюс шаблон с {text} в том месте, где будет находиться выделение, и каждая становится отдельной записью в контекстном меню. Несколько, которые быстро окупаются:

Заголовок: Ответьте простым английским
Подсказка: Перепишите следующее так, чтобы носитель языка мог понять. Удерживайте это в пределах 80 слов.

{text}
Заголовок: Найдите утверждение
Подсказка: Перечислите каждое фактическое утверждение в следующем тексте и отметьте те, которые нуждаются в источнике.

{text}

Эти задачи короткие и частые, поэтому это хорошее место для локальной модели: никаких затрат за запрос, никаких сетевых круговых поездок, и выделенный текст никогда не покидает ваш компьютер. Оставьте облачную модель для выделений, которые длинные или требуют реального рассуждения (плотный пункт контракта, блок незнакомого кода).

Встроенная подсказка Перевести переводит на английский. Если вы в основном читаете в другом направлении, отредактируйте встроенную подсказку или добавьте пользовательскую с вашим целевым языком.

Рабочий процесс 3: Задавайте вопросы о своих файлах

База знаний превращает PDF, документы Word, текст, CSV и файлы Markdown в нечто, с чем вы можете общаться. Перейдите в Настройки → Управление знаниями → Добавить новые знания, загрузите файлы и дождитесь обработки. Затем в поле ввода чата иконка знаний позволяет вам выбрать, какую коллекцию использовать.

Две вещи, которые стоит знать перед загрузкой большой папки:

  • Все обрабатывается и хранится в браузере. Page Assist предупреждает, что это может вызвать проблемы с производительностью при большом объеме данных. Начните с ограниченного набора файлов, а не с целого архива.
  • Качество извлечения зависит от модели встраивания больше, чем от модели чата. Если ответы продолжают упускать очевидные отрывки, попробуйте более сильную модель встраивания, прежде чем переключаться на модели чата.

Выбор между локальным и облачным здесь в основном зависит от документов. Внутренние файлы, которые вы не стали бы вставлять в веб-сервис, являются примером полностью локальной настройки: локальное встраивание плюс локальная модель чата. Публичные документы или документы продуктов могут идти в любом направлении.

Рабочий процесс 4: Позволить модели действовать на странице

Новые рабочие процессы выходят за рамки чтения. Две функции предоставляют модели инструменты:

  • Действие страницы — это отдельное сопутствующее расширение для браузеров на основе Chromium. С его помощью (значок курсора в боковой панели) модель может читать текущую вкладку и щелкать, печатать, прокручивать, навигировать и заполнять формы, шаг за шагом. Оно поставляется отдельно, потому что требует разрешения debugger в Chrome, которое большинству пользователей никогда не нужно предоставлять. Смотрите документацию по действиям страницы для настройки.
  • MCP позволяет вам подключать удаленные серверы MCP через Streamable HTTP с авторизацией по токену или OAuth 2.1. Серверы STDIO могут быть соединены с HTTP с помощью supergateway.

Оба имеют переключатель одобрения. "Требовать одобрение перед каждым действием" включено по умолчанию для действия страницы. MCP наоборот: инструменты работают без одобрения, пока вы не включите "Требовать одобрение перед запуском инструментов MCP", после чего каждый инструмент можно установить на Разрешить, Человек в цикле или Отключить. Держите одобрение для всего, что отправляет формы, отправляет сообщения или записывает данные.

Это тот рабочий процесс, где выбор модели имеет наибольшее значение. Использование многошаговых инструментов требует модели, которая надежно следует схемам инструментов и восстанавливается после неправильного шага, что на практике означает способную облачную модель. Небольшая локальная модель часто будет застревать или повторять действия.

Локально или в облаке: быстрый способ решить

  • Выберите локально когда текст является частным, задача короткая (переписывания, переводы, быстрые объяснения) или вы хотите нулевые предельные затраты.
  • Выберите облако когда страница длинная, вопрос требует рассуждений по всему документу или модель должна использовать инструменты.
  • Обратите внимание на то, что вы отправляете: сам Page Assist ничего не собирает, но все, что отправляется облачному провайдеру, покидает ваш компьютер. AIHubMix заявляет, что не хранит содержимое подсказок или ответов, только метаданные запросов, такие как количество токенов. У поставщиков моделей есть свои собственные политики хранения.

Поскольку обе модели находятся в одном и том же выборе моделей, переключение — это изменение выпадающего списка во время разговора, а не другое приложение.

Распространенные проблемы

  • 403 при общении с Ollama: CORS. Включите пользовательский URL-адрес источника в Настройках Ollama или установите OLLAMA_ORIGINS=*.
  • "Модель не найдена" после добавления поставщика: API-ключ неверен или не имеет баланса.
  • Нет AIHubMix в выпадающем списке: расширение старше 1.5.86. Обновите его или выберите Пользовательский и введите https://aihubmix.com/v1.
  • Модель встраивания не предлагается в Настройках RAG: она была сохранена как Модель чата. Добавьте ее снова с типом, установленным на Модель встраивания.
  • Чат с веб-сайтом дает поверхностные ответы: переключитесь на нормальный режим и используйте модель с более длинным контекстным окном.
  • Боковая панель не открывается: Opera и Arc не поддерживают это; используйте веб-интерфейс.

Часто задаваемые вопросы

Page Assist бесплатен? Да. Он лицензирован по MIT и бесплатен во всех поддерживаемых браузерах. Вы платите только в том случае, если подключаете платного облачного провайдера.

Мне нужен Ollama для использования Page Assist? Нет. Ollama является значением по умолчанию, но любая конечная точка, совместимая с OpenAI, работает, включая LM Studio, llama.cpp, vLLM и облачные шлюзы, такие как AIHubMix.

AIHubMix в выпадающем списке поставщиков? Да, с версии 1.5.86. Выберите его и вставьте свой API-ключ; базовый URL заполняется. В более старой версии сначала обновите расширение.

Отправляет ли Page Assist мои данные о просмотре куда-либо? Page Assist не имеет телеметрии и хранит историю локально. Содержимое страницы отправляется только той модели, с которой вы общаетесь. Если это облачная модель, содержимое отправляется этому провайдеру.

Какую модель встраивания мне использовать? Локально, nomic-embed-text через Ollama является документированной рекомендацией. Через AIHubMix выберите одну, такую как gemini-embedding-001, из того же списка моделей, что и модели чата, и сохраните ее с типом, установленным на Модель встраивания.

Могу ли я использовать разные модели для разных рабочих процессов? Да. Выбор модели осуществляется для каждого чата, поэтому вы можете оставить локальную модель для быстрых переписываний и переключиться на облачную модель для длинной страницы в одной и той же сессии.

Работает ли действие страницы в Firefox? Нет. Действие страницы доступно только в браузерах на основе Chromium, таких как Chrome, Brave и Edge, потому что оно зависит от протокола Chrome DevTools.

Источники