대부분의 AI 채팅 도구는 자체 탭에서 실행됩니다. 페이지에서 텍스트를 복사하고 채팅 창에 붙여넣은 다음, 답변을 다시 복사합니다. 페이지 어시스트 는 이러한 왕복을 없애줍니다: 현재 읽고 있는 페이지 옆에 사이드바에서 모델을 열 수 있는 오픈 소스 브라우저 확장 프로그램이며, 더 긴 대화를 위한 전체 탭 웹 UI도 제공합니다.
이것은 Ollama에서 실행되는 로컬 모델을 위한 프론트 엔드로 시작되었으며, 여전히 기본값입니다. 그러나 OpenAI 호환 엔드포인트를 모두 수용할 수 있어, 동일한 사이드바에서 노트북의 작은 모델과 클라우드의 프론티어 모델 간에 전환할 수 있습니다. 이 가이드는 사람들이 실제로 사용하는 네 가지 워크플로우를 설명하며, 각 워크플로우에 대해 어떤 기능을 활성화해야 하는지와 로컬 모델 또는 클라우드 모델이 더 적합한지에 대해 설명합니다.

페이지 어시스트 개요
아래의 수치는 2026년 10월 8일 기준 GitHub 리포지토리와 Chrome 웹 스토어 목록에서 가져온 것입니다.
- 라이센스 및 비용: MIT, 무료. 독립 개발자(n4ze3m)와 커뮤니티 기여자들이 만든 것입니다.
- 채택: 약 8,200개의 GitHub 스타; 300,000명의 사용자와 Chrome 웹 스토어에서 4.8의 평가를 받았습니다.
- 릴리스 속도: 주간. 2026년 10월 8일에 출시된 버전 1.5.86은 프리셋 제공자 목록에 AIHubMix를 추가했습니다.
- 브라우저: Chrome, Brave, Edge, Vivaldi, Firefox, LibreWolf, Zen. Opera와 Arc는 웹 UI는 지원하지만 사이드바는 지원하지 않습니다.
- 개인정보 보호: 텔레메트리가 없습니다. 채팅 기록, 설정 및 지식 기반 임베딩은 브라우저 저장소에 남습니다.
다음에서 설치하세요: Chrome 웹 스토어 (Firefox와 Edge는 각자의 애드온 페이지가 있습니다). 첫날에 배워야 할 두 가지 단축키는 다음과 같습니다: Ctrl+Shift+Y 는 사이드바를 열고, Ctrl+Shift+L 는 웹 UI를 엽니다.
어떤 워크플로우가 무엇을 필요로 하는가
| 워크플로우 | 기능 | 필요 | 모델 적합성 |
|---|---|---|---|
| 긴 페이지 읽기 | 웹사이트와 채팅 | 채팅 모델 | 긴 페이지에는 클라우드 모델이 적합 |
| 선택한 텍스트 재작성 | 코파일럿 메뉴 | 채팅 모델 | 로컬 모델이면 충분 |
| 자신의 파일에 질문하기 | 지식 기반 | 채팅 + 임베딩 | 둘 다 가능 |
| 모델이 행동하게 하기 | 페이지 액션 / MCP | 도구 호출 모델 | 클라우드 |
"모델 적합성"은 시작점이지 규칙이 아닙니다. 좋은 GPU에서 강력한 로컬 모델은 네 가지 행을 모두 커버할 수 있습니다.
일회성 설정: 로컬 모델 및 클라우드 제공자
로컬: Ollama가 자동으로 감지됩니다
Ollama가 localhost:11434 에서 실행되고 있다면, 페이지 어시스트는 구성 없이 이를 찾아내고 가져온 모든 모델을 나열합니다. 메시지를 보낼 때 403 오류가 발생하면 CORS 문제입니다: 설정 → Ollama 설정에서 사용자 정의 출처 옵션을 활성화하거나 OLLAMA_ORIGINS=* 로 설정하고 Ollama를 재시작하세요.
클라우드: 제공자 목록에서 AIHubMix 선택
AIHubMix는 페이지 어시스트의 내장 제공자입니다: 버전 1.5.86부터 OpenAI, DeepSeek 및 기타와 함께 제공자 드롭다운에 위치하므로 URL을 입력할 필요가 없습니다. 흐름은 페이지 어시스트의 OpenAI 호환 제공자 가이드를 따릅니다:
- AIHubMix 콘솔에서 API 키를 생성합니다 (해당 빠른 시작 에서 위치를 보여줍니다).
- 페이지 어시스트에서 설정 → OpenAI 호환 API → 제공자 추가를 엽니다.
- 드롭다운에서 AIHubMix 를 선택합니다. 기본 URL
https://aihubmix.com/v1가 자동으로 입력됩니다. - API 키를 붙여넣고 저장합니다.
- AIHubMix에서 가져온 모델 목록이 나타납니다. 검색하여 원하는 채팅 모델을 선택하고, 유형을 채팅 모델 로 두고 저장합니다.


키를 붙여넣기 전에 확인하고 싶다면, 한 번의 요청으로 충분합니다. 페이지 어시스트는 동일한 채팅 완성 엔드포인트를 통해 AIHubMix와 통신합니다:
curl https://aihubmix.com/v1/chat/completions \
-H "Authorization: Bearer $AIHUBMIX_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "auto", "messages": [{"role": "user", "content": "ping"}]}'
auto 는 AIHubMix의 실제 모델 이름입니다: 해당 LLM 라우터 는 요청마다 모델을 선택하며 (기본적으로 비용 우선, 품질 우선 및 지연 우선 변형이 있습니다) 실제로 사용된 모델에 대해 청구합니다. 선택을 원하지 않는 경우, 페이지 어시스트 모델 중 하나로 auto 를 추가하는 것은 합리적인 기본값입니다. 특정 모델을 선택하고 가격을 비교하고 싶을 때는 모델 목록 를 탐색하세요.
임베딩 모델: 네 가지 워크플로우 중 두 가지에 필요
지식 기반 및 웹사이트와의 채팅 기본 모드는 임베딩 모델이 필요합니다. 설정 → RAG 설정에서 설정하세요. 로컬에서는 페이지 어시스트가 Ollama를 통해 nomic-embed-text 를 추천합니다. AIHubMix를 통해 임베딩 모델은 채팅 모델과 동일한 모델 목록에서 가져옵니다. 제공자의 모델 목록을 다시 열고, 예를 들어 gemini-embedding-001 와 같은 임베딩 모델을 선택하고, 유형을 임베딩 모델 로 설정하여 저장합니다. 그러면 RAG 설정 드롭다운에 나타납니다.

워크플로우 1: 페이지를 떠나지 않고 긴 페이지 읽기
기사, 문서 페이지 또는 GitHub 이슈 스레드에서 사이드바를 열고 웹사이트와 채팅 기능을 켭니다. 이제 "여기서 세 가지 주요 주장은 무엇인가요?" 또는 "어떤 구성 옵션이 14번 댓글의 오류를 수정하나요?"라고 질문하면 모델이 현재 페이지에서 답변합니다.
페이지가 모델에 도달하는 두 가지 방법이 있으며, 그 차이가 중요합니다:
- 임베딩 모드 (기본값): 페이지가 청크로 나뉘고 임베딩되며, 관련 청크만 모델로 전송됩니다. 작은 컨텍스트 창에서 작동하지만 전체 페이지에 걸쳐 있는 내용을 놓칠 수 있습니다.
- 정상 모드: 페이지 텍스트가 직접 전송됩니다. 검색 설정에서 "임베딩 및 검색 사용"을 끄고 "전체 컨텍스트 모드의 최대 콘텐츠 크기"를 높입니다. 요약 및 "섹션 A와 섹션 D를 비교" 질문에 더 적합하지만 긴 컨텍스트 창을 가진 모델이 필요합니다.
두 번째 모드가 클라우드 모델이 필요한 이유입니다. 긴 사양이나 200개의 댓글 스레드는 큰 컨텍스트 클라우드 모델에서 편안하게 처리되며, 작은 로컬 모델은 페이지를 줄여야 할 것입니다.

알아두면 좋은 세 가지 관련 기능이 있습니다:
- @탭 멘션:
@를 입력하여 다른 열린 탭을 동일한 질문으로 가져올 수 있습니다. 예를 들어 두 개의 가격 페이지를 비교할 수 있습니다. 먼저 설정에서 활성화하세요. - YouTube 요약 버튼: YouTube 비디오 페이지에서 사이드바를 열고 비디오를 요약하는 선택적 버튼으로, 페이지의 전사에서 작업합니다.
- 비전: 콘텐츠가 대부분 이미지나 차트인 페이지의 경우, 눈 아이콘이 페이지의 스크린샷을 비전 가능 모델로 전송합니다. 비전이 없는 모델은 OCR로 대체할 수 있으며, 페이지 어시스트의 문서에서는 이를 기본적으로 설명합니다.
워크플로우 2: 텍스트 선택, 오른쪽 클릭, 완료
코파일럿 메뉴는 확장 프로그램에서 가장 빠른 워크플로우입니다. 페이지에서 텍스트를 선택하고 오른쪽 클릭한 후 페이지 어시스트 아래에서 작업을 선택합니다. 다섯 가지가 기본 제공됩니다: 요약, 재구성, 번역, 설명 및 사용자 정의.
실제 가치는 사용자 정의 코파일럿 프롬프트 (설정 → 프롬프트 관리 → 사용자 정의 코파일럿)에 있습니다. 각 프롬프트는 제목과 선택한 텍스트가 들어갈 {text} 가 포함된 템플릿으로 구성되며, 각 프롬프트는 자체 오른쪽 클릭 항목이 됩니다. 빠르게 효과를 볼 수 있는 몇 가지:
제목: 간단한 영어로 답변하기
프롬프트: 다음을 비원어민이 이해할 수 있도록 재작성하세요. 80단어 이하로 유지하세요.
{text}
제목: 주장 찾기
프롬프트: 다음 텍스트에서 각 사실적 주장을 나열하고 출처가 필요한 주장을 표시하세요.
{text}
이 작업들은 짧고 빈번하므로, 로컬 모델에 적합한 장소입니다: 요청당 비용이 없고, 네트워크 왕복이 없으며, 선택한 텍스트는 절대 기계에서 벗어나지 않습니다. 긴 선택이나 실제 추론이 필요한 경우 (밀집된 계약 조항, 익숙하지 않은 코드 블록 등) 클라우드 모델을 사용하세요.
내장된 번역 프롬프트는 영어로 번역합니다. 다른 방향으로 주로 읽는 경우, 내장된 프롬프트를 편집하거나 목표 언어로 사용자 정의 프롬프트를 추가하세요.
워크플로우 3: 자신의 파일에 대한 질문하기
지식 기반은 PDF, Word 문서, 텍스트, CSV 및 Markdown 파일을 채팅할 수 있는 것으로 변환합니다. 설정 → 지식 관리 → 새 지식 추가로 이동하여 파일을 업로드하고 처리될 때까지 기다립니다. 그런 다음 채팅 입력에서 지식 아이콘을 통해 사용할 컬렉션을 선택할 수 있습니다.

대용량 폴더를 업로드하기 전에 알아야 할 두 가지:
- 모든 것이 브라우저에서 처리되고 저장됩니다. 페이지 어시스트는 많은 데이터로 인해 성능 문제가 발생할 수 있다고 경고합니다. 전체 아카이브보다는 집중된 파일 세트로 시작하세요.
- 검색 품질은 채팅 모델보다 임베딩 모델에 더 의존합니다. 답변이 명백한 구절을 놓치는 경우, 채팅 모델을 변경하기 전에 더 강력한 임베딩 모델을 시도하세요.
여기서 로컬 대 클라우드 선택은 주로 문서와 관련이 있습니다. 웹 서비스에 붙여넣지 않을 내부 파일은 완전히 로컬 설정의 경우입니다: 로컬 임베딩과 로컬 채팅 모델. 공개 문서나 제품 문서는 어느 쪽으로든 갈 수 있습니다.
워크플로우 4: 모델이 페이지에서 행동하게 하기
가장 최신의 워크플로우는 읽기를 넘어섭니다. 두 가지 기능이 모델에 도구를 제공합니다:
- 페이지 액션 은 크로미움 브라우저를 위한 별도의 동반 확장입니다. 이를 활성화하면 (사이드바의 커서 아이콘), 모델은 현재 탭을 읽고 클릭, 입력, 스크롤, 탐색 및 양식을 채울 수 있습니다. 이는 Chrome의
debugger권한이 필요하기 때문에 별도로 제공됩니다. 대부분의 사용자는 이를 부여할 필요가 없습니다. 설정 방법은 페이지 액션 문서 에서 확인하세요. - MCP 는 원격 MCP 서버를 Streamable HTTP를 통해 연결할 수 있게 해주며, 베어러 토큰 또는 OAuth 2.1 인증을 사용합니다. STDIO 서버는 supergateway를 통해 HTTP로 브리징할 수 있습니다.
두 가지 모두 승인 스위치가 있습니다. "각 작업 전에 승인 필요"는 페이지 액션의 기본값으로 활성화되어 있습니다. MCP는 반대입니다: 도구는 "MCP 도구 실행 전에 승인 필요"를 활성화할 때까지 승인 없이 실행됩니다. 이후 각 도구는 허용, 사람 개입 또는 비활성화로 설정할 수 있습니다. 양식을 제출하거나 메시지를 보내거나 데이터를 작성하는 모든 작업에 대해 승인을 유지하세요.

이 워크플로우에서 모델 선택이 가장 중요합니다. 다단계 도구 사용은 도구 스키마를 신뢰성 있게 따르고 잘못된 단계에서 복구할 수 있는 모델이 필요하며, 이는 실제로 능력 있는 클라우드 모델을 의미합니다. 작은 로컬 모델은 종종 작업이 중단되거나 반복됩니다.
로컬 또는 클라우드: 빠른 결정 방법
- 로컬 선택: 텍스트가 개인적이고, 작업이 짧으며 (재작성, 번역, 간단한 설명), 추가 비용이 없기를 원할 때.
- 클라우드 선택: 페이지가 길고, 질문이 전체 문서에 걸쳐 추론이 필요하거나, 모델이 도구를 사용해야 할 때.
- 보내는 내용을 주의하세요: 페이지 어시스트 자체는 아무것도 수집하지 않지만, 클라우드 제공자에게 전송된 모든 내용은 기계에서 나갑니다. AIHubMix는 프롬프트나 응답 내용을 저장하지 않으며, 요청 메타데이터(예: 토큰 수)만 저장한다고 명시합니다. 상위 모델 공급자는 각자의 보존 정책을 가지고 있습니다.
두 종류의 모델이 동일한 모델 선택기에서 위치하므로, 대화 중간에 드롭다운 변경으로 전환할 수 있으며, 다른 앱이 아닙니다.
일반적인 문제
- Ollama와 채팅할 때 403 오류: CORS. Ollama 설정에서 사용자 정의 출처 URL을 활성화하거나
OLLAMA_ORIGINS=*로 설정하세요. - 제공자를 추가한 후 "모델을 찾을 수 없음": API 키가 잘못되었거나 잔액이 없습니다.
- 드롭다운에 AIHubMix가 없음: 확장 프로그램이 1.5.86보다 오래되었습니다. 업데이트하거나 사용자 정의를 선택하고
https://aihubmix.com/v1를 입력하세요. - RAG 설정에서 임베딩 모델이 제공되지 않음: 채팅 모델로 저장되었습니다. 유형을 임베딩 모델로 설정하여 다시 추가하세요.
- 웹사이트와 채팅할 때 얕은 답변: 정상 모드로 전환하고 긴 컨텍스트 창을 가진 모델을 사용하세요.
- 사이드바가 열리지 않음: Opera와 Arc는 이를 지원하지 않으며, 웹 UI를 사용하세요.
자주 묻는 질문
페이지 어시스트는 무료인가요? 네. MIT 라이센스이며 모든 지원되는 브라우저에서 무료입니다. 유료 클라우드 제공자에 연결할 경우에만 비용이 발생합니다.
페이지 어시스트를 사용하려면 Ollama가 필요한가요? 아니요. Ollama는 기본값이지만, LM Studio, llama.cpp, vLLM 및 AIHubMix와 같은 클라우드 게이트웨이를 포함하여 모든 OpenAI 호환 엔드포인트가 작동합니다.
제공자 드롭다운에 AIHubMix가 있나요? 네, 버전 1.5.86부터 있습니다. 선택하고 API 키를 붙여넣으면 기본 URL이 자동으로 입력됩니다. 이전 버전에서는 먼저 확장 프로그램을 업데이트하세요.
페이지 어시스트가 내 브라우징 데이터를 어디론가 전송하나요? 페이지 어시스트는 텔레메트리가 없으며 기록을 로컬에 저장합니다. 페이지 콘텐츠는 채팅하는 모델에만 전송됩니다. 클라우드 모델인 경우, 콘텐츠는 해당 제공자로 전송됩니다.
어떤 임베딩 모델을 사용해야 하나요? 로컬에서는 Ollama를 통해 nomic-embed-text가 문서화된 추천입니다. AIHubMix를 통해서는 채팅 모델과 동일한 모델 목록에서 gemini-embedding-001과 같은 모델을 선택하고, 유형을 임베딩 모델로 설정하여 저장하세요.
다른 워크플로우에 대해 다른 모델을 사용할 수 있나요? 네. 모델 선택기는 채팅별로 다르므로, 빠른 재작성을 위해 로컬 모델을 유지하고 같은 세션에서 긴 페이지에 대해 클라우드 모델로 전환할 수 있습니다.
페이지 액션은 Firefox에서 작동하나요? 아니요. 페이지 액션은 Chrome, Brave 및 Edge와 같은 크로미움 기반 브라우저에서만 사용할 수 있으며, Chrome DevTools 프로토콜에 의존하기 때문입니다.



