Локальный ИИ в браузере: запустите Ollama и общайтесь с любой веб-страницей
Запуск ИИ-моделей локально с помощью Ollama стал стандартным выбором для разработчиков и пользователей, заботящихся о конфиденциальности. А что если подключить эти модели прямо к браузеру и общаться с любой веб-страницей, которую вы читаете? Это руководство покажет, как это сделать.
Что такое Ollama?
Ollama — это инструмент с открытым исходным кодом для запуска больших языковых моделей на вашем компьютере. Он берёт на себя скачивание, квантизацию и обслуживание моделей через простой HTTP API. После установки выполните ollama serve, и ваши модели будут доступны по адресу 127.0.0.1:11434.
Выбор модели
В библиотеке Ollama — сотни моделей. Вот несколько популярных для начала:
- Gemma 4 — новейшая открытая модель Google. Несколько размеров, быстрая и универсальная.
- Qwen 3.5 — мультиязычная модель от Alibaba. Сильна в задачах на английском и китайском.
- Llama 4 — последняя модель Meta. Широкая поддержка сообщества и множество дообученных вариантов.
- Mistral Small — компактная и эффективная, подходит для повседневного чтения.
- DeepSeek-R1 — отличные способности к рассуждению, доступны дистиллированные версии для большинства оборудования.
Полный список с сортировкой по популярности — на ollama.com/search. Скачайте модель командой ollama pull <model>.
Не уверены, потянет ли ваш компьютер конкретную модель? Проверьте на canirun.ai — сервис определяет ваше оборудование и показывает подходящие модели.
Подключение Ollama к браузеру
Локальная ИИ-модель — это хорошо, но переключение между терминалом и браузером прерывает чтение. Идеальная настройка позволяет задавать вопросы о читаемой веб-странице прямо в браузере, используя локальные модели Ollama.
Настройка за 3 шага
- Установите Ollama — скачайте с ollama.com, затем загрузите модель:
ollama pull <model> - Запустите сервер — выполните
ollama serve(по умолчанию слушает на127.0.0.1:11434) - Установите PageGrok — из Chrome Web Store. Расширение автоматически обнаружит ваши работающие модели Ollama.
Готово. Откройте любую веб-страницу, нажмите на иконку PageGrok и начинайте задавать вопросы. ИИ читает содержимое страницы и отвечает с помощью вашей локальной модели — данные не покидают ваш компьютер.
Зачем использовать локальный ИИ для просмотра веб-страниц?
- Конфиденциальность — содержимое страниц и диалоги остаются на вашем устройстве. Данные не отправляются в облачные API.
- Без затрат на API — после загрузки модели инференс бесплатен. Никакой оплаты за токены.
- Без ограничений — задавайте сколько угодно вопросов, скорость зависит только от вашего оборудования.
- Работает офлайн — после скачивания модели интернет для ИИ-инференса не нужен.
- Полный контроль — выбирайте модель, настраивайте длину контекста, переключайтесь между моделями в любое время.
Сценарии использования
- Техническая документация — быстро разобраться в API-справочнике, не читая каждый абзац
- Анализ новостей — получить разные точки зрения на статью, отличить факты от мнений
- Изучение языков — спрашивать переводы и объяснения иностранного контента
- Корпоративное использование — подключиться к внутреннему Ollama-серверу для приватного ИИ-доступа команды
- Исследования — резюмировать длинные статьи, извлекать ключевые аргументы, задавать уточняющие вопросы
Что он читает
PageGrok обходит DOM текущей вкладки, включая Shadow DOM. Всё, что отрисовано как текст, доступно для чтения: статьи и документация, внутренние системы и панели за логином, страницы, которые фронтенд собирает уже после загрузки. Правило простое: если вы видите текст во вкладке, PageGrok его прочитает.
На насыщенных страницах помогает выбор области. Отметьте одну или несколько тематических зон — модель получит только их, а навигация, боковые панели и лишние разделы в обработку не попадут. Ответ точнее, ожидание короче.
С локальной моделью включите предзагрузку в настройках. Модель остаётся в памяти, поэтому вопрос после перерыва получает ответ сразу.
Частые вопросы
Как узнать, потянет ли мой компьютер конкретную модель?
Используйте canirun.ai — сервис определяет ваше оборудование и показывает, какие модели будут работать хорошо. Выберите GPU или чип, и вы увидите расчётную скорость и потребление памяти для сотен моделей.
Можно ли запустить Grok локально через Ollama?
xAI никогда не публиковала официальные веса Grok в библиотеке Ollama. Участники сообщества загружали сборки Grok-1 и Grok-2, но их происхождение не подтверждено, а Grok-1 — это модель на 314 миллиардов параметров (MoE), непрактичная на потребительском оборудовании. Если вам нужно сопоставимое качество локально, выберите актуальную крупную открытую модель из библиотеки Ollama — PageGrok работает со всеми.
PageGrok поддерживает все модели Ollama?
Да. PageGrok автоматически обнаруживает любую модель, загруженную в вашем локальном Ollama. Скачайте любую модель из библиотеки — она сразу появится в селекторе моделей PageGrok.
Мои данные в безопасности?
При использовании Ollama (режим по умолчанию) вся обработка происходит между вашим браузером и localhost. Содержимое страниц и диалоги никогда не передаются по сети. Подробнее — в политике конфиденциальности.
Попробуйте прямо на этой странице
Встроенный AI работает без настройки и без аккаунта. Также можно подключить собственную модель.