Навыки gemini-computer-use
📦

gemini-computer-use

Ревизия содержимого r2 Высокий риск 🔑 Переменные окружения🌐 Доступ к сети⚙️ Внешние команды

Автоматизируйте задачи в браузере с помощью Gemini

Автоматизацию браузера с моделями зрения сложно безопасно настроить. Этот навык предоставляет цикл Playwright для действий Gemini Computer Use и подтверждений.

Поддерживает: Claude Codex Code(CC)
⚠️ 38 Плохо

Установить с помощью моего Агента

Скопируйте этот запрос в своего Агента. Он содержит каноническую страницу Skill и манифест.

Запрос агента
Review the Skillstore skill "gemini-computer-use" from https://skillstore.io/skills/am-will-gemini-computer-use.md and its manifest at https://skillstore.io/api/skills/am-will-gemini-computer-use/manifest. Verify the artifact. Stop and obtain explicit user consent before installing or changing files.

Ваш Агент по-прежнему должен показать план и запросить все подтверждения, требуемые политикой безопасности.

Ресурсы для AI-агентов

Используйте эти ссылки, когда AI-агенту, crawler или script нужен чистый контекст вместо полной страницы.

Протестировать

Использование «gemini-computer-use». Запустите базовую задачу проверки сайта на публичной странице.

Ожидаемый результат:

Агент открывает страницу, проверяет видимый контент, сообщает основной результат и останавливается после достижения лимита ходов или финального ответа.

Использование «gemini-computer-use». Проверьте, готов ли браузерный агент к аутентифицированному рабочему процессу.

Ожидаемый результат:

  • Используйте изолированный профиль браузера перед входом в аккаунт.
  • Исключите сочетания клавиш и действия перетаскивания, если они не требуются.
  • Подтвердите, как обрабатываются скриншоты и URL, прежде чем вводить конфиденциальные данные.

Использование «gemini-computer-use». Добавьте ограничения действий для исследовательской задачи только для чтения.

Ожидаемый результат:

Рекомендуемая настройка оставляет доступными навигацию, ожидание и прокрутку, исключая ввод текста, сочетания клавиш и действия перетаскивания.

Аудит безопасности

Высокий риск

All 35 static findings are false positives caused by empty credential placeholders, normal environment configuration, keyboard APIs, Markdown formatting, and example URLs. No embedded secret, certificate access, Ruby execution, or shell backtick execution is present. The agent still has high-impact design risks because it sends browser screenshots to Gemini and executes model-directed browser actions with limited local policy enforcement.

4
Просканировано файлов
475
Проанализировано строк
0
Пункты проверки
0
Ложные срабатывания проигнорированы

Подтверждённые проблемы безопасности (3)

Высокий
Indirect Prompt Injection Can Drive Browser Actions
Webpage screenshots are sent to Gemini, and returned function calls are executed. Hostile page content can influence actions when model safety metadata requests no confirmation.
The loop directly combines untrusted page screenshots with model-directed function execution. Confirmation depends on a safety field supplied in the model response.
Высокий
Browser Screenshots and URLs Leave the Local Environment
Each function response includes the current URL and full screenshot for Gemini. Pages may expose personal, confidential, or internal information without redaction.
The code explicitly captures a complete screenshot and current URL, places them in function responses, and sends the conversation to Gemini.
Средний
Dependencies Are Installed Without Version Pins
The quick start installs Google GenAI, Playwright, and Chromium without tested version constraints or integrity controls.
The documented installation commands name packages without versions and download a browser binary without an integrity workflow.
Поделиться и цитировать этот отчет

Делитесь версионным отчетом об оценке, нейтральным значком, встраиваемой карточкой и цитатами. Skillstore публикует доказательства, не решая, безопасен ли этот Skill.

Открыть версионный отчет
Оценка безопасности

Копировать ссылку на отчёт

https://skillstore.io/skills/am-will-gemini-computer-use/audits/5?utm_source=security_passport&utm_medium=share&utm_campaign=versioned_report

Значок Markdown

[![Skillstore security assessment](https://skillstore.io/badges/skills/am-will-gemini-computer-use/security.svg)](https://skillstore.io/skills/am-will-gemini-computer-use?utm_source=security_passport_badge)

Значок HTML

<a href="https://skillstore.io/skills/am-will-gemini-computer-use?utm_source=security_passport_badge"><img src="https://skillstore.io/badges/skills/am-will-gemini-computer-use/security.svg" alt="Skillstore security assessment" loading="lazy"></a>

Встраиваемая карточка

<iframe src="https://skillstore.io/embed/skills/am-will-gemini-computer-use.html" title="Skillstore Security Assessment" sandbox="allow-popups allow-popups-to-escape-sandbox" loading="lazy" referrerpolicy="no-referrer" width="420" height="180"></iframe>
Академические ссылки (APA · BibTeX · CFF)

Цитата APA

am-will. (2026). gemini-computer-use security audit report (audit version 5) [Author version unspecified]. Skillstore. https://skillstore.io/skills/am-will-gemini-computer-use/audits/5

Цитата BibTeX

@techreport{am-will-am-will-gemini-computer-use-2026, author = {am-will}, title = {gemini-computer-use security audit report (audit version 5)}, institution = {Skillstore}, year = {2026}, number = {5}, url = {https://skillstore.io/skills/am-will-gemini-computer-use/audits/5}, note = {Author version unspecified} }

CITATION.cff

cff-version: 1.2.0 message: "If you use this Skill, cite its author and this versioned security audit report." title: "gemini-computer-use security audit report (audit version 5)" version: "unspecified" type: report authors: - name: "am-will" date-released: "2026-07-23" url: "https://skillstore.io/skills/am-will-gemini-computer-use/audits/5" identifiers: - type: other value: "skillstore:am-will-gemini-computer-use:audit:5" description: "Skillstore immutable audit report identifier"

Оценка Skillstore

Почему такая оценка Достоверность доказательств: Средний
64
Архитектура
85
Сопровождаемость
87
Контент
70
Сообщество
91
Соответствие спецификации

Что вы можете построить

Прототипирование Computer Use Agent

Создайте рабочий цикл управления браузером перед добавлением собственной бизнес-логики или интеграции с продуктом.

Изучение автоматизации веб-задач

Проверьте, как Gemini обрабатывает навигацию, чтение страниц, клики, ввод текста и прокрутку в контролируемом браузере.

Оценка средств контроля безопасности браузера

Изучите исключения действий, подтверждения безопасности и рекомендации по песочнице перед использованием AI-управления браузером.

Попробуйте эти промпты

Запустите базовую задачу в браузере
Используйте этот навык, чтобы настроить Gemini Computer Use и выполнить простую задачу в браузере для https://example.com.
Ограничьте рискованные действия
Настройте браузерного агента так, чтобы блокировать действия перетаскивания и сочетания клавиш, затем выполните короткую задачу навигации.
Проверьте обработку безопасности
Проверьте поведение подтверждений безопасности в этом навыке и порекомендуйте изменения для использования на сайтах с аутентификацией.
Расширьте цикл агента
Расширьте цикл агента, чтобы логировать каждое действие, URL и решение по безопасности без сохранения скриншотов или ключей API.

Лучшие практики

  • Запускайте браузер в изолированном профиле или контейнере для каждой тестовой сессии.
  • Используйте --exclude, чтобы удалить действия, которые не требуются текущей задаче.
  • Храните ключ API Gemini в окружении и не коммитьте локальные env-файлы.

Избегать

  • Запуск агента в производственных аккаунтах без этапа проверки.
  • Разрешение неограниченного ввода текста, сочетаний клавиш или действий перетаскивания для чувствительных рабочих процессов.
  • Сохранение скриншотов, URL, логов или файлов окружения, содержащих приватные данные.

Часто задаваемые вопросы

Включает ли этот навык рабочий скрипт агента?
Да. Он включает Python-скрипт, который соединяет Gemini Computer Use с циклом браузера Playwright.
На какую модель ориентирован скрипт?
Скрипт ориентирован на preview-модель Gemini 2.5 Computer Use, указанную в источнике.
Требуется ли ключ API?
Да. Скрипт считывает GEMINI_API_KEY из окружения перед созданием клиента Google GenAI.
Может ли он работать без отображения окна браузера?
Да. Скрипт поддерживает headless mode через свою опцию командной строки.
Блокирует ли он рискованные действия автоматически?
Он запрашивает подтверждение только тогда, когда Gemini возвращает решение по безопасности. Используйте исключения действий для более строгого контроля.
Может ли он автоматизировать настольные приложения?
Нет. Включенная реализация ограничена автоматизацией браузера через Playwright.

Сведения для разработчиков

Автор

am-will

Лицензия

MIT

Ревизия Skillstore

r2

Примечание о версии

Автор не указал версию.

Ссылка

31bc7611b504c197d3e993aef7943461c871616f

Актуальность поддержки

26.07.2026

Использование

15 загрузок · 198 просмотров

Структура файлов

Больше от am-will

Показать все
📦

vercel-react-best-practices

79

Оптимизация приложений React и Next.js

Приложения React и Next.js часто страдают от каскадов асинхронных операций, больших бандлов и лишних рендеров. Этот навык дает агентам конкретные правила производительности Vercel для более безопасного рефакторинга.

Кодинг и разработка Просмотр
📦

swarm-planner

78

Планирование параллельных рабочих процессов агентов

Крупные изменения в коде трудно распределять между несколькими агентами без ошибок в зависимостях. Этот навык создает планы реализации с учетом зависимостей, включая исследование, уточнение, проверку и группы параллельного выполнения.

Кодинг и разработка Просмотр
📦

planner

78

Планирование поэтапной реализации

Сложная работа с кодом может становиться неясной, когда отсутствуют объем работ, зависимости и шаги проверки. Этот навык создает поэтапные планы со спринтами, атомарными задачами и контрольными точками верификации.

Продуктивность Просмотр
📦

plan-harder

78

Создание поэтапных планов реализации

Сложные задачи разработки ПО могут срываться, когда объем работ, последовательность и проверка результата неясны. Этот навык создает поэтапные планы с атомарными задачами, контрольными точками, рисками и этапами проверки.

Кодинг и разработка Просмотр
Показать все
📦

prompt-optimization

82

Оптимизация промптов LLM и инструкций для агентов

от 89jobrien

Слабые промпты приводят к непоследовательным результатам модели и замедляют разработку ИИ-функций. Этот навык помогает структурировать промпты, примеры, ограничения и форматы вывода для Claude, Codex и Claude Code.

Продуктивность Просмотр
📦

playwright-testing

86

Улучшение покрытия тестами Playwright

от C0ntr0lledCha0s

Наборы тестов Playwright могут становиться нестабильными, когда конфигурация, локаторы и фикстуры непоследовательны. Этот навык дает практические шаблоны для надежных браузерных тестов, отладки и переиспользуемых page objects.

Кодинг и разработка Просмотр
📦

webapp-testing

85

Создавайте тесты веб-приложений на Playwright

от AutumnsGrove

Ручное тестирование в браузере занимает много времени и часто пропускает регрессии в формах, на разных устройствах и при разных состояниях сети. Этот навык помогает Claude, Codex и Claude Code создавать практичные тесты Playwright для реальных веб-сценариев.

Кодинг и разработка Просмотр
📦

playwright-best-practices

79

Повышение надежности тестов Playwright

от 0xBigBoss

Тесты Playwright в рабочих процессах агентов часто становятся нестабильными, медленными и шумными. Этот навык предоставляет краткие паттерны для локаторов, проверок, фикстур, повторного использования аутентификации, сетевых моков и компактных репортеров.

Кодинг и разработка Просмотр
📦

e2e-testing

78

Планирование рабочих процессов E2E-тестирования с Playwright

от sickn33

Командам нужны понятные шаги для надежного браузерного тестирования. Этот навык помогает с настройкой Playwright, проектированием тестов, визуальными проверками, покрытием браузеров и интеграцией с CI.

Кодинг и разработка Просмотр