#811 · 主分类: AI代理与自动化

gemini-skill

automation browser-automation drawing gemini mcp mcp-client mcp-server openclaw openclaw-agent openclaw-skills openclawskill

gemini画图MCP和技能,通过浏览器使用,可用于openclaw或任何支持MCP的agent。٩(๑>◡<๑)۶

项目最后更新:08/01/26

GitHub Stars

830

Forks数量

119

贡献者数量

4

许可证

MIT

收录理由

只会对话的智能体总像缺了一条腿,这个项目恰好补上了那部分——它让智能体通过浏览器直接调用 Gemini 网页版的生图和对话能力,不必额外购买独立的 API 套餐。项目以标准 MCP 服务器加技能的形式运行,任何支持 MCP 的客户端都能驱动一个真实登录的浏览器会话,底层走 CDP 协议。浏览器守护进程把那些琐碎又麻烦的环节都包揽了:维持会话不中断、绕过自动化检测、下载原图、去掉水印。想给现有智能体加上 Gemini 画图和图片提取,这几乎是最省事的接入方式。另外它还附带一个兼容 OpenAI 接口的 Atlas Cloud 提供商,如果你想把纯 API 路线和浏览器自动化做个对比,也能直接切换。需要留意的是,它要求本地装有浏览器并登录 Google 账号,所以更适合能接受这种环境配置的场景。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目