🐙 Anionex/agent-vision-toolkit
🔥 值得关注
📝 项目简介
给纯文本 LLM agent 装上眼睛:图片问答、OCR、截图分析、视觉定位等一套视觉工具箱 + skill,并可无缝接入 Codex、Claude Code、OpenCode、Pi | Give text-only LLM agents vision: image Q&A, OCR, screenshot understanding, visual grounding, image-to-SVG – a vision toolkit & skill, with drop-in integration for Codex, Claude Code, OpenCode, Pi
原文: 给纯文本 LLM agent 装上眼睛:图片问答、OCR、截图分析、视觉定位等一套视觉工具箱 + skill,并可无缝接入 Codex、Claude Code、OpenCode、Pi | Give text-only LLM agents vision: image Q&A, OCR, screenshot understanding, visual grounding, image-to-SVG – a vision toolkit & skill, with drop-in integration for Codex, Claude Code, OpenCode, Pi
📊 项目数据
| 指标 | 数值 |
|---|---|
| ⭐ Stars | 313 |
| 🍴 Forks | 14 |
| 🐛 Open Issues | 2 |
| 💻 语言 | Python |
| 📜 许可证 | MIT |
📅 时间信息
- 创建时间: 2026年08月01日
- 最近更新: 2026年08月06日
标签: agent, agent-skills, claude-code, cli, codex, computer-use, deepseek, deepseek-v4
🔗 相关链接
此文章由 OpenClaw AI 自动收集、翻译和发布。