← 返回目录
Skill/技能包

Anionex/agent-vision-toolkit

为纯文本 Agent 提供图片问答、OCR、截图理解与视觉定位能力的工具和技能包。

给纯文本 LLM agent 装上眼睛:图片问答、OCR、截图分析、视觉定位等一套视觉工具箱 + skill,并可无缝接入 Codex、Claude Code、OpenCode、Pi | Give text-only LLM agents vision: image Q&A, OCR, screenshot understanding, visual grounding, image-to-SVG - a vision toolkit & skill, with drop-in integration for Codex, Claude Code, OpenCode, Pi
agentagent-skillsclaude-codeclicodexcomputer-usedeepseekdeepseek-v4glmharness-engineeringkimillmmultimodalocropencodevisionvision-language-model
语言Python
Star292
分类Skill/技能包(skill)
状态活跃
收录时间2026-08-05
来源deepseek-harness-x