工具与能力
modlens:给模型装上眼睛
首个视觉插件:粘贴图片,视觉引擎返回结构化 JSON 证据,模型基于证据作答。
配置片段
# 锁版本安装——pnpm 会对 24 小时内新发布的版本延迟解析
npx -y @deepseek-ai/dsh plugin --profile web add @liustack/modlens@3.18.1密钥完全自持:Gemini、OpenAI 兼容或 Claude CLI 引擎都在本地配置,不会发往任何第三方代理。
核心代码
三步数据流是拆解亮点:图片进 -> 结构化证据出 -> 模型作答。
// 1. 粘贴图片 -> 2. 视觉引擎返回 JSON 证据
const evidence = await visionEngine.analyze(image, {
ocr: true,
layout: true,
entities: true,
});
// 3. 证据作为 tool 结果交给模型推理
return { ok: true, evidence };OCR 转录、阅读顺序版面、实体关系都以结构化 JSON 返回,而不是散文——正是推理模型能直接消费的形态。
为何高分
- 先发优势:生态首个视觉插件(857 到约 2444 star)。
- 设计:外部能力返回结构化证据,是 tool 类插件的标准范式。
- 隐私:密钥留在本机,零代理转发。