Anionex GitHub avatar

codex-deepseek-vision

Anionex

一个本地代理,在 Codex 中使用 DeepSeek 纯文本模型时,把粘贴的图片和 view_image 调用改写成视觉 API 的文字描述,让模型能“看图”,且无需额外 MCP、skills 或 CLI。

Stars

23

7 天增长

暂无数据

Fork 数

0

开放 Issue

0

开源协议

暂无数据

最近更新

2026-08-01

AI 仓库情报摘要
FR-AI / ANALYSIS

为什么值得关注

它用很小的自包含代理解决了实际集成缺口:让 Codex 的图像工具通过检查,代理在请求链路中把图片转成文字描述,DeepSeek 即可回答图片内容,并已在真实 Codex + DeepSeek 会话中验证。

适合谁使用

  • 已把 Codex 接入 DeepSeek 并需要视觉能力的桌面端用户
  • 使用 cc-switch 管理 Codex 模型目录的开发者
  • 希望在自己代理/网关中加入图片改写逻辑的开发者

典型使用场景

  • 让 DeepSeek 在 Codex 中描述 UI 截图或设计风格
  • 通过发送截图排查界面字段不一致等 bug
  • 同一个请求中多图并发描述并利用缓存降低重复调用
  • 把图像改写三件套并入已有代理,避免全量安装

项目优势

  • 多图并发调用视觉模型,N 张图接近 1 张图的延迟
  • 按图片 sha256 缓存描述,同一张图不重复调用视觉 API
  • 零依赖自包含,只需在 .env 配置 OpenAI 兼容视觉 API key
  • 同时支持粘贴图片(message.content)和 view_image(function_call_output.output)两种结构

使用前须知

  • 本质是文本描述而非真实多模态,描述质量取决于所配置的视觉模型
  • 必须配置视觉 API key 或本地 CLI 回退,否则 DeepSeek 仍会回复无法看图
  • 目前验证范围为 macOS + Codex 桌面 app;自定义网关需手动合并改写逻辑和 catalog image 模态

README 快速开始

快速开始

项目描述

一个可以让像deepseek-v4这样的纯文本模型, 在codex中无障碍调用内置看图工具(view_image)的方案

相关仓库与替代方案

根据分类、Topic 和编程语言匹配的相似项目。

lopopolo
精选
lopopolo GitHub avatar

harness-engineering

Harness Engineering is a methodology for improving coding agent outputs by carefully crafting the environment around them—providing curated context, tools, and executable constraints that encode an organization’s nonfunctional requirements and cumulative lessons.

AI 与机器学习AI 智能体
2,390
slvDev
精选
slvDev GitHub avatar

esp32-ai

A 28.9 million parameter language model runs on an $8 ESP32-S3 microcontroller entirely on-device, generating simple stories at about 9.5 tokens per second.

AI 与机器学习大语言模型
1,960
littledivy
精选
littledivy GitHub avatar

mimic

mimic captures traffic from any iOS or web app and automatically generates a Python client library that lets you call the app's API like a regular library.

AI 与机器学习
1,482