开发过程中主要用 DeepSeek V4 Flash 来写前端和后端,遇到几个有意思的事,发出来跟大家交流下。
DeepSeek V4 Flash 配合本地 Vision API 的多模态曲线方案
DeepSeek V4 Flash 便宜是真的便宜,但它不支持多模态。我的解决办法是:让它调用我本地的 Apple Vision API 做 OCR ,间接实现“看图”的能力。
具体场景是我给它一张设计稿截图,里面有很多小图标,要求它对着设计稿写代码,需要用到的图标自己抠出来。我以为 OCR 最多只能识别文字,结果它通过 Vision API 把每个小图标的位置、大小、形状都识别得相当精准,抠出来的图标直接能用。
这点真的出乎我意料。之前在 Trae 里用内置的多模态模型搞这个,折腾很久都没搞定,反而用 Flash + Vision API 这条曲线方案跑通了。有没有老哥也是用类似方案做多模态的?交流下经验。
Reasonix 的断连问题
Reasonix 我用了一段时间,效果确实可以,但遇到一个很烦的问题:一个会话用久了之后,经常性提示“正在重连”,后面就一直连不上,只能新建会话把上下文复制过去继续。已经确定不是我网络的问题,但还没定位到具体原因。
有没有用 Reasonix 的老哥遇到同样的情况?后来是怎么解决的?
大模型 API 延迟的问题
还有一个想听听大家看法的:现在大模型的 API 普遍响应慢。但用户其实等不了那么久,很多人测到一半就退出了,除了流式返回外,还有其他解决方案吗?
产品截图
产品叫「穿啥 - AI 穿搭测评与搭配推荐」,微信搜就能找到,欢迎体验和交流。






