昨天打听到一个MCP叫做vision-bridge,可以单独配多模态的模型进去,从而让Deepseek具备一些视觉功能。测试了一下,实际的效果相当于正常人用语言给瞎子描述图片,细节丢失的很厉害,很难说是有用。
来都来了 发表于 2026-8-5 08:45
昨天打听到一个MCP叫做vision-bridge,可以单独配多模态的模型进去,从而让Deepseek具备一些视觉功能。测试 ...
一直都是这样…我最后放弃了是因为这样信息损失其实也挺严重
—— 来自 S1Fun
gpt20x一周能用多少亿啊
论坛助手,iPhone
CCauchy 发表于 2026-8-5 09:13
gpt20x一周能用多少亿啊
论坛助手,iPhone
我3个月烧了400多亿
来都来了 发表于 2026-8-5 08:45
昨天打听到一个MCP叫做vision-bridge,可以单独配多模态的模型进去,从而让Deepseek具备一些视觉功能。测试 ...
现在网页端的视觉模式是用DeepSeek-ViT这个内部模型对Deepseek V4f翻译来实现的,而且其视觉理解能力还可以。
所以……也许伴随官方harness发布,DeepSeek-ViT作为其MCP就对外开放了呢~~
anysearch,每天可以搜1000次。效果我不太确定,我搜索用的不多。
本帖最后由 朋友费小号 于 2026-8-5 09:55 编辑
我是个低俗且普通的小白用户,之前一直用酒馆,但是现在感觉酒馆太麻烦了,有没有什么更简单好使的api调动方法?
cherry studio和chatbox吗?
话说现在用pro模型的1m上下文还需要写成deepseek-v4-pro后面跟个的形式吗
0WHan0 发表于 2026-8-5 09:40
话说现在用pro模型的1m上下文还需要写成deepseek-v4-pro后面跟个的形式吗
一直都不用,以前加上1m后缀是写给claudecode看的,接口本身不需要这个
朋友费小号 发表于 2026-8-5 09:37
我是个低俗且普通的小白用户,感觉酒馆太麻烦了,有没有什么更简单好使的api调动方法?
cherry studio吗? ...
https://sta1n156.github.io/RP-Hub/网页酒馆,虽然有一些不好的风评,且功能不全但是作为入门体验还是没问题
—— 来自 HONOR PTP-AN70, Android 16, 鹅球 v3.5.99
serj005 发表于 2026-8-5 09:46
一直都不用,以前加上1m后缀是写给claudecode看的,接口本身不需要这个
那在claudecode里用flash模型也要加吗
0WHan0 发表于 2026-8-5 09:49
那在claudecode里用flash模型也要加吗
flash不用,因为官方配置里没有加,这方面按官方的接入指南来就行了
朋友费小号 发表于 2026-8-5 09:37
我是个低俗且普通的小白用户,之前一直用酒馆,但是现在感觉酒馆太麻烦了,有没有什么更简单好使的api调动 ...
手机上可以用tavo rikkahub chatbox
—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
又发了一次harness招募,这次明确要MCP 等生态建设的,且提到了“发布”,那么应该是有进展了吧
Re:Source
spaceblue 发表于 2026-8-5 09:21
我3个月烧了400多亿
用到100%了吗?
论坛助手,iPhone
现在订阅用得完的话是不是gpt最好
论坛助手,iPhone
CCauchy 发表于 2026-8-5 10:34
现在订阅用得完的话是不是gpt最好
论坛助手,iPhone
那肯定的
—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
V4F codex经常搜网页的时候卡死循环 最迷惑的是东西都搜完可也给出内容了还在说自己没网络权限 这是想逃逸来着
而且偶尔会有回答·这个问题很有趣 这个问题有意思 然后开始长考并且缓存命中率暴跌
deekseek没有给codex做过适配,还是在claude code里用吧
本帖最后由 serj005 于 2026-8-5 11:04 编辑
reasonix今天加了ds官方的Anthropic API和responses API服务端搜索功能,不用额外加第三方搜索插件了。不过官方搜索对上下文消耗挺大的,搜了个新闻就用了7%上下文长度
CCauchy 发表于 2026-8-5 10:18
用到100%了吗?
论坛助手,iPhone
这两个月重置太多,肯定没用满。但是20X的量真的很大,lunamax相当于不要钱除了慢了点,还可以用网页版的Pro,这个思考模式是最久的。
我在 Kelivo 里面配置了搜索,然后 v4f 会疯狂搜索,有时候搜索一两百个页面,然后这些网页会全部进入上下文,发第二个消息的时候,就提示我1M上下文用完了
我看harness还在招人内测,现在扩大招人范围为了更快提供的接入支持,感觉这周有点悬啊
不发pro,那只能继续苦一苦flash了
我有个问题,如果在第三方harness上使用v4f,三种api有能力上的区别吗?oai的c api和r api,还有a/的端口
此誓的守望 发表于 2026-8-5 11:29
我有个问题,如果在第三方harness上使用v4f,三种api有能力上的区别吗?oai的c api和r api,还有a/的端口
...
有的,官方的API里后两种自带原生搜索,opencode go好像没区别……
看样子pro ga应该是准备好了,就看harness了,能不能搞快点啊
要一鸣惊人吗,必须打爆fable5才行
不然别搓专武了,直接发吧
我急啊
OpenCode go在叫苦了
zzxzz1019 发表于 2026-8-5 11:36
OpenCode go在叫苦了
真没卡了呀 Re:Source
朋友费小号 发表于 2026-8-5 09:37
我是个低俗且普通的小白用户,之前一直用酒馆,但是现在感觉酒馆太麻烦了,有没有什么更简单好使的api调动 ...
cherry
可以部分实现酒馆功能
并且还可以写写材料
—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99
4F玩酒馆思考的好慢啊,感觉每次出文要花个五六分钟。用了几个预设都一样,官API
有个爬虫插件不用注册1000次次数每月,不是t开头的挺好用的f开头的人
论坛助手,iPhone
矮矮人 发表于 2026-8-5 11:47
4F玩酒馆思考的好慢啊,感觉每次出文要花个五六分钟。用了几个预设都一样,官API ...
因为现在4fga的雷霆大思考会把你预设的每一个要求都检查一遍啊,并且是现在思维链里面先打一个草稿检查一遍然后再在思维链里面修改稿然后再检测一遍,所以如果你的预设比较复杂,它就会不停的检查,特别是字数,建议设置成自适应字数。不过优点是特别遵循预设要求。
flash生成的midi音乐,出乎意料的不错
提示词如下
实现一个Artcore曲目,名字叫FINALLY,时长3分钟,用于游戏的BOSS战斗
前期含有悲伤的起调,像是回忆起旅途中的悲欢离合,然后渐入佳境,所有的回忆都化为力量,高潮部分将情绪烘托到行云流水的战斗高潮和快意恩仇的感觉,结尾回味悠长
乐器需要使用音色表中标注的高级乐器
强调弦乐+吉他+贝斯+澎湃的鼓配合
旋律扣人心弦
调式全使用中国五声调式
矮矮人 发表于 2026-8-5 11:47
4F玩酒馆思考的好慢啊,感觉每次出文要花个五六分钟。用了几个预设都一样,官API ...
不至于吧,我顶多思考30s,梦鲸思客那个预设。同样官方api。 Re:Source
opencode v4f最近每天下午5点左右开始持续崩溃
—— 来自 HONOR MAA-AN10, Android 16, 鹅球 v3.5.99-debug
朋友费小号 发表于 2026-8-5 09:37
我是个低俗且普通的小白用户,之前一直用酒馆,但是现在感觉酒馆太麻烦了,有没有什么更简单好使的api调动 ...
rikkahub,安卓上的
朋友费小号 发表于 2026-8-5 09:37
我是个低俗且普通的小白用户,之前一直用酒馆,但是现在感觉酒馆太麻烦了,有没有什么更简单好使的api调动 ...
可以试试hermes,本质上是个agent,上手之后他可以帮你实现大部分酒馆功能
此誓的守望 发表于 2026-8-5 11:29
我有个问题,如果在第三方harness上使用v4f,三种api有能力上的区别吗?oai的c api和r api,还有a/的端口
...
纯性能上没区别,只是Anthropic API和responses API会多个网页搜索功能,但是大部分工具都没适配后后两者的搜索,原生调用应该就只有cc和reasonix支持,其他要用搜索得加插件