老叶

老叶

丢失193个BTC的男人丨资深程序员丨AI爱好者丨喜欢打破垄断做免费软件,传统大厂恨的牙痒痒的男人。本账号推文信息不做为投资建议。

0关注中
0粉丝

动态

老叶1999.eth
老叶1999.eth
DeepSeek 曾经对她爱搭不理,现在的她你有点高攀不起!
老叶1999.eth
老叶1999.eth
grok 4.6 也来了! 它几乎跟 DeepSeek-V4-Pro-0813 同时发布! 说实话看到 grok 4.6 的参数,我还是挺激动的!grok 4.5 就已经是我日常最喜欢的模型之一了,因为它的速度真的非常快,而且他没有那么多限制,非常适合日常使用。 然而这次的 grok 4.6 直接拉到与头部两家旗舰模型很接近的参数,并且拥有比他们更快的速度。 老马的 grok 这次是真的上桌了!我觉得它真的能顶替 gemini 成为新的御三家选手!
老叶1999.eth
老叶1999.eth
官宣了!DeepSeek-V4-Pro-0813 马上来了! 就在刚刚,DeepSeek 官网的文档已经把 DeepSeek-V4-Pro 正式版的模型ID公布出来了,根据上面的日期,定档时间应该就是 8月13日。 并且 V4-Pro 正式版,也开始支持 Responses API,可以直接在 codex 上面使用,而不需要任何转换。
老叶1999.eth
老叶1999.eth
炸了,OpenAI 这波有点狠。 Pro x20 套餐刚重置完额度,我一看直接傻眼了 周限额度疑似只剩之前的 1/3。 不是小砍,是直接砍到肉里。 最近两天 OpenAI 的模型访问一直在过载,动不动就卡、限流、排队。 所以现在就两个可能: 要么是额度配置出 Bug 了, 要么就是 OpenAI 真扛不住了,开始主动收紧 Pro 用户额度。 如果是后者,那 Pro x20 这个套餐的性价比就得重新算了。 不知道是不是个例。 有 x20 的兄弟看下自己额度,看看是不是也被砍了。
老叶1999.eth
老叶1999.eth
Tibo 在说谎!经过多轮 PRO x20 套餐实测下来 GPT-5.6 Luna 实际在订阅额度中的降价仅40%。 我们单独跑 luna 模型的 PRO x20 账户周限直接比 直接跑 sol 模型的少了一倍。
Tibo
Tibo
有些好心人显然误解了,但GPT-5.6 Luna降价80%并不是临时的噱头,而是永久性的。效率提升不会消失。幸运的是。
老叶1999.eth
老叶1999.eth
有网友说,为什么不把直接:model_provider = "OpenAI" 这样也可以生图和搜索了。 我来解释一下为什么,因为一般中转都会避开 model_providers.OpenAI 主要是因为这个远程 compact 他是一个同步请求,很多中转用的 CF 都有超过100秒就超时的风险。如果你是自己反代,不使用 CF ,那么完全可以按照这个方法,后面不用看了。 我逆向之后发现,除了检测 model_providers 还会检测 x-openai-actor-authorization 这个头信息。 因此按照我的方案,可以避开这个远程compact 又能实现 生图 和 搜索。 其次是为什么要逆向,因为我是发现 codex 的桌面版有检测 openai-actor-authorization 这个头信息,而桌面版目前是没有开源的。
老叶1999.eth
老叶1999.eth
惊现!新版 Codex 客户端,竟然在偷偷给第三方中转站“降智”。 7 月 11 日,我就发现新版 Codex 无法生图,并且第一时间公开了完整解决方案。 本以为这只是一个生图功能限制,结果继续逆向分析后,我发现事情远没有这么简单。 新版 Codex 一旦检测到你使用的是第三方 Provider,就会直接限制两项重要能力: 1、图片生成 2、Web Search 生图被限制,大家很容易发现。 但 Web Search 被悄悄关闭,才是真正影响模型能力的地方。 很多人可能不知道 Web Search 有多重要。 大模型的内部知识库都有截止日期,它并不知道今天刚刚发生了什么,也无法凭空获取最新的文档、新闻和技术变化。 所以模型厂商会给模型外挂一个实时联网搜索能力,这就是 Web Search。 它相当于模型的“眼睛”。 没有 Web Search,模型只能依赖旧知识回答问题; 有了 Web Search,它才能实时查询全网信息,验证事实,读取最新文档。 但现在,只要你在新版 Codex 中使用第三方中转站,哪怕后端接入的是完全相同的正版模型,客户端也可能直接把 Web Search 能力屏蔽掉。 模型没变。 API 没变。 只是因为 Provider 不是官方的,客户端就主动砍掉了能力。 这才是真正意义上的“客户端降智”。 好消息是,经过逆向分析,我已经找到了绕过限制、恢复生图和 Web Search 的方法。 详细修改教程,我已经发在前一条推文里: 正在使用 Codex 第三方中转站的人,建议马上检查一下。 你以为自己用的是同一个模型,实际上客户端可能早就偷偷阉割了它。 大家可以看一下附图修改前后的对比:
老叶1999.eth
老叶1999.eth
深度体验了一整天 GPT-5.6-sol。 我的态度大概经历了三个阶段: 兴奋 → 质疑 → 理解并接受。 先说一个很容易被混淆的地方: GPT-5.6-sol 本身最高的推理等级其实还是 xhigh,UI 里显示的 Max 和 Ultra,更多指的是客户端的工作流模式,并不只是单纯把模型“调得更聪明”。 今天 Ultra 被吐槽最多的地方,就是它很喜欢自动派发大量子代理。 哪怕只是一个不算复杂的任务,也可能瞬间拉起一堆代理,消耗大量 Token,整个过程看起来声势浩大,但实际收益未必能匹配成本。 我刚开始用的时候也有点怀疑: 这到底是在干活,还是在拿 Token 堆排场? 后来理解了它的机制,我把推理等级降到 High,又重新跑了一些真实任务,体验反而好了很多。 速度比 GPT-5.5 xhigh 更快,能力和稳定性又明显更强,Token 消耗也没有 Ultra 那么夸张。 至少以我今天的体验来看: GPT-5.6-sol + High,可能才是目前最适合日常使用的组合。 复杂重构、全项目 Review、需要并行探索的大任务,可以再考虑 Ultra。 普通开发任务没必要一上来就拉满。 这个模型不是不能用,也不是一定要无脑开最高档。 真正的问题是,很多人还没搞清楚 Max、Ultra 和推理等级的区别,就已经开始拿 Ultra 当默认模式了。 用对了,确实比 5.5 强不少。 用错了,就只能看着 Token 哗哗往外流。
老叶1999.eth
老叶1999.eth
给大家一个忠告!如果你要使用 5.6 sol。 请把 Superpowers 暂时的丢进垃圾桶! 否则你将会见到模型持续数小时的左右脑互博!最终问题越来越多,没完没了!
老叶1999.eth
老叶1999.eth
抱歉,真的草率了,请原谅! 深度用了一整天,觉得 5.6 sol 太慢了,其次是太纠结了。一个小问题,越修范围越大! 不好意思,奥特曼,这次真的无法帮你吹牛逼了!吊了这么久的胃口,就这? 当我知道了 5.6 原来是使用 5.4 的底座开发的,我就知道要完蛋了!
老叶1999.eth
老叶1999.eth
抱歉,真的草率了,请原谅! 深度用了一整天,觉得 5.6 sol 太慢了,其次是太纠结了。一个小问题,越修范围越大! 不好意思,奥特曼,这次真的无法帮你吹牛逼了!吊了这么久的胃口,就这? 当我知道了 5.6 原来是使用 5.4 的底座开发的,我就知道要完蛋了!
老叶1999.eth
老叶1999.eth
gpt-5.6-sol 还没用上的,真的赶紧去用。 我刚用 ultra 模式,把自己的中转站项目完整 review 了一遍。 耗时 1 小时 32 分钟,硬生生揪出了 19 个问题。 说实话,我人都看傻了。 我一直有个习惯:每次发版前必须做一次 review。原本以为项目已经挺干净了,结果还是挖出一堆历史遗留问题。 现在终于明白了: gpt-5.5 留下的屎山,得靠 gpt-5.6 来擦。 至于 gpt-5.6 留下的屎山…… 那就等 GPT-6.0 来擦吧。