LMU

Grok 4.6 和 DeepSeek V4 Pro-0813 接连发布:2026年8月的大模型格局速览

Grok 4.6 和 DeepSeek V4 Pro-0813 接连发布:2026年8月的大模型格局速览

数据核实时间:2026年8月14日。文中benchmark分数均为厂商自报或第三方聚合站(Artificial Analysis等)数据,非独立中立测试,具体数字以各官方页面实时公示为准。 TL;DR 2026年8月12日到13日,xAI和DeepSeek在24小时内接连发布Grok 4.6和DeepSeek V4 Pro-0813。前者主打长程Agent任务和视觉交互能力,跑分逼近Fable 5级别;后者是一次低调的静默更新,没有发布会,但在编程类benchmark上有大幅跳升。放在一起看,能观察到一个更大的趋势:开源模型和闭源旗舰的差距,正在以肉眼可见的速度缩小。 Grok 4.6:不是上下文升级,是Agent持续力升级 xAI于2026年8月12日发布Grok 4.6,距离上一代Grok 4.5发布仅一个月。官方博客说明这次的重点不是把上下文窗口做大——上下文窗口维持在50万token,跟4.5一致——而是让模型在长链条任务里"待得住":无论是深挖一个代码库、多步骤研究一个陌生话题,还是把一个粗糙的原型迭代成可用软件,模型都被要求保持任务连续性。
LMU
个人开发者/小团队怎么挑中转平台?一套8维度打分法,附淘汰红线

个人开发者/小团队怎么挑中转平台?一套8维度打分法,附淘汰红线

用 Claude Code 或者接 GPT/Codex API,国内绕不开中转平台。市面上一堆平台各说各的好,价格表看花了眼也挑不出个所以然。这篇不整虚的,直接上一套能量化打分的方法,附一份"一票否决"的淘汰清单——踩中任何一条,别的分数再高也不用看了。 先说淘汰红线,7条踩中一条直接划掉 这7条不是扣分项,是一票否决项。理由很简单:这几条要么说明平台在骗你,要么说明它撐不住基本的生产使用要求,分数再高都没意义。 * ❌ 不说明上游来源:接的是官方API、逆向接口、还是账号池转发,官网连提都不提,或者含糊其辞 * ❌ Token统计不透明:账单和实际调用量对不上,出问题查不到明细 * ❌ Cache无法验证:宣称支持Prompt Cache,但响应里根本看不到对应字段,验证方法见下文 * ❌ 大量429:正常使用强度下频繁被限流,说明容量或者上游账号池撐不住 * ❌ stream经常断:流式输出中途断线,Claude Code这种交互密集场景下体验直接崩 * ❌ 充值/退款规则模糊:
LMU
Claude Code 国内能用吗?我用灵眸AI 半年的完整记录

Claude Code 国内能用吗?我用灵眸AI 半年的完整记录

我把 Claude Code 当主力开发工具已经半年了。这半年里换过两家中转,踩过几个坑,最后稳定在 灵眸AI(api.lmuai.com)这个国内节点的 Anthropic 中转上。这篇是一次完整复盘——把"国内能不能用"和"挑哪家"这两件事讲透,给同样在国内的开发者参考。 一、为什么直连 Anthropic 在国内走不通 很多人第一反应是"挂个梯子不就行了吗"。试过你就会知道,远没那么简单。 第一关是注册。Anthropic 账号要绑定美区受理的信用卡,国内大部分双币种 Visa/Mastercard 都拒。我试过三张主流银行的双币卡,全部失败——Anthropic 校验的是发卡行 BIN,国内卡的 BIN 段几乎全在他们的拒绝列表里。
LMU
Claude Code Prompt Cache 完全指南:原理、配置、避坑、实测省 80%(2026年5月版)

Claude Code Prompt Cache 完全指南:原理、配置、避坑、实测省 80%(2026年5月版)

用 Claude Code 一年,最大的认知更新就一句话:Prompt Cache 没配好,你交给 Anthropic 的钱里有 80% 是冤枉付的。本文整理踩过的坑、读源码后理解的工作原理、以及一套实测有效的配置方案 。包含:前缀匹配机制深度解析、5min vs 1h 档位选择、5 个让缓存失效的隐藏陷阱、CLAUDE.md 最佳实践、中转站选型注意事项、100 轮实测数据。
LMU