博客
面向开发者的实操干货:用一个 OpenAI 兼容接口玩转 DeepSeek、Qwen、Kimi、GLM 等。
阿里 2026 年 8 月 3 日正式发布 Qwen3.8-Max:2.4 万亿参数 MoE、激活 95B、1M 上下文、定价 $2/$6——外加一句从没人敢押的承诺:Max 级权重下周开源,连带一个 27B 小版本。基准数字、该打的折扣、以及预览期两周的怀疑哪些被验证了。
阅读全文 →MiniMax 2026 年 8 月 3 日放出 H3 视频模型权重:33B 稠密架构、4–15 秒、最高 2K、原生立体声,消费级显卡就能跑 ComfyUI。坑在许可证里——适用地区排除美国、欧盟、英国和韩国。这次发布里到底有什么、本地能跑到什么程度、以及托管 API 什么时候仍然是对的。
阅读全文 →V4-Flash-0731 正式版 7 月 31 日落地——284B/13B 架构原封不动、只重做后训练,Agents' Last Exam 直接打到 25.2、贴脸 Opus 4.8 的 25.7,价格还是 $0.14/$0.28。权重当天上 Hugging Face。数字、后训练的故事、以及它落在价格战周意味着什么。
阅读全文 →快乐马从一句提示词、一张图或几张参考图生成带同步音频的 1080p 视频,720P 每秒 $0.14 起。API 是两步异步任务:创建、轮询。curl 和 Python 完整示例、四个模型的用法、以及真正要紧的计费规则。
阅读全文 →Qwen3.7-Max 是阿里现役旗舰档,Plus 是它的均衡款——都能在海外通过 OpenAI 兼容端点直接调用,国际卡、免中国手机号。配置、选型、代码,以及 Qwen3.8 的位置。
阅读全文 →月之暗面 7 月 27 日如约放出 K3 权重——1.56TB 上了 Hugging Face,一天不差。然后是三个转折:新许可证卡住 MaaS 转售商、自部署门槛从 80 张 GPU 起步、第三方伺服市场稀薄且已出现静默量化。什么免费、什么要授权、实际该怎么办,一次说清。
阅读全文 →今天并不存在禁令——存在的是一场明说了"可以制裁"的财政部审查,以及美国科技界今年集结过的最大规模反禁令联盟:近 200 家初创、英伟达、微软、Meta、Altman 和 Pichai。事实、情景推演、以及你的技术栈该怎么办,持续追踪更新。
阅读全文 →Opus 5 成为 Artificial Analysis 新榜首(61 分,微超 Fable 5 的 60),单任务成本还低 26%——这是"国产模型赢在性价比"论点迄今受到的最强攻击。我们就是靠这个论点吃饭的,所以把账算得诚实:Opus 5 真正抹平了什么,5.7 倍的输出价差又还在决定什么。
阅读全文 →K3 发布 48 小时后订阅消失:套餐暂停、Kimi Code 售罄、连付费 API 用户都在撞 429。完整拆解——需求怎么打穿月之暗面的容量、今天什么还能用、以及在它恢复期间拿到 K3 级能力的实用路线。
阅读全文 →智谱创始人唐杰公开确认 GLM-5.5,承诺"史诗级 plus"的提升;报道指向 8 月发布、参数量预计破万亿——背后是刚建成的全国产芯片 1GW 数据中心。哪些已确认、哪些是预期,以及对开发者真正要紧的那个问题:GLM 还便宜吗?
阅读全文 →阿里 7 月 19 日放出 Qwen3.8-Max 预览:前沿级的口号、零份公开基准。8 月 3 日正式版落地:整桌基准、$2/$6 定价、带日期的开源承诺。这一页追了预览期的每一条主张——现在逐条对账。
阅读全文 →月之暗面 2026 年 7 月 16 日发布 Kimi K3:2.8 万亿参数 MoE、100 万上下文、开源权重阵营已发布的最强 GPQA 成绩,Artificial Analysis 榜第三、只在 Fable 5 和 GPT-5.6 Sol 之后。$3/$15 是中国实验室史上最贵定价。规格、基准、真实成本、怎么选,一文拆完。
阅读全文 →Kimi K3 于 2026 年 7 月 16 日发布,比预告片晚一天、比社区押注的 WAIC 窗口早一天。我们逐条追踪过发布前的每个说法——Arena 上的 Kivine、2.5T 泄露、WAIC 时间赌注——现在对答案:记分板全在这,权重进展也在这。完整规格与价格见发布日深度拆解。
阅读全文 →DeepSeek V4 自 2026 年 4 月 24 日起一直以 Preview 身份运行。现在多方报道指向 7 月中旬转正,且正式版或引入高峰时段 API 价格翻倍——还有一条完全官方的硬消息:旧别名 deepseek-chat 和 deepseek-reasoner 7 月 24 日停用。实锤、报道、传闻分开讲,以及这对海外开发者意味着什么。
阅读全文 →GPT-5.6 对国产阵容逐档对比,已按 7 月 30 日降价刷新:Sol $5/$30、Terra $2/$12、Luna 狂砍 80% 至 $0.20/$1.20——已压过 DeepSeek V4-Pro。降价改变了什么、没改变什么(旗舰级编程仍比 GLM-5.2 贵 4.8 倍),连跑分争议一起讲清。
阅读全文 →在 OpenRouter 上给 GLM-5.2 送最多 token 的应用是 Hermes Agent、Claude Code、pi、Kilo Code 和 OpenClaw——多为让用户自由选模型的开源编程与 agent 工具。这份数据说明了什么,以及你怎么自己跑 GLM-5.2。
阅读全文 →Cline 接受任意 OpenAI 兼容端点,所以你能通过 Turiloop 在它里面跑 GLM-5.2、DeepSeek V4-Pro 或 V4-Flash——三个字段、不改代码、国际卡、免中国手机号。
阅读全文 →Roo Code 支持任意 OpenAI 兼容 provider,所以你能用一个 Turiloop key 在 GLM-5.2、DeepSeek V4-Pro 和 V4-Flash 之间路由——默认走便宜的,任务难了再升级。
阅读全文 →Continue.dev 的 OpenAI 兼容 provider 让你用几行 config.yaml 就能把 GLM-5.2 和 DeepSeek 加进 VS Code 或 JetBrains——聊天、补全、编辑,全用一个 Turiloop key。
阅读全文 →aider 能连任意 OpenAI 兼容端点。用两个环境变量加 openai/ 模型前缀把它指到 Turiloop,就能在终端里和 GLM-5.2 或 DeepSeek 结对编程——国际卡、免中国手机号。
阅读全文 →主流国产模型官方牌价,2026 年 7 月更新:Kimi K3($3/$15)、GLM-5.2($1.40/$4.40)、DeepSeek V4-Pro($0.435/$0.87)、Kimi K2.6、MiniMax——配上支撑这些价格的跑分,以及它们压过的闭源价格。
阅读全文 →短答案(2026 年 7 月更新):Fable 5 仍霸榜 SWE-bench Pro,Claude Opus 5 以半价成为新的前沿席位,GLM-5.2 依旧是性价比默认,Kimi K3 拿走 agent 与前端天花板,DeepSeek V4-Pro 管算法、V4-Flash 管跑量。每个结论背后的跑分和价格。
阅读全文 →DeepSeek V4-Pro 官方价 $0.435/$0.87 每百万 token,V4-Flash $0.14/$0.28、缓存命中约 $0.014(2026 年 6 月)。真实账单由什么决定、和 GPT-5.5/Claude 差多少、身在海外怎么付。
阅读全文 →GLM-5.2 是全球第一的开源权重模型、综合第四,SWE-bench Pro 拿 62.1 分,100 万 token 上下文,价格只是闭源前沿的零头。这篇拆清楚它的跑分、MoE 架构、定价,以及怎么调用。
阅读全文 →Fable 5 是现在花钱能买到的最强模型,GLM-5.2 是现在最强的开源权重模型,两者价格天差地别。这篇教你怎么在它们之间选。
阅读全文 →快乐马几秒就能生成带同步音频的 1080p 视频,登顶 Artificial Analysis 视频榜,成本却只是同行的零头。它已在 Turiloop 上线——文生视频、图生视频、参考生视频、视频编辑,720p 每秒 $0.14 起。
阅读全文 →Kimi K3 是新的能力之王(AA 总榜第三,只输 Fable 5 和 GPT-5.6 Sol);GLM-5.2 仍是 $1.40/$4.40 的性价比默认;DeepSeek V4 拿走算法与大批量。一页讲清每个选择的跑分与价格依据——2026 年 7 月 25 日更新。
阅读全文 →GLM-5.2、DeepSeek V4、Kimi K2.6、MiniMax 又强又便宜,难的是海外怎么稳定调用、怎么付钱。一篇讲清楚选中转站到底看什么,别踩坑。
阅读全文 →DeepSeek V4-Pro 在代码 benchmark 上追平闭源前沿,价格却只是零头。用真实跑分和 API 价格做的 2026 三方对比。
阅读全文 →两者都来自 2026 年 4 月国产那波,都很能写代码。真正的区别在价格、上下文长度和 agent 能力。这篇教你怎么选。
阅读全文 →GPT-5.5 输出 $30/M;DeepSeek V4-Pro 只要其零头,代码却追平。这篇讲怎么两行完成迁移,不用重写代码。
阅读全文 →DeepSeek R1 让思维链推理出了名;今天这份工作属于 DeepSeek V4-Pro 的思考模式,旧别名 deepseek-reasoner 将于 2026 年 7 月 24 日停用。什么时候值得为深思熟虑付费、什么时候不值,以及现在怎么调用。
阅读全文 →约 $0.14 / $0.28 每百万 token、命中缓存 $0.014——DeepSeek V4-Flash 比闭源前沿便宜约 100 倍。这篇讲它擅长什么、什么时候该换 Pro 档。
阅读全文 →命中缓存的费用约为普通输入 token 的十分之一:DeepSeek 缓存读取约 $0.07/M、Kimi K2.6 约 $0.16/M。把提示结构摆对,省钱是自动的。
阅读全文 →工具调用把对话模型变成能调你 API 的 agent。这篇讲怎么用 DeepSeek V4 和 GLM-5.1、走标准 OpenAI tools 接口实现。
阅读全文 →一篇实用的 DeepSeek RAG 教程:从你自己的文档检索,让又便宜又能打的模型基于它作答。最小、贴近生产的流水线,含生成代码、省钱技巧和常见问题。
阅读全文 →gpt-image-2 通过 OpenAI 兼容接口从提示词生成高分辨率图像。这篇讲怎么调用——生成与编辑——以及按张计费。
阅读全文 →调一次模型很简单。真实流量需要带退避的重试、超时和兜底模型。这篇给出让你的应用稳住的几个模式。
阅读全文 →Kimi K2.6(长上下文 agent)与 GLM-5.1(代码)是 2026 年 4 月国产那波里最强的两款。这篇讲清楚海外怎么调用它们,带代码。
阅读全文 →实操指南:用一个 OpenAI 兼容接口调用 GLM-5.2、DeepSeek V4、Kimi K2.6、MiniMax——模型切换、流式、智能路由,全是可跑的代码。
阅读全文 →面向海外开发者的实操指南:用国际信用卡直接调用 DeepSeek API——无需中国手机号、无需支付宝,OpenAI 兼容,几分钟接入。
阅读全文 →