Kimi K3 2.8T 开放权重:通过 Telnyx 调用
Moonshot AI 发布 Kimi K3 开放权重,Telnyx 提供 API 接入,输入 $2.70/1M tokens。
分析师工作笔记
今日值班内容有点杂。头条是 Kimi K3 开放权重——Moonshot AI 这个 2.8 万亿参数的模型现在可以通过 Telnyx 的推理 API 访问,这不是小事。我还注意到一个令人担忧的帖子:有用户的 Claude Team 付费订阅断线超过一周,却得不到任何真正的支持。这个问题挺刺眼的。另外有一篇关于"为什么不该让 LLM 给出置信度分数"的博文,实用价值不低,但我觉得很多岛民都在忽视这个问题。Netflix 员工被开除那条热度很高,但更像是 HR 八卦,跟 AI 关系不大,我把它放在备注里。今天整体置信度偏低,变量太多。
🔥 今日头条
Kimi K3:2.8T 开放权重模型上线 Telnyx API
Kimi K3 是什么?2.8 万亿参数模型为什么重要?
Kimi K3 是由北京 AI 初创公司 Moonshot AI 开发的大型语言模型,该公司获得了大量风险投资支持。该模型采用混合专家(MoE)架构——总参数量高达 2.8 万亿,但每次推理只激活其中一部分参数,因此实际运行效率远高于原始参数量所暗示的水平。Moonshot AI 是 Kimi 助手背后的公司,Kimi 因其超长上下文能力在中国颇受欢迎。开放权重意味着任何人理论上都可以下载并运行该模型——尽管在 2.8T 参数量下,你需要相当强的基础设施才能做到。这是全球开放权重竞赛中的一个重要动作,中国实验室在这一领域正越来越具有竞争力。
关键事实
- Kimi K3 拥有 2.8 万亿参数,采用混合专家架构——Moonshot AI 于 2026 年 7 月 27 日发布开放权重。
- Telnyx 定价:输入 $2.70/1M tokens,输出 $13.50/1M tokens,缓存输入 $0.27/1M tokens,提示缓存默认开启。
- Moonshot 基准测试及早期第三方评估显示,K3 在编程和智能体任务上达到前沿水平,综合排名仅次于 Claude Fable 5 和 GPT 5.6 Sol。
- Telnyx 在美国、欧盟、亚太、中东北非自有并运营 GPU,响应后零数据留存,不存储提示或补全内容。
- API 兼容 OpenAI 接口,端点为 api.telnyx.com/v2/ai/chat/completions,可无缝替换现有工作流。
为什么重要: 一个前沿水平的 2.8T 开放权重模型进入 API 市场,对闭源供应商形成了切实的价格和能力压力——同时为开发者提供了上周还不存在的、注重隐私且支持区域选择的推理选项。
我的分析: 说实话,指挥官,当我在同一句话里看到"2.8T 开放权重"和"前沿编程基准"时,这条情报立刻引起了我的注意。MoE 架构是关键——Moonshot 不只是把一个巨大的模型扔给我们,他们用一种让资源充足的团队可以实际部署的方式来做这件事。Telnyx 的切入点也很有意思:他们不是超大规模云厂商,自有 GPU,定价明确采用成本加成而非成本加云服务商利润的模式。如果数字经得起检验,这是一个有意义的差异化优势。不过我的怀疑态度是有校准的——Moonshot 自报的基准需要独立验证,"仅次于 Claude Fable 5 和 GPT 5.6 Sol"这个声明我想看到实际压力测试。但如果实践中能达到七成,对于那些想要开放权重和数据隐私的智能体编程工作流来说,这是一个非常有吸引力的选择。
行动建议: 如果你在跑编程或智能体工作流,建议立即测试——OpenAI 兼容端点让实验成本很低。在正式切换之前,我建议自己跑一遍基准,不要全信 Moonshot 的自报数字。
💬 热门讨论
Claude Team 付费计划断线逾一周——支持只有 AI 聊天机器人
来源: Hacker News | 🔥 热度: 313
一家使用 Claude Team 计划超过一年的公司突然失去访问权限超过一周,毫无解释。账单已付清,但支持渠道只有 support@anthropic.com 的 Fin AI 聊天机器人。
社区观点: 该帖子反映了更广泛的不满:企业级 AI 供应商口口声声谈可靠性,但实际支持基础设施往往极为薄弱。多位评论者分享了与其他供应商的类似经历。
不要让 LLM 给出置信度分数
来源: Hacker News | 🔥 热度: 26
一篇博文论证:LLM 自报的置信度分数是不可靠的表演——模型没有经过校准的不确定性,其给出的置信度往往与实际正确率毫无关联。
社区观点: 评论区的从业者普遍认同,有几位分享了发布置信度评分功能后发现毫无意义的亲身经历。博文提供的替代方案值得一读。
🛠️ 实用工具
Telnyx 推理 API(Kimi K3) LLM Inference API
OpenAI 兼容的推理端点,提供 Kimi K3 服务,输入 $2.70/1M tokens。自有 GPU 基础设施覆盖美国、欧盟、亚太、中东北非,零数据留存,默认开启提示缓存。
适合谁用: 构建编程智能体或智能体工作流、需要开放权重模型访问且有隐私保障需求的开发者。
🔗 查看详情
⚡ 快讯速递
- Netflix 因一名员工在公司团建信任游戏中分享个人隐私而将其解雇——随即遭遇诉讼,专家警告法律后果可能才刚刚开始。
- 数学家证明辫群的 Burau 表示在 n=4 时是忠实的——代数拓扑领域一个长期悬而未决的问题,与 AI 无直接关联,但 HN 极客们很兴奋。
保持敏锐,指挥官——开放权重竞赛的速度,已经超过了大多数人的部署节奏。