LongCat-Flash-Chat 更新 09/16 00:13 longcat · LongCat-Flash-Chat
LongCat-Flash 在两项关键原则下进行设计与优化:高效的计算利用,以及高效的训练和推理。具体而言,(1) 由于并非所有 token 都是平等的,我们在 MoE 模块中引入了零计算专家机制,以根据重要性为重要 token 分配动态计算预算,即根据上下文需求激活 18.6 到 31.3 billion 参数(总共 560 billion 参数)。为了确保一致的计算负载,我们采用由 PID 控制器调节的专家偏置,保持每个 token 平均激活约 27 billion 参数。(2) 由于通信开销在 MoE 模型扩展过程中成为瓶颈,我们纳入了 Shortcut-connected MoE (ScMoE) 设计以扩大计算-通信重叠窗口。结合定制的基础设施优化,该设计实现了在超过数万个加速器的大规模下进行训练,以及高吞吐量和低延迟的推理。
Shut down officially: what is sold here may not be the original model LongCat-Flash-Chat The vendor has stopped serving it.Relays still sell it under this name, but you may get a different model. If you still want it, start with a small trial or verify it first.
官方已下线。 LongCat 官方开放平台 FAQ 核对
模型介绍 LongCat-Flash 在两项关键原则下进行设计与优化:高效的计算利用,以及高效的训练和推理。
展开完整介绍 LongCat-Flash 在两项关键原则下进行设计与优化:高效的计算利用,以及高效的训练和推理。具体而言,(1) 由于并非所有 token 都是平等的,我们在 MoE 模块中引入了零计算专家机制,以根据重要性为重要 token 分配动态计算预算,即根据上下文需求激活 18.6 到 31.3 billion 参数(总共 560 billion 参数)。为了确保一致的计算负载,我们采用由 PID 控制器调节的专家偏置,保持每个 token 平均激活约 27 billion 参数。(2) 由于通信开销在 MoE 模型扩展过程中成为瓶颈,我们纳入了 Shortcut-connected MoE (ScMoE) 设计以扩大计算-通信重叠窗口。结合定制的基础设施优化,该设计实现了在超过数万个加速器的大规模下进行训练,以及高吞吐量和低延迟的推理。
查看介绍来源
模型基础信息
厂商 LongCat
现在还能用吗 官方已下线官方已停止提供,通常已经调不通了;页面上的成绩只反映它当时的表现。
这些资料是哪个地区的 暂无官方资料目前只知道这个模型的名字,厂商还没有公开规格和价格。 它还叫这些名字(24 条) LONGCAT FLASH CHAT LONGCAT FLASH CHAT(longcat-api-cn · global) LONGCAT-FLASH-CHAT LONGCAT-FLASH-CHAT(longcat-api-cn · global) LONGCATFLASHCHAT LONGCATFLASHCHAT(longcat-api-cn · global) LONGCAT_FLASH_CHAT LONGCAT_FLASH_CHAT(longcat-api-cn · global) LongCat Flash Chat LongCat Flash Chat(longcat-api-cn · global) LongCat-Flash-Chat LongCat-Flash-Chat(longcat-api-cn · global) LongCatFlashChat LongCatFlashChat(longcat-api-cn · global) LongCat_Flash_Chat LongCat_Flash_Chat(longcat-api-cn · global) longcat flash chat longcat flash chat(longcat-api-cn · global) longcat-flash-chat longcat-flash-chat(longcat-api-cn · global) longcat_flash_chat longcat_flash_chat(longcat-api-cn · global) longcatflashchat longcatflashchat(longcat-api-cn · global) 不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。
官方价格 暂无官方价格
它有多强 成绩来自 Epoch AI, AI Benchmarking Hub (2026) 0 / 20 项 20 项评测里,这个模型测过 0 项
模型自己的成绩 0 项
配上工具的成绩 0 项
换不同设置跑出的成绩 0 次 这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。
还有 20 项评测没测过这个模型 Aider Polyglot CyBench DeepResearchBench GDPval METR Time Horizons OSWorld OSWorld 2 SWE-bench Verified Terminal-Bench ARC-AGI-2 Epoch Capabilities Index FrontierMath GPQA Diamond Humanity's Last Exam LiveBench MATH Level 5 MirrorCode SimpleBench SimpleQA Verified Video-MME 可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。
这个模型还没有可比的综合成绩,下面是它的单项成绩。
模型自己的成绩 同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。
这个模型还没有可公开的单项成绩。
配上 Agent 能做到什么 这不是模型自己的分数。 下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。
这个模型还没有出现在 SWE-bench、Terminal-Bench 一类的 Agent 评测里。