绵延数日的思维链。
带检查点记忆的多日智能体链条。V4 Pro 会规划、修订、自我恢复——把难题当作一次下潜, 而非一场冲刺。当某条路径走入死胡同,它会带着所学上浮,然后再次下潜。
V4 Pro 生来就要下潜——越过模式匹配,越过那个舒服的答案, 抵达难题真正栖身的地方。
它把算力投在问题最坚硬之处,容纳矛盾而不崩溃,抵达底部才会上浮。 深度优先计算意味着:一条跑三天的推理链,成本只相当于过去的三分钟—— 而沿途的每一次转折,都被牢牢记住。
低调地说:我们没有让它更快,而是让它愿意潜得更深。— V4 研究团队 · 预印本 §2.4
带检查点记忆的多日智能体链条。V4 Pro 会规划、修订、自我恢复——把难题当作一次下潜, 而非一场冲刺。当某条路径走入死胡同,它会带着所学上浮,然后再次下潜。
一百万 token 的原生上下文——没有任何滑窗把戏。一次读入整个代码库、一整卷论文、 一整年的日志,并跨全部内容推理。
视觉、音频与文本共用一个主干——没有拼接式适配器。截图、图纸、九十分钟的录音, 都流经同一份注意力。
一流的工具编排,结构化输出与自我校验调用。在把结果交给你之前, 它会先核对自己的工作。
MIT 许可权重,FP8 与 INT4 双版本,完整模型卡, 以及一个下午即可复现的评测工具链。
以同行零头的训练预算,跑出 3.1× 的 MFU。 深度不该是只有万亿级实验室才负担得起的东西。
你的请求以原始字节进入——文本、图像或音频。
字节级分词器无损压缩输入流。
MoE 门控为每个 token 从 384 位专家中选出 8 位——零浪费算力。
入选专家共享同一份 1M token 记忆库,再行重组。
一次一个 token——经过校验、带引用、感知深度。
全球推理,首 token 仅 40 毫秒。为你真正思考的部分付费,仅此而已。
MIT 许可权重,发布当日即开源。FP8 适配集群,INT4 适配工作站。