跳到正文
原文
fal.ai Blog· Dogac Eldenk·· 2026-07-08AI 评分22

fal.ai 如何用 DSpark 为 Ideogram V4 提示词扩展实现约 1000 tok/s 与 16 倍吞吐

How We Achieved ~1000 tok/s and 16x Throughput with DSpark for Ideogram V4 Prompt Expander

AI 导读

fal.ai 在 SGLang 上用 DSpark 为 Ideogram V4 的提示词扩展功能实现约 1000 tok/s 和 16 倍吞吐。该功能基于微调后的 Qwen 3.5 35B MoE(FP8)模型,此前在 SGLang 上并发为 1 时仅 328 tok/s,启用 MTP 投机解码后提升至 500 tok/s。

来源:fal.ai Blog · blog.fal.ai