CUDA vLLM 支持 DeepSeekv4.1 Flash 两天后,AMD 才发布其 DeepSeek v4.1 Flash 镜像。功能可即开即用,但每美元性能比 H200 差最多 14.8 倍、比 B200/B300 差最多 42 倍。
SemiAnalysis 称,NVIDIA 与 600 万开发者生态的合作使 CUDA 在第一天就完成优化,这正是 CUDA 护城河的威力所在。
SemiAnalysis(@SemiAnalysis_)
🌸 科技圈· 茶馆 · 投稿
🤔 165 😁 60 😢 18 🖕 10 😇 8 👍 6 ❤️ 5 🤬 3 👎 2 🔥 1 👀 1