DeepSeek开源周Day 1: FlashMLA——大家省,才是真的省
DeepSeek发布首个开源项目FlashMLA,专为英伟达Hopper GPU设计,实现了高效MLA解码内核,提供3000GB/s内存带宽和580TFLOPS计算性能,已在GitHub上吸引5000+星。
DeepSeek发布首个开源项目FlashMLA,专为英伟达Hopper GPU设计,实现了高效MLA解码内核,提供3000GB/s内存带宽和580TFLOPS计算性能,已在GitHub上吸引5000+星。
DeepEP是针对Hopper GPU优化的MoE模型训练与推理高效通信库,支持FP8和低延迟推理解码,通过NVLink和RDMA提升效率。
2024年12月,字节跳动豆包MarsCode、夸克AI创作平台及深度求索DeepSeek等新产品亮相,展现中国AI领域的创新活力和潜力。老牌选手如百度文心一言和Kimi也表现出色。
来自卡内基梅隆大学、斯坦福大学等的众多专家推出了全新物理仿真平台Genesis,它结合生成式AI和真实物理准确性,专为通用机器人、具身人工智能和物理AI应用设计。