标签:性能优化
国内复现Sora并开源:成本降低46%,序列扩充近百万!
本文介绍了专注于AIGC领域的专业社区,关注微软 & OpenAI、百度文心一言、讯飞星火等大语言模型(LLM)的发展和应用落地的情况。文章首先提到了OpenAI展示了...
揭开Groq LPU神秘面纱:世界最快硬件加速器的底层架构设计!
Groq, 一家创业公司,因其自研的硬件加速器LPU(Language Processing Unit)一夜爆火,实现了500个token/s的推理速度,秒杀了ChatGPT。这种性能的飞跃归功于...