sort导航
location_on 首页 keyboard_arrow_right 资讯
NVIDIA与Meta携手优化Llama 4 GPU推理

NVIDIA与Meta携手优化Llama 4 GPU推理

NVIDIA与Meta近日宣布合作,共同优化Llama 4模型在GPU上的推理性能。这一合作旨在提升大规模语言模型的推理效率,降低计算资源消耗,为AI应用提供更强大的支持。通过结合NVIDIA的GPU...

NVIDIA NeMo框架训练定制行业大模型

NVIDIA NeMo框架训练定制行业大模型

🎉 NVIDIA推出的NeMo框架为AI开发者提供了强大的工具,用于构建和训练定制化的行业大模型。该框架基于深度学习技术,支持多种模型架构,能够满足不同行业的特定需求。NeMo框架 的核心优势在于其模...

NVIDIA NIM推理微服务加速模型部署

NVIDIA NIM推理微服务加速模型部署

在人工智能时代,模型部署已成为企业数字化转型的核心挑战。NVIDIA NIM作为一种高效的推理微服务框架,显著优化了模型部署流程,提升了推理性能和可扩展性。 NVIDIA NIM专注于加速AI模型的推...

NVIDIA H200 GPU大显存加速大模型训练

NVIDIA H200 GPU大显存加速大模型训练

在人工智能领域,训练大型模型需要高效的计算资源。NVIDIA H200 GPU凭借其大显存设计,显著提升了训练效率,尤其适用于深度学习应用。 H200 GPU 基于Ampere架构,提供高达48GB或...

MiniMax视频生成能力在海螺AI内测可用

MiniMax视频生成能力在海螺AI内测可用

MiniMax视频生成能力已在海螺AI平台内测中可用,这一创新技术为视频创作领域带来新机遇。内测功能基于先进AI算法,能够快速处理用户输入并生成高质量视频内容。 该能力的核心优势在于其高效的视频生成速...

MiniMax发布abab7万亿参数MoE语言模型

MiniMax发布abab7万亿参数MoE语言模型

近日,人工智能公司MiniMax 正式推出了其最新研发的abab 7万亿参数MoE 语言模型,这一发布在AI领域引起了广泛关注。该模型采用了Mixture of Experts(MoE)架构,通过稀疏...