术语表

nameDescription
Large Language ModelLLM(Large Language Model)是一种在海量文本数据上训练的 AI 模型,能够理解和生成自然语言,其参数规模通常从数十亿到数千亿不等。
Inference ServiceInference Service 是机器学习或深度学习领域中的一种服务,为已训练模型提供高性能、可扩展的预测或推理能力。
Inference RuntimesInference Runtime 为基于模型的推理服务提供高性能容器环境,优化资源利用率,加速推理过程,并降低延迟。
AI AgentAI Agent 是一种能够感知环境、做出决策并自主执行任务的 AI 实体,具有自主性、适应性和目标导向性。
Text GenerationText Generation 是使用自然语言处理(NLP)技术,基于给定输入(例如上下文、提示或规则)自动生成连贯且有意义文本内容的过程。
Text ClassificationText Classification 是将文本数据分配到预定义类别或标签中的过程,通常通过机器学习或深度学习模型实现,并用于信息检索、情感分析和垃圾邮件检测等各种应用。
Text-to-ImageText-to-Image 是使用结合 NLP 和计算机视觉的 AI 技术,将输入文本描述自动生成图像并将文本转换为视觉内容的过程。
Virtual GPUVirtual GPU(vGPU)是一种利用虚拟化技术将物理 GPU 资源拆分并分配给多个虚拟机的技术,从而实现图形处理能力的共享和高效利用。
Physical GPUPhysical GPU(pGPU)是指将宿主机上的整块物理 GPU 卡直接挂载到虚拟机,以便独占访问 GPU 资源的技术。