Elastic 推理 (Elastic Inference)
推理是使用机器学习训练模型对您的数据进行预测或操作(例如文本嵌入或重排序)的过程。您可以在数据摄入期间(例如,从您摄入的文本数据中创建嵌入)或搜索期间(基于之前创建的嵌入执行 语义搜索)使用推理。根据底层推理基础设施和您使用的接口,在 Elastic Stack 中执行推理有多种方式。
推理基础设施
- Elastic Inference Service:一种在您的集群资源之外运行推理的托管服务。
- 部署在您集群中的训练模型:在您自己的机器学习节点上运行的模型。
- 外部推理:提供模型的第三方服务。
访问方式
semantic_text工作流:一种简化的方法,它在后台使用推理 API 来实现语义搜索。- 推理 API:一种通用 API,使您能够使用 EIS、您自己的模型或第三方服务来运行推理。