#33 · 主分类: 推理与本地部署

serve

cloud-native cncf deep-learning docker fastapi framework generative-ai grpc jaeger kubernetes llmops machine-learning microservice mlops multimodal neural-search opentelemetry orchestration pipeline prometheus

☁️ 使用云原生技术栈构建多模态AI应用

项目最后更新:03/24/25

GitHub Stars

21.9K

Forks数量

2.2K

贡献者数量

185

许可证

Apache-2.0

收录理由

把推理逻辑封装成 Executor,通过 gRPC、HTTP 或 WebSocket 暴露服务,Jina 让开发者不必从零搭建周边基础设施。扩缩容、流式传输、动态批处理都由框架接管,原生 gRPC 支持配合 Docker、Kubernetes 和 Docker Compose 集成,放进云原生微服务栈里毫无违和感。编排层才是它真正省时间的地方——团队可以从本地原型直接推到线上负载均衡的端点,多模态负载尤其拿手。LLM 端点逐 token 流式输出,聊天类应用因此响应始终跟手。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目