#148 · 主分类: 计算机视觉
ha-llmvision
家居视觉智能。
项目最后更新:08/23/26
GitHub Stars
1.4K
Forks数量
141
贡献者数量
44
许可证
Apache-2.0
收录理由
对于家里装有摄像头的 Home Assistant 用户,ha-llmvision 能把多模态大语言模型直接架在现有的视频流和 Frigate 事件之上。系统会描述画面里正在发生什么,回答关于某段录像的问题,并把抽取出的信息写进传感器。它还会保留一条摄像头事件的时间线,记住里面出现的人、宠物和物体,你可以把这些内容放到仪表盘上,或者通过 Assist 直接询问。这个集成兼容的模型服务商很广,从 OpenAI、Anthropic、Gemini 到 Ollama、LocalAI 这类本地方案都有,让你在云端便利与完全隐私之间自由选择。正因为覆盖面这么宽,它成了让已有硬件发挥更多价值的直截了当的办法——无论你想要更丰富的安防告警,还是自动生成场景描述,都能派上用场。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。