LLaVA(Large Language and Vision Assistant)是一個開源且免費的 AI 圖像辨識助手,你可以透過上傳圖片並提問得到對應的答案。

他有提供介面可以展示這個工具的威力,使用方法很簡單,只要上傳圖片並問他問題,像是最基本的請他辨識圖片:

他就能跟你說圖片裡有什麼。

你也可以問他進一步的問題,像下面這張就是問他說這圖片哪邊怪怪的。

他也可以就問題給對應的答案。

如果會寫程式的話,也可以把這個模型拿回去使用喔。