軽量Vision & Languageマルチモーダルモデルのモデル図
外観検査の対象画像例
学会発表の様子

コンピュータビジョンを研究しています

加藤研究室では、コンピュータビジョン、特にVision-Language Model(VLM)など最新のマルチモーダルAIを研究しています。「見る」だけでなく「理解し、言葉で説明する」AIを目指し、基礎研究から産業応用まで幅広く取り組んでいます。