研究内容
加藤研究室では、コンピュータビジョンの技術を基礎から応用まで幅広く研究しています。深層学習をはじめとする画像認識・画像処理技術に加え、近年は「見る」だけでなく「理解し、言葉で説明する」ことができる視覚言語モデル(VLM)などの最新のマルチモーダルAIにも力を入れています。工場における外観検査・異常検知などの産業応用から、人の感性や印象を定量的に扱う感性情報処理まで、実社会の課題解決につながる研究に取り組んでいます。
研究テーマ
-

コンピュータビジョン
コンピュータに、人の目のような「見る力」を持たせたい。そんな想いから、深層学習や視覚言語モデル(VLM)といった最新のAI技術を使いながら、画像認識やロボットビジョンなど、新しい「見る」技術を研究しています。最近は、ただ「見る」だけでなく、見たものを「理解して、言葉で説明する」AIにも挑戦しています。
-

産業応用
深層学習を使って、工場の製品検査で「良品か不良品か」を見分けるAIなど、ものづくりの現場のちょっとした困りごとをAIで解決できないか、日々研究しています。新しい製品が出てきてもすぐに使える、そんな実用的な検査AIを目指しています。
-

感性情報処理
「なぜこの画像を美しいと感じるんだろう」「この木目、なんだか心地いいな」——そんな人の感性や印象を、データとして捉えてAIで表現できないかと研究しています。心理学的な視点と機械学習を組み合わせながら、人とコンピュータの新しいコミュニケーションのかたちを探っています。