arXiv論文 · cs.CV
Image-Space Rule Discovery
画像編集モデルが画像内の指示を読み取り、規則を推論し、ワークシート形式の課題を画像空間で完結できるかを評価するWISRDベンチマークを提案しました。
プロフィール
Misora Sugiyama
Computer Vision · Image & Video Generation

02 — Publications
コンピュータビジョン、生成モデル、画像編集、視覚推論に関するarXiv論文を2本公開しています。
03 — What's new?
04 — Projects
物体、構造、文脈、変化を視覚データから捉える表現学習を探究します。
一貫性、制御性、表現力を備えた画像・動画生成モデルを研究します。
重要な内容や意図を保ちながら、画像を異なるドメインへ変換する方法を研究します。
05 — Bio
コンピュータビジョンと生成AIを基盤に、視覚知能(Visual Intelligence)の研究に取り組んでいます。単にもっともらしい画像を生成するだけでなく、視覚的な構造を理解し、意図を保ちながら、異なるドメイン間で情報を変換できる知能の実現に関心があります。
現在の主な関心は、画像・動画生成、Image-to-Imageモデル、制御可能な生成、表現学習です。
06 — Affiliations
Academic affiliation
Research community
Computer vision community
07 — Contact
研究、講演、共同研究などに関するご連絡は、以下のメールアドレスまでお願いいたします。