Misora Sugiyama 杉山 未空
メニュー

プロフィール

杉山 未空

Misora Sugiyama

Computer Vision · Image & Video Generation

杉山未空のプロフィール写真

01 — Profile

杉山 未空

Misora Sugiyama

  • NYU Tandon School of Engineering
  • LIMIT Lab
  • cvpaper.challenge

杉山未空は、コンピュータビジョンと生成モデルを研究しています。特に画像・動画生成、Image-to-Imageモデルに取り組んでいます。

02 — Publications

研究成果

コンピュータビジョン、生成モデル、画像編集、視覚推論に関するarXiv論文を2本公開しています。

01

arXiv論文 · cs.CV

Image-Space Rule Discovery

Misora Sugiyama, Toya Oyama, Hirokatsu Kataoka

画像編集モデルが画像内の指示を読み取り、規則を推論し、ワークシート形式の課題を画像空間で完結できるかを評価するWISRDベンチマークを提案しました。

画像編集視覚推論ベンチマーク
arXivで見る
02

arXiv · ICCV 2025 Workshop

Simple Visual Artifact Detection in Sora-Generated Videos

Misora Sugiyama, Hirokatsu Kataoka

Sora生成動画に見られる4種類の視覚的アーティファクトを検出するマルチラベル分類手法を提案し、ResNet-50で平均94.14%の分類精度を達成しました。

動画生成アーティファクト検出マルチラベル分類
arXivで見る

03 — What's new?

お知らせ

「Image-Space Rule Discovery」をarXivで公開しました。

詳細 ↗

「Simple Visual Artifact Detection in Sora-Generated Videos」をarXivで公開しました。

詳細 ↗

生成動画の視覚的アーティファクト検出に関する研究をICCV 2025 Workshopで発表しました。

04 — Projects

研究テーマ

01

Computer Vision

物体、構造、文脈、変化を視覚データから捉える表現学習を探究します。

表現学習視覚理解
02

Image & Video Generation

一貫性、制御性、表現力を備えた画像・動画生成モデルを研究します。

拡散モデル時間的一貫性
03

Image-to-Image Models

重要な内容や意図を保ちながら、画像を異なるドメインへ変換する方法を研究します。

画像変換制御

05 — Bio

プロフィール

コンピュータビジョンと生成AIを基盤に、視覚知能(Visual Intelligence)の研究に取り組んでいます。単にもっともらしい画像を生成するだけでなく、視覚的な構造を理解し、意図を保ちながら、異なるドメイン間で情報を変換できる知能の実現に関心があります。

現在の主な関心は、画像・動画生成、Image-to-Imageモデル、制御可能な生成、表現学習です。

06 — Affiliations

所属・コミュニティ

NYU

NYU Tandon School of Engineering

Academic affiliation

LIM

LIMIT Lab

Research community

CV

cvpaper.challenge

Computer vision community

07 — Contact

連絡先

研究、講演、共同研究などに関するご連絡は、以下のメールアドレスまでお願いいたします。

メールを送る misorasugiyama.eca@gmail.com