SIGGRAPH
[Paper Note] Neural Cellular Automata: From Cells to Pixels, Ehsan Pajouheshgar+, arXiv'25, 2025.06
Paper/Blog Link My Issue
#Author Thread-Post Issue Date: 2026-07-11 GPT Summary- NCA(ニューラルセルラーオートマタ)は生物に着想を得た動的系であり、自己組織化により複雑なパターンを生成する。しかし、低解像度の出力に制約される理由は、学習時間やメモリの増加、局所的な情報伝搬の制限、高解像度での計算要求にある。本研究では、粗いグリッドで進化するNCAと軽量な暗黙デコーダを組み合わせ、高解像度での出力を可能にする。推論は高度に並列化でき、形態形成とテクスチャ合成に特化した損失を導入することで効率が向上。実験により、提案モデルがリアルタイムで高解像度の出力を生成し、自己組織化を保持できることを示した。 Comment
元ポスト:
[Paper Note] Diffusion as Shader: 3D-aware Video Diffusion for Versatile Video Generation Control, Zekai Gu+, SIGGRAPH'25, 2025.01
Paper/Blog Link My Issue
#ComputerVision #Controllable #DiffusionModel #VideoGeneration/Understandings Issue Date: 2025-12-21 GPT Summary- 新しいアプローチ「Diffusion as Shader(DaS)」を提案し、3D制御信号を活用して動画生成の多様な制御を実現。従来の2D制御信号に対し、3Dトラッキング動画を用いることで、時間的一貫性が向上し、幅広い動画制御タスクに強力な性能を発揮。 Comment
pj page: https://igl-hkust.github.io/das/
Sketch-Guided Text-to-Image Diffusion Models, Andrey+, Google Research, SIGGRAPH'23
Paper/Blog Link My Issue
#NeuralNetwork #ComputerVision #NLP #TextToImageGeneration #One-Line Notes #ImageSynthesis Issue Date: 2022-12-01 Comment
スケッチとpromptを入力することで、スケッチ biasedな画像を生成することができる技術。すごい。
[Paper Note] Stereo Magnification: Learning View Synthesis using Multiplane Images, Tinghui Zhou+, SIGGRAPH'18, 2018.05
Paper/Blog Link My Issue
#ComputerVision #Dataset #Evaluation Issue Date: 2025-11-20 GPT Summary- 視点合成問題において、狭ベースラインのステレオカメラから新しい視点を生成する手法を提案。マルチプレーン画像(MPI)を用いた学習フレームワークを構築し、YouTube動画をデータソースとして活用。これにより、入力画像ペアからMPIを予測し、従来の手法よりも優れた視点外挿を実現。 Comment
