Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Irfan Essa — most-cited papers & profile · Multimodal
← authors
·
overview
Irfan Essa
24
papers ·
118
citations ·
61
h-index
Georgia Institute of Technology
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
DD-PPO: Learning Near-Perfect PointGoal Navigators from 2.5 Billion Frames
2019 · 36 citations
Emergence Of Maps In The Memories Of Blind Navigation Agents
2023 · 17 citations
Estimating Mass Distribution of Articulated Objects using Non-prehensile Manipulation
2019 · 13 citations
Visual Prompt Tuning for Generative Transfer Learning
2022 · 11 citations
Prompt-Free Diffusion: Taking "Text" out of Text-to-Image Diffusion Models
2023 · 7 citations
Photorealistic Video Generation with Diffusion Models
2023 · 7 citations
Photorealistic Video Generation with Diffusion Models
2023 · 7 citations
VER: Scaling On-Policy RL Leads to the Emergence of Navigation in Embodied Rearrangement
2022 · 6 citations
VER: Scaling On-Policy RL Leads to the Emergence of Navigation in Embodied Rearrangement
2022 · 6 citations
Video based Object 6D Pose Estimation using Transformers
2022 · 6 citations
Analyzing Visual Representations in Embodied Navigation Tasks
2020 · 1 citations
End-to-End Multimodal Representation Learning for Video Dialog
2022 · 1 citations
Embodied Question Answering in Photorealistic Environments with Point Cloud Perception
2019
DD-PPO: Learning Near-Perfect PointGoal Navigators from 2.5 Billion Frames
2019
Graph-based Cluttered Scene Generation and Interactive Exploration using Deep Reinforcement Learning
2021
Topics
Video Understanding
Image Generation
3D Vision
Navigation
Sim-to-Real
Manipulation
Object Detection
Diffusion Models
Visual Language
Perception