Awesome Large Language Models
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Stephen Gould — most-cited papers & profile · Large Language Models
← authors
·
overview
Stephen Gould
28
papers ·
187
citations
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Bottom-Up and Top-Down Attention for Image Captioning and Visual Question Answering
2017 · 94 citations
A Recurrent Vision-and-Language BERT for Navigation
2020 · 40 citations
Temporally Consistent Unbalanced Optimal Transport for Unsupervised Action Segmentation
2024 · 19 citations
Multiview Detection with Feature Perspective Transformation
2020 · 10 citations
Self-Supervised Video Representation Learning With Odd-One-Out Networks
2016 · 7 citations
Learning Variations in Human Motion via Mix-and-Match Perturbation
2019 · 7 citations
Higher-order Pooling of CNN Features via Kernel Linearization for Action Recognition
2017 · 2 citations
Vision-and-Language Navigation: Interpreting visually-grounded navigation instructions in real environments
2017 · 2 citations
Rethinking conditional GAN training: An approach using geometrically structured latent manifolds
2020 · 2 citations
Spatially Conditioned Graphs for Detecting Human-Object Interactions
2020 · 1 citations
Learning to Select Camera Views: Efficient Multiview Understanding at Few Glances
2023 · 1 citations
Learning Navigational Visual Representations with Semantic Map Supervision
2023 · 1 citations
Exploring Predicate Visual Context in Detecting Human-Object Interactions
2023 · 1 citations
Gromov Wasserstein Optimal Transport for Semantic Correspondences
2026
DiSA: Diffusion Step Annealing in Autoregressive Image Generation
2025
Top co-authors
Cristian Rodriguez-Opazo
· 2
Damith Ranasinghe
· 2
Ignacio M. De la Jara
· 2
Hamed Damirchi
· 1
Topics
Video Understanding
Object Detection
Segmentation
Training & Sampling
Conditioning & Control
Image Generation
3D & NeRF Generation
Visual Language
Navigation
Perception