[go: up one dir, main page]

Suivre
Jing Yu Koh
Jing Yu Koh
Adresse e-mail validée de cs.cmu.edu - Page d'accueil
Titre
Citée par
Citée par
Année
Scaling autoregressive models for content-rich text-to-image generation
J Yu, Y Xu, JY Koh, T Luong, G Baid, Z Wang, V Vasudevan, A Ku, Y Yang, ...
TMLR, 2022
19252022
Vector-quantized image modeling with improved vqgan
J Yu, X Li, JY Koh, H Zhang, R Pang, J Qin, A Ku, Y Xu, J Baldridge, Y Wu
ICLR, 2021
9922021
Visualwebarena: Evaluating multimodal agents on realistic visual web tasks
JY Koh, R Lo, L Jang, V Duvvur, MC Lim, PY Huang, G Neubig, S Zhou, ...
ACL, 2024
8392024
Cross-Modal Contrastive Learning for Text-to-Image Generation
H Zhang*, JY Koh*, J Baldridge, H Lee, Y Yang
CVPR, 2021
5972021
Generating images with multimodal language models
JY Koh, D Fried, R Salakhutdinov
NeurIPS, 2023
4762023
Grounding Language Models to Images for Multimodal Inputs and Outputs
JY Koh, R Salakhutdinov, D Fried
ICML, 2023
321*2023
Tree Search for Language Model Agents
JY Koh, S McAleer, D Fried, R Salakhutdinov
TMLR, 2025
2742025
OmniACT: A Dataset and Benchmark for Enabling Multimodal Generalist Autonomous Agents for Desktop and Web
R Kapoor*, YP Butala*, M Russak, JY Koh, K Kamble, W Alshikh, ...
ECCV, 2024
199*2024
Dissecting Adversarial Robustness of Multimodal LM Agents
CH Wu, RR Shah, JY Koh, R Salakhutdinov, D Fried, A Raghunathan
ICLR, 2024
188*2024
Pathdreamer: A World Model for Indoor Navigation
JY Koh, H Lee, Y Yang, J Baldridge, P Anderson
ICCV, 2021
1682021
Text-to-image generation grounded by fine-grained user attention
JY Koh, J Baldridge, H Lee, Y Yang
WACV, 2021
982021
A New Path: Scaling Vision-and-Language Navigation with Synthetic Instructions and Imitation Learning
A Kamath, P Anderson, S Wang, JY Koh, A Ku, A Waters, Y Yang, ...
CVPR, 2022
94*2022
Simple and Effective Synthesis of Indoor 3D Scenes
JY Koh*, H Agrawal*, D Batra, R Tucker, A Waters, H Lee, Y Yang, ...
AAAI, 2022
572022
Vq3d: Learning a 3d-aware generative model on imagenet
K Sargent, JY Koh, H Zhang, H Chang, C Herrmann, P Srinivasan, J Wu, ...
ICCV, 2023
402023
Multimodal graph learning for generative tasks
M Yoon, JY Koh, B Hooi, R Salakhutdinov
NeurIPS GLFrontiers Workshop, 2023
382023
Revisiting hierarchical approach for persistent long-term video prediction
W Lee, W Jung, H Zhang, T Chen, JY Koh, T Huang, H Yoon, H Lee, ...
ICLR, 2021
372021
Improving Customer Satisfaction in Bike Sharing Systems through Dynamic Repositioning
S Ghosh*, JY Koh*, P Jaillet
IJCAI, 2019
322019
Urban Zoning Using Higher-Order Markov Random Fields on Multi-View Imagery Data
T Feng, QT Truong, T Nguyen, JY Koh, LF Yu, SK Yeung, A Binder
ECCV, 2018
282018
Vector-Quantized Image Modeling
YU Jiahui, X Li, H Zhang, V Vasudevan, AYS Ku, JM Baldridge, Y Xu, ...
US Patent App. 18/520,083, 2024
262024
Cross-Modal Contrastive Learning for Text-to-Image Generation based on Machine Learning Models
H Zhang, JY Koh, JM Baldridge, Y Yang, H Lee
US Patent App. 17/467,628, 2023
222023
Le système ne peut pas réaliser cette opération maintenant. Veuillez réessayer plus tard.
Articles 1–20