Steve James
Steve James
Home
Publications
Research Lab
Contact
Dataset
GameTraversalBenchmark: Evaluating Planning Abilities Of Large Language Models Through Traversing 2D Game Maps
Large language models (LLMs) have recently demonstrated great success in generating and understanding natural language. While they have …
Muhammad Nasir
,
Steven James
,
Julian Togelius
PDF
Cite
Code
MiDaS: A Large-Scale Minecraft Dataset for Non-Natural Image Benchmarking
Reinforcement learning (RL) has recently made several significant advances using video games as a testbed. While many of these games …
David Torpey
,
Max Parkin
,
Jonah Alter
,
Richard Klein
,
Steven James
PDF
Cite
DOI
Cite
×