Modelpedia
Work in progress
About
Findings
Models
Concepts
Methods
Datasets
Sources
Light
Dark
PlaSma: Procedural Knowledge Models for Language-based Planning and Re-Planning
2024-01-16
· ICLR 2024 poster ·
anchor
Findings
IC-1188
GPT-3 procedural planning performance is scale-dependent, with Curie (6.7B) scoring 3.75 and Davinci (175B) scoring 4.90 overall quality in few-shot settings, while GPT-4 achieves 4.81 overall and 5.00 order