Applied Scientist, Silicon and Systems Group Edge AI
This role involves developing and validating novel evaluation methods for multimodal language models used in Amazon's Edge AI devices. The scientist will analyze model performance using large datasets, interpret failures, and collaborate with cross-functional teams to improve model reliability and capabilities. Work includes advancing automated evaluation frameworks, particularly for perception tasks involving audio, vision, and language.