About the team
The Seed Vision team focuses on foundational models for visual generation, developing multimodal generative models, and carrying out leading research and application development to solve fundamental computer vision challenges in GenAI.
Responsibilities
- Develop and scale vision foundation models across image and video modalities.
- Design data pipelines, pre-training strategies, and post-training methods for vision tasks.
- Improve core capabilities such as perception, reasoning, and multimodal understanding.
- Optimize model architectures, training efficiency, and evaluation frameworks.
- Explore real-world applications of vision models in multimodal systems.
Minimum Qualifications
- Individuals who are completing or have recently completed a Bachelor's in Computer Science, Electrical Engineering, Electrical and Computer Engineering, Physics, Mathematics, or a related discipline.
- Excellent coding ability, data structures, and fundamental algorithm skills, proficient in C/C++ or Python, etc.
- Demonstrated interest or project experience in relevant areas.
Preferred Qualifications
- Experience with computer vision, multimodal learning, or machine learning through internships is preferred.
- Strong problem-solving and communication skills.