Find jobs
Pricing
FIND JOBSPRICINGSIGN INSIGN UP
← Back
HY
Hyphen Connect Limited

Multimodal AI Systems Architect (AI Engineering)

All locations for this role
United States, China
United States, San Francisco Bay Area, USA
United States, Australia
United States, Singapore
United States, Hong Kong
United States, Seattle, USA
United States, Oregon, USA
United States, Boston, USA
Location
United States, China
Department
Engineering
Last seen
1h ago
We are seeking a talented Multimodal AI Systems Architect to develop and optimize AI systems that seamlessly integrate vision and audio models. This role focuses on enhancing our voice-to-voice interactions and multimodal retrieval capabilities, ensuring our systems are efficient and innovative.
Responsibilities:
•
Integrate vision encoders and audio-native models into core agent reasoning loops.
•
Optimize streaming latency for voice-to-voice AI interactions.
•
Architect multimodal RAG systems capable of retrieving insights from videos and PDFs.
Qualifications:
•
Experience with Whisper, CLIP, and multimodal LLM integration.
•
Knowledge of streaming architectures and WebRTC.
•
Expertise in cross-modal alignment.
Seekless
Product
Find jobsPricing
Legal
PrivacyTermsCookies
© 2026 SEEKLESS, INC. ALL RIGHTS RESERVED.BUILT WITH CARE