Multimodal AI Engineer: Vision-Language in Production

Tether.io

United Arab Emirates

On-site

AED 293,793 - 440,690

Full time

14 days+
Application generator

Stand out for this role — generate a tailored resume and cover letter in about a minute.

Get past ATS filters

Job summary

Tether.io is looking for a passionate member of the AI model team to drive innovation in vision-language models. This role focuses on the full development lifecycle, from data curation to model evaluation and optimization, to create highly capable models for real-world applications.

You will collaborate within a small, talented team, leveraging cutting-edge technology in a setting that values your contributions to push the boundaries of multimodal AI.

Qualifications

  • Strong experience with multimodal post-training workflows including supervised fine-tuning.
  • Hands-on experience with distributed training frameworks.
  • Demonstrated ability to build and improve vision-language models.

Responsibilities

  • Conduct end-to-end research and engineering on vision-language models.
  • Design and implement evaluation frameworks and benchmarks.
  • Build and scale training workflows across distributed GPU infrastructure.

Skills

Multimodal post-training workflows
Parameter-efficient fine-tuning
Reinforcement learning from feedback
Data curation and filtering

Education

Degree in Computer Science, Machine Learning, or a related field

Tools

GitHub
HuggingFace

Job description

Tether.io is looking for a passionate member of the AI model team to drive innovation in vision-language models. This role focuses on the full development lifecycle, from data curation to model evaluation and optimization, to create highly capable models for real-world applications.

You will collaborate within a small, talented team, leveraging cutting-edge technology in a setting that values your contributions to push the boundaries of multimodal AI.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Multimodal Vision AI Engineer (LLM Integration)
Multimodal Vision AI Engineer (LLM Integration)

Duncan & Ross Consulting • Abu Dhabi

On-site
AED 331,000 - 477,000
COMPUTER VISION ENGINEER (LLM & AI Integration)
COMPUTER VISION ENGINEER (LLM & AI Integration)

Duncan & Ross Consulting • Abu Dhabi

On-site
AED 331,000 - 477,000
AI Research Engineer (Pre-training - LLM & Multi-Modal)
AI Research Engineer (Pre-training - LLM & Multi-Modal)

Remotedxb • Dubai

On-site
AED 2,500,000 - 4,000,000
AI Research Engineer: LLM & Multimodal Pre-training
AI Research Engineer: LLM & Multimodal Pre-training

Remotedxb • Dubai

On-site
AED 2,500,000 - 4,000,000
Vision-Language AI Research Engineer
Vision-Language AI Research Engineer

Technology Innovation Institute • United Arab Emirates

On-site
AED 400,000 - 700,000
AI Engineer
AI Engineer

Technology Innovation Institute • United Arab Emirates

On-site
AED 257,000 - 331,000
Senior AI Engineer
Senior AI Engineer

Technology Innovation Institute • United Arab Emirates

On-site
AED 300,000 - 450,000
Senior AI Scientist: Multimodal Research & Real-World Impact
Senior AI Scientist: Multimodal Research & Real-World Impact

Inception42 • Abu Dhabi

On-site
AED 350,000 - 550,000
AI Engineer: Architect & Deploy Multimodal AI Systems
AI Engineer: Architect & Deploy Multimodal AI Systems

AGAPI Technologies • United Arab Emirates

On-site
AED 180,000 - 280,000
Competitive compensation
Visa processing and UAE benefits
Generous holidays
+3
VLM Engineer
VLM Engineer

Technology Innovation Institute • United Arab Emirates

On-site
AED 400,000 - 700,000