دانشجوی دکترای زبانشناسی در دانشگاه گنت (Ghent University)، بلژیک — پژوهشگر پردازش زبان طبیعی و عاملهای مکالمهای همدلانه
صادق جعفری از فبروری ۲۰۲۵ در مقطع دکترای زبانشناسی دانشگاه گنت بلژیک مشغول تحصیل است و زیر نظر پروفسور ورونیک هوسته، پروفسور اِلس لوفِیوِر و پروفسور تونی بلپیم روی طراحی عاملهای مکالمهای چندوجهی همدلانهتر کار میکند. او مدرک ماستری خود را در رشتهی کمپیوتر ساینس با معدل ۳.۷۷ و مدرک لیسانس خود را نیز در همین رشته با معدل ۳.۷۶، هر دو از پوهنتون علم و صنعت ایران، به دست آورده است. صادق تاکنون در بیش از یکده مقالهی علمی در کنفرانسها و ورکشاپهای معتبر بینالمللی NLP مانند LREC، EACL، COLING و EMNLP مشارکت داشته و تجربهی پژوهشی خود را در سنگاپور، دنمارک و ایران کسب کرده است.
اسیستانت تحقیقاتی — شرکت سِنتیکنت (SenticNet)، دانشکدهی محاسبات و علم دیتای پوهنتون تکنالوژیکی نانیانگ (NTU)، سنگاپور
کار روی تولید و ارزیابی ویدیوهای احساسی با استفاده از مدلهای تولیدی گوناگون، با هدف افزایش دیتاستها برای آموزش end-to-end مدلهای زبانی بزرگ چندوجهی (MLLMs) در تولید محتوای احساسی.
اسیستانت تحقیقاتی — لابراتوار NLPnorth، دیپارتمنت کمپیوتر ساینس پوهنتون آیتی کوپنهاگن
همکاری در پروژهای برای بهبود Lang2Vec، با هدف یافتن یک امبدینگ برای هر زبان جهت تقویت مدلهای NLP برای زبانهای کممنبع؛ مسئولیت شناسایی بهترین مدل برای تشخیص مقادیر گمشده و انتخاب ویژگی برای این وظیفه.
اسیستانت تحقیقاتی — لابراتوار NLP، دیپارتمنت انجینیری کمپیوتر پوهنتون علم و صنعت ایران
رهبری تیمی متشکل از پنج دانشجوی لیسانس با هدف طراحی چتباتی که افراد نیازمند حمایت روانی را از روی پستهای شبکههای اجتماعی تشخیص داده و در مسیر بهبودی همراهی میکند.
اسیستانت تحقیقاتی — لابراتوار دیتا ماینینگ، پوهنتون علم و صنعت ایران
ایجاد یک دیتاست تشخیص موجودیتهای نامدار (NER) برای زبان فارسی و تلاش برای ساخت ابزاری جهت پیونددادن این موجودیتها به صفحات ویکیپدیا.
مدیر پروژه و اسیستانت تحقیقاتی NLP — شرکت دادماتک (Dadmatech)
فعالیت روی Dadmatools، یک پروژهی متنباز منابع پردازش زبان طبیعی برای زبان فارسی، با استفاده از روش adapter برای ساخت یک پایپلاین برای وظایف گوناگون NLP؛ همکاری در پروژههای NLP سفارشی برای شرکتهای دیگر نیز از دیگر مسئولیتهای او بوده است.
پایتون دیولوپر — شرکت نتباکس آفیشل (NetboxOfficial)
کرالینگ معلومات فلم و موسیقی از سایتهای دیگر، نوشتن API های جنگو برای بازیابی معلومات فلم و موسیقی از دیتابیس، ساخت یک سیستم پیشنهاددهندهی فلم و تحلیل رفتار کاربران برای پیشبینی زمان استفادهی آنها از اپلیکیشن.
انکشافدهندهی دیتابیس اوراکل — شرکت طاهاتک (TahaTech)
طراحی یک دیتابیس برای مدیریت منابع چندین شرکت.
Towards Reliable Evaluation of Emotional Text Generation in LLMs: Human vs. Automatic Metrics
APARSIN: A Multi-Variety Sentiment and Translation Benchmark for Iranic Languages
Disentangling Emotion Understanding and Generation in Large Language Models
Embedding Analogies for Evaluating Emotion in LLM-Generated Utterances
data2lang2vec: Data Driven Typological Features Completion
DadmaTools V2: an Adapter-Based Natural Language Processing Toolkit for the Persian Language
Psychological Health Chatbot, Detecting and Assisting Patients in their Path to Recovery
A Silent Voice: A Bilingual Longitudinal Analysis of Mahsa Amini's Movement Tweets
DRAGON at FIGNEWS 2024 Shared Task: a Dedicated RAG for October 7th Conflict News
Measuring and Improving Software Testability at Design Level
A Longitudinal Study About Gradual Changes in the Iranian Online Public Sphere Pre and Post of "Mahsa Moment": Focusing on Twitter