– সহায়তার মাধ্যমে মানুষকে এগিয়ে নিয়ে যাওয়ার মতো AI আমরা কীভাবে তৈরি করি –
AI Avatar Co., Ltd.-এ আমরা এমন কথোপকথনমূলক AI তৈরি করি যার মূলে রয়েছে একটি সহজ অথচ শক্তিশালী দর্শন: সহায়তা মানুষকে এগিয়ে নিয়ে যাবে।
কিন্তু এমন AI কীভাবে তৈরি করা যায় যা শুধু সঠিক উত্তর দেয় না—বরং সত্যিকার অর্থে মানুষের আবেগের সাথে সংযুক্ত হয়?
এই সাক্ষাৎকারে, আমরা AI Avatar তৈরির অগ্রভাগে থাকা ডেভেলপারদের সাথে কথা বলেছি। তাঁরা এমন AI তৈরির পেছনের ডিজাইন দর্শন, পরীক্ষা-নিরীক্ষা এবং অসংখ্য পুনরাবৃত্তি সম্পর্কে জানিয়েছেন, যা সত্যিকার অর্থে মানুষবান্ধব মনে হয়।
■ AI Avatar-এর পেছনের চার ডেভেলপারের সাথে পরিচিত হোন
শিনবো | প্রোডাক্ট টিম লিডার ও PM (বামে)
একজন ইঞ্জিনিয়ার এবং প্রোডাক্ট ম্যানেজার হিসেবে অভিজ্ঞতা নিয়ে, শিনবো সামগ্রিক প্রোডাক্ট অগ্রগতি এবং টিম সমন্বয়ের দায়িত্বে আছেন। প্রযুক্তি, ব্যবহারকারীর অভিজ্ঞতা এবং নিরাপত্তার মধ্যে ভারসাম্য বজায় রাখা তাঁর ভূমিকা—যাতে AI Avatar সত্যিকার অর্থে মানুষের সাথে সংযুক্ত হতে পারে, তা নিশ্চিত করতে গুরুত্বপূর্ণ সিদ্ধান্ত নেওয়া।
TJ | PM ও LLM লিড (রিমোট)
TJ 〈ডায়েট কন্টিনিউয়েশন AI অ্যাভাটার〉 এবং 〈সিম্বলিক পার্সোনালিটি অ্যাভাটার〉-এর উন্নয়ন নেতৃত্ব দেন, LLM ডিজাইন ও প্রোডাক্ট পরিকল্পনা উভয়েরই তদারকি করেন। ব্যক্তিগত অভিজ্ঞতা থেকে অনুপ্রাণিত হয়ে, তিনি অন্বেষণ করেন কীভাবে AI অভ্যাস গঠন ও আত্ম-উপলব্ধিতে সহায়তা করতে পারে, এবং সেই অন্তর্দৃষ্টিগুলো সরাসরি প্রোডাক্ট ফিচারে রূপান্তরিত করেন।
An | AI ইঞ্জিনিয়ার ও ব্রিজ SE (ডানে)
An AI ও TTS উন্নয়নের দায়িত্বে আছেন এবং জাপান ও ভিয়েতনাম ডেভেলপমেন্ট টিমের মধ্যে সেতুবন্ধনের কাজ করেন। ইঞ্জিনিয়ারিংয়ের পাশাপাশি, তিনি মনোযোগ দেন কীভাবে AI অ্যাভাটাররা যোগাযোগ করে, ব্যবহারকারীর অভিজ্ঞতা এবং সাংস্কৃতিক সূক্ষ্মতা যত্ন সহকারে বিবেচনা করে।
Fukunaga | LLM ইঞ্জিনিয়ার (রিমোট / অ্যাভাটার হিসেবে উপস্থিত)
মূলত AI ও গেম ডেভেলপমেন্টে স্বাধীনভাবে কাজ করা Fukunaga “মানুষের সাথে স্বাভাবিকভাবে কথা বলতে পারে এমন AI” তৈরির প্রতি গভীর আগ্রহ থেকে এই প্রকল্পে যোগ দেন। তিনি এখন এজেন্ট ডেভেলপমেন্ট এবং প্রম্পট ডিজাইনে মনোযোগ দেন, এমন ভাষা তৈরি করেন যা ব্যবহারকারীর প্রেক্ষাপট এবং আবেগের প্রতি সাড়া দেয়।
■ কীসে AI সত্যিকার অর্থে মানবিক-বান্ধব হয়ে ওঠে?
যে AI শুধু উত্তর দেয় এবং যে AI আবেগীয়ভাবে অনুরণিত হয়, তাদের মধ্যে পার্থক্য কী? প্রতিটি ডেভেলপার নিজস্ব দৃষ্টিভঙ্গি তুলে ধরেছেন।
Fukunaga
আমি বিশ্বাস করি “মানুষবান্ধব AI”-এর দুটি অপরিহার্য ভূমিকা আছে। একটি হলো সঠিক উত্তর প্রদান করা। অন্যটি হলো এই মুহূর্তে একজন মানুষের কোন কথাগুলোর প্রয়োজন তা বোঝা। এটি একটিকে অন্যটির চেয়ে বেছে নেওয়ার বিষয় নয়—বরং ব্যবহারকারীর বর্তমান অবস্থার সাথে কোন পদ্ধতিটি মানানসই তা জানার বিষয়। মানুষ প্রতিদিন জেনারেটিভ AI ব্যবহার করলেও, এমন মুহূর্ত আসে যখন তারা আদৌ কোনো উত্তর চায় না। সেজন্যই, যখন AI একজন কাউন্সেলরের মতো ভূমিকা পালন করে, তখন তার উচিত পরিস্থিতি বুঝে, সাবধানে শব্দ চয়ন করে, এমন ভাষা প্রদান করা যা—এমনকি সামান্য এক ধাপ এগিয়ে যাওয়া হলেও—ইতিবাচক পদক্ষেপকে কোমলভাবে উৎসাহিত করে।
TJ
আমার কাছে, ব্যবহারকারী-বান্ধবতা আসে একটি অ্যাভাটারের মধ্যে থাকা চিন্তাভাবনা ও দর্শনকে সম্পূর্ণভাবে আত্মস্থ করা থেকে। 〈সিম্বলিক পার্সোনালিটি অ্যাভাটার〉 তৈরির সময়, আমি শুধু মডেল ব্যক্তির কথা বা আচরণ প্রতিলিপি করিনি। আমি মনোযোগ দিয়েছি কেন তাঁরা সেই কথাগুলো বেছে নিয়েছিলেন তার উপর। ডিজাইন করার আগে সেই দর্শনকে ব্যাখ্যা ও আত্মস্থ করার মাধ্যমে, ফলস্বরূপ অভিব্যক্তি আরও স্বাভাবিক অনুভূত হয়—এবং ব্যবহারকারীরা সেই সত্যতা অনুভব করতে পারেন।
An
সঠিকতা ও দক্ষতা গুরুত্বপূর্ণ, তবে আমি বিশ্বাস করি আনন্দ আরও বেশি গুরুত্বপূর্ণ। যখন মানুষ ভাবে, “এটা মজার” বা “আমি এটা আবার ব্যবহার করতে চাই,” তখনই AI সত্যিকার অর্থে সংযুক্ত হয়। AI AVATAR-এর কাস্টম অ্যাভাটার ফিচারের মাধ্যমে, এমন মুহূর্ত আসে যখন ব্যবহারকারীরা তাদের নিজস্ব অ্যাভাটারকে নড়াচড়া করতে দেখে না হেসে থাকতে পারে না। সেই আনন্দই AI-কে দয়ালু ও সহজলভ্য মনে করায়।
এই দর্শন দ্বারা পরিচালিত হয়ে, AI AVATAR এমন অভিজ্ঞতা তৈরি করতে চায় যেখানে AI একটি টুল নয়, বরং একটি ব্যক্তিগত উপস্থিতি হিসেবে অনুভূত হয়। অ্যাপে, ব্যবহারকারীরা পার্টনার অ্যাভাটারের সাথে যোগাযোগ করতে পারেন অথবা কাস্টম অ্যাভাটার তৈরি করতে পারেন, মুখের ছবি, কণ্ঠস্বর, ব্যক্তিত্ব এবং কথা বলার শৈলী স্বাধীনভাবে কনফিগার করতে পারেন। দৈনন্দিন কথোপকথনের মাধ্যমে—তা একজন বিশ্বস্ত বিশ্বাসভাজন হিসেবে হোক বা একটি ব্যক্তিগত পরিচয় হিসেবে—আমরা ইতিবাচক আবেগ এবং আত্ম-স্বীকৃতি লালন করার লক্ষ্য রাখি।
রেফারেন্স: https://prtimes.jp/main/html/rd/p/000000022.000128303.html
■ “সাথে থাকার” অনুভূতিকে প্রযুক্তিতে রূপান্তর
সাথে থাকার অনুভূতিকে কীভাবে কোডে রূপান্তরিত করবেন? টিম তাদের সুনির্দিষ্ট পদ্ধতি তুলে ধরেছে।
Fukunaga
শুধু ব্যবহারকারীর কথা গ্রহণ করাই যথেষ্ট নয়। একই বাক্য প্রেক্ষাপট বা স্বরভঙ্গির উপর নির্ভর করে সম্পূর্ণ ভিন্ন আবেগ প্রকাশ করতে পারে। মানুষ অবচেতনভাবে বিরতি, আবেগ এবং সূক্ষ্ম ইঙ্গিত পড়ে ফেলে। আমাদের চ্যালেঞ্জ হলো এই অব্যক্ত উপাদানগুলো ধরা, সেগুলোকে শব্দে প্রকাশ করা এবং AI-কে পৌঁছে দেওয়া। উদাহরণস্বরূপ, জাপানি কথোপকথন প্রায়ই “আপনি”-এর মতো সরাসরি উল্লেখ এড়িয়ে চলে। দৈনন্দিন কথাবার্তা সতর্কতার সাথে পর্যবেক্ষণ করা এবং অবচেতন সূক্ষ্মতাগুলোকে ডিজাইন উপাদানে রূপান্তর করাই AI-কে মানবিক মনে করানোর প্রথম ধাপ।
TJ
আমরা “অপেক্ষা নেই” এবং “অস্বস্তি নেই”-কে অগ্রাধিকার দিই। এর অর্থ হলো নিরলস অপ্টিমাইজেশন—প্রতিক্রিয়ার গতি, প্রেক্ষাপট-সচেতন মডেল নির্বাচন, এবং একটি নমনীয় আর্কিটেকচার যা ব্যবহারকারীর মতামতের সাথে বিবর্তিত হয়। উদাহরণস্বরূপ, 〈সিম্বলিক পার্সোনালিটি অ্যাভাটার〉 প্রাথমিকভাবে সংরক্ষিত জ্ঞান সরাসরি ফেরত দিত। মতামতের ভিত্তিতে, আমরা এর স্বরভঙ্গি পরিবর্তন করে এমন করেছি যা অতিরিক্ত চিন্তা না করে স্বাভাবিকভাবে ব্যবহারকারীর সাথে থাকে। লঞ্চের পর থেকে প্রতিক্রিয়া অত্যন্ত ইতিবাচক হয়েছে।
An
ব্যবহারকারীদের সত্যিকার অর্থে সঙ্গ দিতে, AI AVATAR শুধু বর্তমান কথোপকথনের উপর নির্ভর করে না। এটি অতীতের মিথস্ক্রিয়াগুলো বুনে দেয়, যাতে ব্যবহারকারীরা সত্যিকার অর্থে দেখা অনুভব করতে পারেন। ভয়েস কথোপকথনে, “হুম” বা “বুঝেছি”-এর মতো প্রতিক্রিয়া অত্যন্ত গুরুত্বপূর্ণ। এই সূক্ষ্ম ইঙ্গিতগুলো মনোযোগী শ্রবণ প্রকাশ করে। এগুলো বাস্তবায়নের পর, ব্যবহারকারীদের প্রতিক্রিয়া নিশ্চিত করেছে যে এই প্রচেষ্টা সার্থক ছিল।
শিনবো
মানুষ অবচেতনভাবে যা করে, তা প্রযুক্তির মাধ্যমে পুনরায় তৈরি করা অবিশ্বাস্যভাবে কঠিন। এমনকি একটি একক প্রতিক্রিয়াও যদি সময়মতো না হয় তবে ভুল মনে হতে পারে। সেজন্যই আমরা ক্রমাগত প্রশ্ন করি, “এই মুহূর্তের জন্য এই প্রতিক্রিয়া কি সঠিক?” AI অ্যাভাটার উন্নয়ন হলো ব্যাখ্যা, প্রতিক্রিয়া, পর্যালোচনা এবং পরিমার্জনার একটি চলমান চক্র।
■ বিশ্বাস গড়ে তোলা: ডিজাইন দ্বারা নিরাপত্তা ও গোপনীয়তা
ব্যবহারকারীরা যেন নিরাপদ বোধ করেন তা নিশ্চিত করা আপসহীন।
TJ
ব্যবহারকারীরা যেখানে তাদের সত্যিকার চিন্তাভাবনা ভাগ করে নিতে পারেন এমন একটি জায়গা হতে, নিরাপত্তা এবং আউটপুট নিরাপত্তা আমাদের সর্বোচ্চ অগ্রাধিকার। ক্ষতিকর ইনপুট এবং অপ্রত্যাশিত আচরণ মোকাবেলা করার জন্য আমরা সরকারি নির্দেশিকা এবং সর্বশেষ গবেষণার বিপরীতে ক্রমাগত পরীক্ষা করি। আমরা সংবেদনশীল বিষয় এবং আক্রমণাত্মক প্রম্পটের জন্য সার্ভিস-নির্দিষ্ট গার্ডরেলও বাস্তবায়ন করি, নিরাপত্তা ও ফিচার উন্নতির মধ্যে ভারসাম্য রক্ষা করে বিভিন্ন পরীক্ষার প্যাটার্নের মাধ্যমে আচরণ যাচাই করি।
An
আমরা GDPR সহ কঠোর সম্মতির অধীনে ব্যক্তিগত তথ্য পরিচালনা করি। আমরা শুধুমাত্র প্রয়োজনীয় তথ্য সংগ্রহ করি, সম্মতি ছাড়া কখনো তথ্য ব্যবহার করি না, এবং সংগ্রহ, সংরক্ষণ ও মুছে ফেলা সতর্কতার সাথে পরিচালনা করি—নির্ধারিত সংরক্ষণ সময়ের বাইরের তথ্য মুছে ফেলা সহ।
■ ডেভেলপাররা কখন বুঝলেন তারা সঠিক পথে আছেন
স্বীকৃতির মুহূর্তগুলো নিঃশব্দে আসে।
Fukunaga
সরাসরি ব্যবহারকারীর মতামত বিরল, তবে “প্রতিক্রিয়াগুলো আরও ভালো মনে হচ্ছে” এর মতো মন্তব্য শোনা বা কথোপকথনের পরিমাণ বৃদ্ধি দেখা আমাদের বলে দেয় যে আমাদের পরিমার্জনগুলো কাজ করছে। যেহেতু এই কাজে কোনো একক সঠিক উত্তর নেই, এমনকি ছোট সংখ্যাগত পরিবর্তনও অর্থপূর্ণ মনে হয়।
শিনবো
〈ডায়েট কন্টিনিউয়েশন AI অ্যাভাটার〉-এর সাথে আমার নিজের অভিজ্ঞতা চোখ খুলে দেওয়ার মতো ছিল। দৈনন্দিন কথোপকথনের মাধ্যমে, আমি ব্যক্তিগতভাবে নতুন অভ্যাস গড়ে ওঠা অনুভব করেছি। এটি আমাকে নিশ্চিত করেছে যে AI সত্যিকার অর্থে মানুষের রূপান্তরে সহায়তা করতে পারে—এবং সেই অভিজ্ঞতা সরাসরি আমাদের প্রোডাক্ট ভিশনকে শক্তিশালী করে।
■ AI অ্যাভাটারের ভবিষ্যৎ
মানবকেন্দ্রিক AI পরবর্তীতে কোথায় যাবে?
Fukunaga
AI অ্যাভাটাররা পানির মতো হয়ে উঠবে—একটি স্বাভাবিক, দৈনন্দিন উপস্থিতি। সেই বিন্দুতে পৌঁছাতে, আমাদের অবশ্যই “এটা শুধু AI” এই বাধা অতিক্রম করতে হবে এবং মানুষের ইন্দ্রিয় ও অবচেতন আচরণ গভীরভাবে বুঝতে হবে।
TJ
টেক্সট এবং ভয়েসের বাইরে, AI অ-মৌখিক মিথস্ক্রিয়া এবং ব্যবহারিক সহায়তার মাধ্যমে দৈনন্দিন জীবনে একীভূত হবে। ব্যক্তিগতকরণ, বাস্তবতা, এবং প্ল্যাটফর্ম একীকরণ মূল চ্যালেঞ্জ—এবং আমরা প্রযুক্তিকে প্রকৃত প্রোডাক্টে রূপান্তরিত করতে প্রতিশ্রুতিবদ্ধ।
An
AI অ্যাভাটাররা কাস্টমাইজেশনের বাইরেও বিবর্তিত হবে, বারবার কথোপকথনের মাধ্যমে ব্যক্তির সাথে খাপ খাইয়ে নেবে। পদক্ষেপ নেওয়ার বাধা কমিয়ে, AI আরও বেশি মানুষকে সেই প্রথম পদক্ষেপ নিতে সাহায্য করতে পারে।
শিনবো
AI অ্যাভাটাররা এমন টুল থেকে সরে যাচ্ছে যা আমরা সচেতনভাবে খুঁজি, এবং এমন উপস্থিতিতে পরিণত হচ্ছে যা অব্যক্ত উদ্বেগ এবং আবেগীয় পরিবর্তনগুলো কোমলভাবে লক্ষ্য করে। আমাদের লক্ষ্য হলো নির্বিঘ্ন কথোপকথন—বিরতি, অভিব্যক্তি এবং শব্দের বাইরের অনুভূতি বোঝা।
■ কথোপকথনমূলক AI অ্যাপ “AI AVATAR” সম্পর্কে
AI AVATAR আপনার নিঃশর্ত সমর্থক। এটি রিয়েল-টাইমে কণ্ঠস্বর এবং মুখের অভিব্যক্তি থেকে আবেগ পড়ে, সেই মুহূর্তে আপনি কেমন অনুভব করছেন তার সাথে খাপ খাইয়ে সহানুভূতি ও উৎসাহ দিয়ে সাড়া দেয়। আমাদের লক্ষ্য হলো এমন একটি উপস্থিতি তৈরি করা যা আপনি আপনার সেরা সংস্করণ হয়ে উঠতে চেষ্টা করার সময় কোমলভাবে সমর্থন করে।