——我们如何打造以支持推动人们前行的AI——
在 AI Avatar 株式会社,我们秉持一个简单却有力的理念开发对话式AI:支持应当推动人们前行。
但是,如何打造一款不只是给出正确答案,而是真正与人类情感产生共鸣的AI呢?
在本次采访中,我们与站在AI Avatar开发最前沿的工程师进行了对话。他们分享了打造一款真正贴近人心的AI背后的设计理念、实验历程与无数次迭代。
■认识AI Avatar背后的四位开发者
Shinbo | 产品团队负责人兼产品经理(左)
Shinbo 兼具工程师与产品经理的经验,负责统筹产品整体进度与团队协调。他的职责是在技术、用户体验与安全性之间取得平衡,做出关键决策,确保AI Avatar真正与人产生连接。
TJ | 产品经理兼LLM负责人(远程)
TJ 负责〈饮食坚持AI Avatar〉与〈标志性人格Avatar〉的开发,统筹LLM设计与产品规划工作。他借助个人经历,探索AI如何支持习惯养成与自我实现,并将这些洞察直接转化为产品功能。
An | AI工程师兼桥梁系统工程师(右)
An 负责AI与TTS(文字转语音)开发,并在日本与越南开发团队之间发挥桥梁作用。除工程工作外,她还专注于AI Avatar的沟通方式,细致考量用户体验与文化差异。
Fukunaga | LLM工程师(远程/以Avatar形式出镜)
Fukunaga 原本独立从事AI与游戏开发工作,出于对打造”能与人自然对话的AI”的浓厚兴趣而加入本项目。他目前专注于智能体开发与提示词设计,精心打磨能够回应用户语境与情感的语言表达。
■究竟是什么让AI真正贴近人心?
仅仅给出答案的AI,与能够引起情感共鸣的AI,二者之间的区别究竟在哪里?每位开发者都分享了自己的见解。
Fukunaga
我认为”贴近人心的AI”承担着两个不可或缺的角色。一是给出准确的答案。二是理解此刻这个人需要怎样的话语。这并非二选一,而是要判断哪种方式更适合用户当下的状态。即便人们每天都在使用生成式AI,也会有完全不想要答案的时刻。正因如此,当AI扮演类似咨询师的角色时,它应当理解当下情境、谨慎斟酌用词,给出能够温和鼓励用户采取积极行动的话语——哪怕只是迈出小小的一步。
TJ
对我而言,友好的用户体验源于对Avatar所体现的思想与理念的充分内化。在开发〈标志性人格Avatar〉时,我并不只是复制原型人物的言行,而是专注于理解他们为何选择那样的措辞。通过在设计之前先解读并内化这种理念,最终呈现出的表达会更加自然——用户也能感受到这份真实感。
An
准确性与效率固然重要,但我认为趣味性更为重要。当人们觉得”这很有趣”或”我还想再用一次”时,AI才算真正与人建立起了连接。借助AI AVATAR的自定义Avatar功能,用户在看到属于自己的独特Avatar动起来时,常常会不禁莞尔。正是这份喜悦,让AI显得亲切而友善。
秉持这一理念,AI AVATAR 致力于打造让AI感觉更像是个人化的存在,而非单纯的工具的体验。在应用中,用户可以与伙伴Avatar互动,或创建自定义Avatar,自由设置面部照片、声音、性格与说话风格。通过日常对话——无论是作为值得信赖的知己,还是个人的另一个自我——我们致力于培养积极情绪与自我肯定感。
参考链接:https://prtimes.jp/main/html/rd/p/000000022.000128303.html
■将”陪伴在侧”转化为技术
如何将”陪伴在侧”的感觉转化为代码?团队分享了具体的实现方式。
Fukunaga
仅仅接收用户的话语是不够的。同一句话,会因语境或语气不同而传达出截然不同的情感。人类会无意识地读取停顿、情绪与微妙的暗示。我们面临的挑战,是捕捉这些未言明的要素,将其转化为语言,并传递给AI。例如,日语对话中常常会避免直接使用”你”这样的称谓。仔细观察日常言语,并将这些无意识的细微差别转化为设计元素,正是让AI显得更像人的第一步。
TJ
我们优先考虑”不让用户等待”与”不让用户感到不适”。这意味着必须持续不断地优化——响应速度、基于语境的模型选择,以及能够随用户反馈不断进化的灵活架构。例如,〈标志性人格Avatar〉最初会直接返回存储的知识内容。基于反馈,我们将其语气调整为自然陪伴用户、无需过度思考的风格。自上线以来,用户反响一直非常积极。
An
为了真正陪伴用户,AI AVATAR并不只依赖当下的对话,还会融入过往的互动记录,让用户真切地感受到被看见。在语音对话中,像”嗯”或”原来如此”这样的应答词至关重要。这些细微的暗示传达出专注倾听的态度。在实现这一功能后,用户的反馈证实了这份努力是值得的。
Shinbo
人类无意识做出的行为,用技术复现起来极为困难。即使是一句简单的应答词,若时机不对也会显得突兀。正因如此,我们不断自问:”这个回应是否适合此刻?”AI Avatar的开发,是一个理解、响应、审视与打磨不断循环的过程。
■建立信任:从设计之初融入安全与隐私保护
确保用户感到安全,是不容妥协的原则。
TJ
为了成为用户可以分享真实想法的场所,安全性与输出内容的安全是我们的最高优先事项。我们持续依据官方准则与最新研究进行测试,以应对恶意输入与意外行为。我们还针对敏感话题与攻击性提示词,实施了服务专属的防护机制,通过多样化的测试模式验证行为表现,同时在安全性与功能改进之间保持平衡。
An
我们在严格合规的框架下处理个人数据,包括遵守GDPR的相关要求。我们只收集必要的信息,绝不在未经同意的情况下使用数据,并对数据的获取、存储与删除进行细致管理——包括删除超出既定保留期限的数据。
■开发者确信自己走在正确道路上的时刻
确认自己方向正确的时刻,往往悄然而至。
Fukunaga
用户的直接反馈并不多见,但当我们听到”回应感觉更好了”这样的评论,或看到对话量的增长时,就能确认我们的打磨确实有效。由于这项工作没有唯一的正确答案,即便是微小的数字变化,也显得意义非凡。
Shinbo
我自己使用〈饮食坚持AI Avatar〉的经历令我大开眼界。通过每天的对话,我亲身感受到了新习惯的养成。这让我确信,AI确实能够切实支持人的转变——这段经历也直接强化了我们的产品愿景。
■AI Avatar的未来
以人为本的AI,下一步将走向何方?
Fukunaga
AI Avatar终将如水一般,成为一种自然融入日常的存在。要达到这一境界,我们必须跨越”这不过是AI”的心理屏障,并深入理解人类的感官与无意识行为。
TJ
除文字与语音之外,AI还将通过非语言互动与实际支持,融入日常生活。个性化、真实感与平台整合是我们面临的关键挑战——我们将致力于把技术转化为真正的产品。
An
AI Avatar将超越单纯的自定义功能,通过反复的对话不断适应每一位用户。通过降低行动的门槛,AI能够帮助更多人迈出第一步。
Shinbo
AI Avatar正逐渐从我们主动寻求使用的工具,转变为能够温和察觉未言明的烦恼与情绪变化的存在。我们的目标是实现无缝的对话——理解言语之外的停顿、表情与情感。
■关于对话式AI应用”AI AVATAR”
AI AVATAR是您无条件的应援者。它能实时读取语音语调与面部表情中的情感,并以贴合您当下心情的共情与鼓励作出回应。我们的目标,是打造一个能够在您努力成为更好的自己的过程中,温柔支持您的存在。