模思智能亮相 ChinaJoy,CEO 李世民围绕 “联接 AI、人与物理世界” 发表演讲

模思智能联合创始人、CEO李世民围绕“联接 AI、人与物理世界”发表演讲

在7月31日举行的ChinaJoy AI未来生态大会上,模思智能联合创始人、CEO 李世民围绕“联接 AI、人与物理世界”,分享了对下一代人机交互的判断:

当交互从文本、PC 和手机走向语音、视觉、空间及环境信号,模型要理解的已不只是一条指令,而是更长、更复杂、更多元的真实情境。

围绕“情境智能”,模思智能正在构建面向真实世界的 MOSS 系列大模型。

模思智能李世民围绕“情境智能”发表主题演讲

语音方向,MOSS-Audio 面向声音与音频情境理解;MOSS-Transcribe-Diarize 聚焦嘈杂、重叠和多说话人场景,让模型更准确地识别“谁在什么时候说了什么”;MOSS-TTS Family 则覆盖自然语音生成、音色克隆、长文本、多人对话、实时流式语音与声音设计。

视觉方向,MOSS-VL-Realtime 可在连续视频流中边看、边理解、边回应,实现更及时的主动交互。

从声音切入,走向全模态理解与生成;

从开放模型,到 MOSS Create 与 MossAPI;

模思智能正让 AI 不只识别信息,更能理解情境,自然联接人与世界。