Lulula AI
为内容创作者与打工人提供全双工实时语音AI助手,支持自然打断与空间音效交互
实时语音智能体 + AI 音频世界
项目介绍
Lulula 是一款新一代实时语音智能体,致力于打破传统 AI 回合制范式。产品以全双工实时语音为核心,支持插嘴、打断和追问,并将语音回复、动作反馈、环境声音与 3D 空间音效融为一体,辅以共享任务文档,构建出可感知、可互动、有存在感的 AI Agent。产品采用本地隐私加云端路由的混合架构,兼顾隐私保护与模型能力,面向长程任务的共享文档协同,让语音不再是一次性指令通道,而是与任务文档实时联动,支持用户与 AI 边说边想、持续推进复杂工作流。 Bonjour 找工地图补充: 让 Agent 适配人的交互带宽 现在的 AI 都是人去适应机器——打字、写 prompt。Lulula 想反过来,让 Agent 适配人的交互带宽,给 AI 真正的声音、身体感与空间环境感。 不是拼接 ASR + LLM + TTS 的管线,而是端到端大模型同时生成语音、动作声、行为——能在对话中主动打断、给出即时回应(back channel),像真人一样自然交互。 除了视觉,Lulula 用 3D 沉浸听觉让 AI 的存在感「如在身边」——开心时拍手、cheers 时碰杯,带空间与时间的逻辑关系。 Lulula 入选奇绩创坛 2026 春季营(S26),在路演日亮相。 创始团队多为字节前同事,核心成员分别来自百度文心、字节扣子与豆包团队,语音算法负责人为顶尖博士,累计发表音频顶会论文 20 余篇。 Lulula 的 Agent 性格鲜明,能与用户自然互动甚至会「怼」用户,交互行为自然涌现——不只是语音助手,更像一个有态度的 AI 伙伴。 端到端语音对话系统,核心指标:
创始团队
孙长昊
创始人 & CEO创始人 & CEO,字节 Coze 早期核心成员,百度文心一言创始团队核心成员;曾在腾讯、旷视负责 AI 产品与智能硬件业务,主导/参与 10+ AI 产品从 0 到 1;负责 Lulula 的产品战略、商业化。
Dr.Sam
首席语音科学家 & 语音模型负责人首席语音科学家 & 语音模型负责人,长期深耕语音方向,发表论 文 20 余篇,多次在国际赛事中获得冠军。
孙靖凯
联合创始人 & 核心工程负责人联合创始人 & 核心工程负责人,前百度 MEG AIGC 创作研发组核心成员,主导视频 AI 剪辑与动态漫编辑器,具备文生视频、 大模型 编排、高并发后端与多模态 AIGC 产品落地经验。
Brick
业务架构师 & 语音工程化负责人业务架构师 & 语音工程化负责人,前滴滴语音工程负责人,长期负责 TTS / ASR / VAD 等语音系统工程化落地。