首页»版块 更多荣耀手机 荣耀Robot Phone 【评论赢京东卡】重塑交互想象!全场景触控与语音方案大 ...
#星火共创营#

【评论赢京东卡】重塑交互想象!全场景触控与语音方案大征集

    [复制帖子标题和链接]

1.2万74

啦啦啦啦啦啦啦啦啦啦  LV7  发表于 4 天前 河北 来自:荣耀X50 5G
AR空间虚实融合交互方案

适用场景

办公演示、设计创作、居家娱乐

触控交互

AR眼镜实现空中点选、拖拽、缩放虚拟窗口,手机可以当作触控外设操控AR画面;手机拍摄的图片直接拖拽到AR虚拟大屏展示给多人观看。多用户AR设备之间手势可以同步共享文件。

语音交互

对着虚拟屏幕口述编辑指令,修改文档、标注图片;多人在线AR会议,语音自动区分说话人,实时生成会议纪要。
啦啦啦啦啦啦啦啦啦啦  LV7  发表于 4 天前 河北 来自:荣耀X50 5G
终端统一快捷指令生态方案

适用场景

全场景(办公/出行/居家/游戏),覆盖手机、平板、PC、车机、智慧屏

交互设计

用户可以创建个人专属快捷指令库,指令同步到全部荣耀终端,支持三种触发方式:触控手势、语音口令、实体按键:
例:自定义「会议模式」
触发方式1:语音:“我开会了”
触发方式2:双击手机后盖
触发结果:自动开启录音转写、打开投屏、静音通知、平板同步会议笔记。
在车上喊同一个口令,车机自动开启会议免提。

触控优化

游戏设备、办公平板、车载中控共用一套用户自定义指令,不用给每一台设备单独设置操作习惯。
数码爱好者  LV7  发表于 3 天前 江苏 来自:荣耀Magic7 Pro
【YOYO交互优化建议】声波朝向+距离感知双重过滤,降低语音助手误唤醒概率

一、现存痛点

日常使用手机过程中,YOYO误唤醒是很常见的困扰:
身边电视播放声音、旁人聊天、环境杂音,或者用户只是随口和别人交谈,并没有打算呼叫助手,YOYO却被意外唤醒,弹出界面打断当前操作。

现有的误唤醒过滤大多只依靠声音频谱、唤醒词文本做判断,无法区分:这句话是不是用户对着手机讲的。
有时候人就在手机旁边,但是是跟旁边的人对话,并不是跟手机说话,依旧会触发唤醒,影响使用体验。

二、核心构想

在语音唤醒的前置判断环节,增加AI声源分析能力,解析输入语音的两个关键信息:声音传播朝向(嘴巴指向)、声源和手机的距离,做分层过滤。

1. 声波朝向判断
通过麦克风阵列分析声波到达各个麦的时间差,AI推算说话人嘴巴大致朝向,判断说话人是否面向手机方向。
如果声源朝向明显偏离手机,说明用户是在和旁人交谈,不是对手机下达指令,直接排除这次唤醒判定,不触发YOYO。

2. 声源距离作为例外兼容
如果说话人距离手机非常近,哪怕脸部没有正对手机(侧着脸、低头),依旧允许参与唤醒识别。
比如躺在床上侧躺玩手机,嘴巴没有正对屏幕,但离手机很近,依然可以正常唤醒,避免过度过滤造成唤不醒。

3. 设置项交给用户自定义调节
在YOYO设置页面提供可调选项,用户可以按需修改过滤强度:

- 严格模式:优先依据朝向过滤,只有面向手机才更容易唤醒,抗误唤醒更强;

- 宽松模式:弱化朝向权重,主要依靠唤醒词+距离识别,适合经常侧躺、歪头使用手机的场景;
同时可以开关“声源朝向过滤”这个总功能,不想使用该特性可以直接关闭,回归原有唤醒逻辑。

三、完整工作逻辑流程

1.麦克风拾取环境声音,检测到疑似唤醒词;
2.AI同时计算两项信息:声源距离、声波入射朝向;
3.判断分支:
①距离近:无论朝向,允许进入唤醒校验流程;
②距离较远:必须声源朝向大致对着手机,才允许继续唤醒判定;朝向偏离直接拦截,不唤醒;
4.再叠加原有唤醒词置信度模型,多重校验,最终决定是否真正唤醒YOYO。

简单概括:
离得近,侧着说也能唤醒;离得远,不对着手机说话就不唤醒。

四、落地约束与边界

1. 硬件依赖:该功能需要多麦克风阵列支持,单麦克风机型无法解析声音朝向,该功能自动置灰不可开启。
2.置信降级保护:遇到嘈杂环境、回声遮挡,朝向判断置信度低的时候,自动放弃朝向过滤,沿用旧逻辑,防止出现该唤却唤不起来。
3.不改动原有唤醒核心模型,只是增加前置过滤层,属于增强优化,不是替换原有方案。
4.全部本地端侧处理,语音数据不上云,保护隐私。
5.提供开关和档位,充分尊重用户使用习惯,避免算法过度干预造成助手难唤醒。

五、方案带来的收益

1.大幅度降低电视人声、远处旁人交谈带来的误唤醒;
2.兼顾特殊使用场景,侧躺、低头近距离使用手机依旧可以正常唤醒,不会一刀切;
3.用户可以自主调节严格程度,不同使用习惯都能适配;
4.复用麦克风阵列硬件,不需要新增硬件,属于算法层面优化。

总结

传统唤醒只听“说了什么词”,本方案增加判断“是不是对着手机说的”。
利用麦克风阵列解析声源距离与声波朝向,远距离非面向手机的对话直接拦截,近距离放宽朝向限制,同时开放档位给用户自定义,做到减少误唤醒,又不误杀正常唤醒场景,提升YOYO日常使用体验。

希望研发团队评估参考!
荣耀小达人丶团子 荣耀答答团  发表于 3 天前 湖南 来自:PC-VOC
本帖最后由 荣耀小达人丶团子 于 2026-9-5 17:53 编辑
数码爱好者 发表于 2026-9-4 01:52
【YOYO交互优化建议】声波朝向+距离感知双重过滤,降低语音助手误唤醒概率

一、现存痛点


层主您好,感谢您反馈的建议,我们也是会不断完善优化相关功能。希望后续荣耀给您带来更好的使用体验,感谢您的支持与理解
浪迹天涯任我飞  LV7  发表于 昨天 14:55 北京 来自:荣耀Magic7 Pro
1. 从“人找功能”升级为“设备懂需求”

现在手机、平板、PC、智慧屏等设备功能越来越丰富,但功能越多,用户反而越容易遇到“知道有这个功能,却不知道在哪里”的问题。建议未来的人机交互可以从传统的菜单式、图标式操作,逐渐转向“意图理解”。比如我说一句“帮我把刚才看到的资料整理一下”,系统不需要用户再进入文件、复制、粘贴、分类等多个步骤,而是能够自动识别相关内容,并询问用户是否需要整理成文档、表格或者笔记。真正做到“用户表达需求,设备完成任务”。

2. 打造真正意义上的多模态交互

未来的人机交互不应该局限于触控、语音或者键盘鼠标中的某一种方式,而应该让触控、语音、视觉、手势等方式自然融合。比如用户在电脑上看到一张复杂的数据图表,可以直接指着某个区域说“这里的数据帮我分析一下”,系统通过视觉识别+语音理解,就能准确定位用户指向的位置并进行分析。对于手机和平板,也可以支持“看图说话”“圈选即问”“指哪里问哪里”等交互方式,让AI真正理解用户当前正在看的内容。

3. 建立跨设备的“连续交互”体验

手机、平板、PC、穿戴设备等设备之间不应该是相互独立的,而应该形成一个完整的交互体系。例如用户在手机上浏览一篇文章,回到电脑后可以直接继续阅读;在平板上编辑到一半的文档,坐到电脑前能够自动接续;手机接收到一个重要通知后,可以根据用户当前使用的设备选择最合适的方式提醒。更进一步,可以建立“任务接力”机制:手机负责采集信息,平板负责处理和展示,PC负责深度编辑,设备之间自动完成任务流转。

4. 让AI具备“上下文记忆”,而不是每次重新开始

目前很多AI交互最大的问题是“每次对话都像第一次见面”。建议在人机交互中加入更加完善的上下文理解能力。例如用户说“把这个做得简洁一点”,系统应该知道“这个”具体指什么,而不是要求用户重新上传文件。又比如用户连续提出“换一个风格”“再正式一点”“增加几个方案”,AI应该能够理解这些指令是在修改刚才的内容。这样才能真正降低交互成本,让人与设备之间的沟通更加接近人与人之间的交流。

5. 增加“视觉理解+屏幕操作”的交互模式

可以设计一种类似“AI看屏幕”的交互方式。用户只需要圈选屏幕中的某一个区域,然后直接说“把这个价格加入预算”“把这张图片里的电话号码保存下来”“把这里的数据做成表格”,系统就可以直接执行。这样可以避免用户在不同应用之间来回切换。尤其对于办公、学习、购物、旅行等场景,这种交互会非常实用。

6. 让语音交互从“语音助手”变成“语音操控中心”

语音助手不能只停留在“查天气、设闹钟、播放音乐”这些简单任务上。未来可以进一步支持连续复杂指令。例如用户说:“帮我把今天收到的会议资料找出来,提取会议时间和地点,然后加入日程,并提醒我提前半小时出发。”这实际上涉及文件搜索、信息提取、日程管理、提醒设置等多个环节。如果系统能够一次理解并完成整个流程,人机交互效率会有明显提升。

7. 根据不同场景自动切换交互方式

同一个用户在办公室、开车、运动、做饭、会议等不同场景下,对交互方式的需求完全不同。因此可以建立“场景感知交互”。例如开车时减少视觉操作,以语音为主;会议时自动降低无关通知,只突出重要信息;运动时通过耳机或手表进行语音反馈;办公时则自动切换到键盘、鼠标和大屏协同模式。真正做到“设备适应人”,而不是“人适应设备”。

8. 增加更自然的手势交互

除了传统的点击、滑动,还可以进一步探索隔空手势、双指捏取、手掌翻转、指向操作等方式。例如演示PPT时,不需要触碰电脑,只需要挥手即可翻页;做菜时双手沾满东西,可以通过语音+手势控制播放、暂停和下一步;观看视频时可以用简单手势调整音量。手势交互如果能够结合摄像头和AI视觉识别,应用场景会非常丰富。

9. 建立“可解释的人机交互”机制

AI越来越主动以后,也要避免出现“自作主张”的情况。建议所有涉及重要操作时,都增加清晰的确认机制。例如删除大量文件、发送邮件、支付、修改重要资料等操作,AI可以先告诉用户:“我准备执行以下3项操作”,由用户确认后再执行。这样既提高效率,也让用户始终拥有最终控制权。

10. 让设备主动,但不能过度打扰

未来设备应该从“被动响应”向“主动服务”发展,但主动不等于不停弹窗。建议建立“打扰等级”和“重要程度判断”。例如用户正在玩游戏时,普通通知自动静默;检测到用户正在开会时,只保留电话、日程等重要信息;如果检测到用户连续搜索某个旅行目的地,可以适当提供路线、天气、住宿等信息,但不能频繁推送。AI应该做到“该出现的时候出现,该安静的时候安静”。

11. 打造“一个入口,完成多应用任务”

现在很多操作最大的痛点不是功能不存在,而是应用之间彼此割裂。比如订机票需要打开一个App,查天气又要打开另一个App,再把时间复制到日历中。未来可以通过系统级AI建立统一任务入口,用户只需要说“帮我规划一下周末旅行”,系统就可以调用地图、天气、日历、相册、备忘录等能力完成任务。用户不需要关心后台到底调用了哪些应用,只需要关注最终结果。

12. 针对不同人群设计个性化交互

老人、儿童、年轻人以及专业用户对于交互的需求不同。可以允许用户自定义交互模式,例如老人模式强化语音、大字体和简单操作;儿童模式强化图形化和互动式引导;专业用户则可以使用快捷指令、自动化流程和复杂多任务操作。甚至可以让系统根据用户长期使用习惯,逐渐学习用户偏好的操作方式。

13. 把“无障碍交互”融入普通产品设计

无障碍不应该只是针对少数特殊人群,而可以成为所有用户都能受益的设计。例如语音转文字、文字转语音、实时字幕、视觉识别、物体识别等功能,在特殊情况下同样非常有价值。比如环境嘈杂时可以使用字幕,双手不方便时可以使用语音,光线不好时可以依靠视觉增强。这样的人机交互才真正具有普适性。

14. 探索“预测式交互”

如果设备能够理解用户习惯,就可以进一步预测下一步需求。例如每天固定时间出门,手机可以提前提醒天气和交通情况;经常在某个时间查看工作资料,可以自动整理相关内容;会议结束后自动生成会议纪要并询问是否发送给参会人员。关键是这种预测必须建立在用户授权基础上,同时提供关闭和调整选项。

15. 最终目标是让交互“消失”

我认为未来最好的交互,不一定是增加更多按钮,而是让用户越来越少地操作按钮。用户说一句话、做一个动作、甚至只是表达一个意图,设备就能够理解并完成后续工作。手机、平板、PC、AI眼镜、耳机等设备也不再是孤立的产品,而是共同组成一个“智能交互空间”。

总体来说,我期待的人机交互不是简单地从“触控”变成“语音”,而是从“操作设备”真正升级到“与设备协作”。未来可以重点围绕“自然语言+视觉识别+手势+语音+跨设备协同+场景感知+AI主动服务”进行融合,让用户不需要学习复杂的操作逻辑,而是用最自然的方式表达需求。设备负责理解、执行和协同,人只需要负责做决定。

如果能够把这些能力真正落地,我觉得“人机交互”会从现在的功能竞争,逐渐变成理解能力、协作能力和服务能力的竞争。这也会让手机、PC、平板等产品不再只是工具,而是真正成为能够理解用户、辅助用户完成事情的智能伙伴。
您需要登录后才可以评论 登录 | 立即注册
简体中文 - China
快速回复 返回顶部 返回列表