交互

元岳数字人小元1 天前
运维·人工智能·开源·人机交互·交互
数字人开源技术优势解析,助力智能交互普及落地当下线下智能交互场景持续普及,数字人设备不再局限于单一展厅展示,逐渐渗透到商业服务、文旅科普、校园科普、便民服务等多个通用场景。传统闭源数字人设备功能固化、修改权限受限、适配性弱,难以适配多元化的场景创新需求。而数字人开源技术的出现,打破了传统设备的功能壁垒,凭借开放、灵活、可自定义的特性,成为各行各业轻量化、低成本落地智能数字服务的优质选择,也让AI数字人一体机的应用价值得到进一步释放。
math_hongfan2 天前
人工智能·学习·华为·交互·语音识别·harmonyos·鸿蒙
鸿蒙多模态AI交互高级:图文+语音+手势融合交互/多模态大模型端侧适配/跨模态检索高阶实战单模态 AI 各管一段,但真实交互是混合的:单模态系统无法理解这种复合意图。多模态 AI = 文本 + 图像 + 语音 + 手势统一理解与交互。
头茬韭菜3 天前
ui·交互
5.5 权限交互:渐进式信任的 UI 设计对应原书:5.9 权限 UX:渐进式信任的交互设计(计划编号 5.5 权限交互) 辅助源码:components/permissions/(50 个文件,~5000 行) 核心文件:PermissionRequest.tsx / PermissionDialog.tsx / PermissionPrompt.tsx / BashPermissionRequest.tsx / FileEditPermissionRequest.tsx / PermissionExplanation.tsx / hooks.
元岳数字人小元4 天前
运维·人工智能·人机交互·交互·源代码管理
易部署易运维!AI数字人一体机实现场景长效运营如今各行各业的线下智能服务建设趋于常态化,企业、政务单位、文旅展馆在数字化升级中,不再只追求设备快速上线,更看重后期运维便捷度、场景适配性与长期迭代能力。传统智能设备功能单一、运维繁琐、更新成本高,难以匹配现代场景的动态化运营需求。而AI数字人一体机凭借轻量化部署、简易运维、可迭代升级的优势,成为当下线下数字化建设的主流选择,能够全方位适配不同行业的数字人交互服务需求。
带娃的IT创业者5 天前
前端·交互·puppeteer·可观测性·浏览器自动化·无头浏览器·web工程化
Puppeteer 深度解析:超越自动化测试的现代 Web 交互范式👋 Hi,我热衷于 (AI 大模型应用落地、Python 实战进阶与 AI 开发工具链)。代表专栏:《AI大模型应知应会短平快系列100篇》《解密OpenClaw》《解码意识NCTransformer》《WeClaw Agent实战》> 💡 创业路上,用技术换时间;欢迎 关注我,一起把 AI 变成生产力 🚀 >
时空节拍AI数字人6 天前
人工智能·microsoft·ai·aigc·交互·语音识别
多模态交互数字人:语音+视觉+触控如何融合2025年世界人工智能大会上,搭载全身触觉传感器的仿生熊猫机器人「安安」成为焦点——观众抚摸它头部,它会主动蹭回手心;给它拥抱,它能识别亲密行为并发出舒缓声音。与此同时,科大讯飞数字人「小飞」在嘈杂展会上实现了5米远场、多人对话中的精准识别与情感共情。全球多模态情感数字人市场规模从2025年的66.2亿美元跃升至2026年的90.2亿美元,年复合增长率36.2%,预计2030年突破313亿美元。当语音、视觉、触控三条感知通道开始融合,数字人正经历一场从「能说话」到「懂你心」的交互范式跃迁。
quanjui6 天前
人工智能·语言模型·交互
【智能体从对话到决策】虚拟环境下大语言模型的部署与智能体交互研究原文标题:Unity 集成大语言模型的方法、实现与评估研究 作者:雍潇潇 项目:UnityLLM 统一接入插件+ 3D 解谜游戏UnityLLM 插件 + 主客观双轨评估
cxr8287 天前
人工智能·交互·智能体·认知框架
Synapse Mind (三维智能认知图谱) 全景深度工程Synapse Mind 是一款基于 WebGL/Three.js 与大语言模型(Gemini API)深度结合的三维高维认知图谱与动态思维演化系统。它打破了传统二维思维导图(2D Mindmap)在空间拓扑拓展、多维度交叉关联及复杂认知下钻方面的局限,利用 React Three Fiber (R3F)、d3-force-3d、Zustand 以及 Server-side Gemini 3.5 Flash 构建了一个高流畅度、强沉浸感、具备深度 AI 关联推演能力的空间网络系统。
2501_933923257 天前
交互
前后端交互避坑指南:从登录到留言板大家好,很多新手小白在学习JavaSpringMVC的时候十分吃力,特别是在学习前后端如何交互的时候,如何传递参数?如何接收参数?明明知识点都会,但是为什么会一直报错呢?下面是我在学习过程中遇见的一些问题,为了帮助大家更好学习,我将通过登录案例+留言板案例讲知识点串通起来,文章末尾附全代码,希望能够帮助到大家!
蓝速科技7 天前
科技·重构·交互
蓝速科技丨双屏翻译机重构跨国商务沟通的交互范式在跨国商务洽谈、涉外律所咨询或是国际医疗会诊这类正式场合,沟通的流畅度往往直接决定了合作的成败。想象一下这样的场景:双方正就关键条款进行深度磋商,却不得不因为语言障碍而频繁停顿。传统的便携式翻译设备大多只有巴掌大的单屏,屏幕狭小,长句显示不全,更尴尬的是,设备只有一台,说完一句就得把机器递来递去,或者在桌面上旋转方向。这种反复的"传递 - 等待 - 阅读"过程,不仅打断了思维的连贯性,更让原本严肃专业的会晤氛围显得支离破碎。对于需要记录要点、查阅资料的专业人士来说,双手被设备束缚更是极大的不便。 正是为了
熊猫钓鱼>_>11 天前
笔记·学习·华为·交互·harmonyos·arkts·arkweb
ArkTS 装饰器总览:V1 / V2 / 通用装饰器完整学习笔记推荐大家体验用AI编程,人工智能学习小站如下,已整理好相应高质量资源: 前言 – 人工智能学习网适用版本:HarmonyOS 5.0.0+ / API 12+ 难度:中级 预计阅读时间:30 分钟
lialaka11 天前
人工智能·3d·交互
「声纹迷宫(Acoustic Labyrinth)」:具身交互智能驱动的实时声学解构与全双工语音数字人控制台讨论一条音频管线的参数边界——比如信噪比阈值定多少、重叠语音该怎么分离——往往讲到一半就要推翻刚才的设定。可多数语音交互产品是"半双工"的对讲机逻辑:你说一句、它播完一段才能接话,思路被硬生生掐断。在声学、音频工程、声纹分析这类"边聊边推演、边问边纠正"的场景里,这种卡顿格外致命。
熊猫钓鱼>_>11 天前
华为·架构·交互·ts·harmonyos·arkts·鸿蒙
ArkTS 基础入门:从零搭建第一个交互页面适用版本:HarmonyOS 5.0.0+ / ArkTS API 12+ 难度:入门级 预计阅读时间:25 分钟 配套代码:见文末工程目录
lialaka11 天前
人工智能·3d·交互
「极客智库(The Architect‘s Nexus)」——全语音 3D AI 首席架构师与具身交互智能会话推演舱跟一位苛刻的首席架构师过方案,最难受的不是被怼,而是“说完一句得等对方把长篇大论吐完才能接话”。这正是多数语音交互产品“半双工”模式的尴尬:用户对讲机式地一句一顿,根本撑不起音视频处理管线、大模型多模态接入、现代前端状态管理这类需要高频来回纠偏的复杂推演。对于资深开发者、系统架构师与独立黑客而言,这种单向、缺乏高水平反馈的对话方式,很难支撑复杂的架构推演。
xingxiliang13 天前
人工智能·物联网·交互
AI 智能耳机 / IoT 穿戴设备语音交互评测体系适用场景:TWS 耳机、骨传导耳机、智能眼镜、车载语音助手等语音交互 IoT 设备 涵盖:唤醒评测、ASR 鲁棒性、E2E 延迟 SLA、自动化测试平台
Tangyuewei14 天前
人工智能·交互
交互熵:AI 编程工具的下一站不是聪明,是靠谱摘要:2026 年 6 月,Claude Code 做了一次底层升级,没有提升代码质量,没有刷新 SWE-bench 分数——它解决的是终端闪烁、思考假死、报错玄学、上下文死锁、连接不稳、会话崩溃六个开发者每天都在被折磨的问题。Anthropic 把这类问题叫"交互熵"(Interactive Entropy):每一次不确定的等待、每一条无意义的报错、每一次无警告的崩溃,都在侵蚀开发者对工具的信任。这件事代表着 AI 编程竞赛的一个重要转向:下一站不是比谁更聪明,是比谁更靠谱。
小龙报14 天前
实时互动·音视频·交互
远控功能哪个全?2026六款远控横评实测“你那边能不能远程帮我敲一行命令?” 周一下午,同事的服务器出了点小问题,他想让我从远端帮看一下。我打开平时用的那款远控,连上他的电脑——远程桌面是有了,但想开个命令行窗口,菜单里根本没有入口;想拖一个配置文件过去,弹窗提示"该功能需要升级会员";想开个隐私屏避免旁边人看到,按钮灰着不可点。 那一刻才反应过来:远程软件最容易被忽视的坑,不是"卡不卡",而是"功能到底齐不齐"。