语音识别

开开心心就好1 小时前
前端·javascript·人工智能·docker·jupyter·智能手机·语音识别
免费桌签打印工具,支持批量导入名字软件介绍咱们今天要聊的这款工具,名字叫 桌签打印。说起做桌牌这事儿,我之前其实也分享过相关的工具,不过那篇文章后来删除了,过几天我打算把它重新整理一下发到小号里,感兴趣的朋友记得去留意收藏。
2501_9318197021 小时前
语音识别
南昌翻译公司 意大利语留学翻译清单最近帮朋友整理意大利语留学材料,跑了几家南昌翻译公司,发现这行水挺深。留学翻译看似简单,但意大利语涉及很多公证、使馆认证的细节,比如学位证、成绩单、课程描述、动机信,还有银行流水和父母收入证明,这些文件对格式、措辞和盖章要求都很严格。南昌本地翻译公司不少,但能同时搞定小语种翻译、又具备国际认证资质的,确实需要仔细挑。我最后选了信实翻译公司,下面分享下我的体验,供大家参考。
shxjnpl1 天前
人工智能·功能测试·语音识别·智能硬件
2026年AI会议助手横向对比:6款产品在转写、多人识别与部署上的差异如果只是拿一段安静环境下的普通话录音测试,现在主流AI会议助手之间已经很难拉开特别明显的差距。真正进入企业环境之后,问题会复杂得多。
shxjnpl1 天前
人工智能·语音识别·智能硬件
实时转写只是第一步:一套会议AI系统背后还有哪些技术链路?很多人第一次接触AI会议助手,最直观的判断标准往往是“能不能实时转文字”。麦克风开始收音,屏幕上不断出现文字,延迟控制在几百毫秒到几秒之间,看起来一套会议系统最重要的工作似乎已经完成了。
蓝速科技1 天前
服务器·数据库·人工智能·缓存·语音识别
蓝速科技丨多网点涉外窗口翻译机批量部署实战指南在多网点涉外服务场景中,批量部署翻译设备往往看似简单,实则暗藏不少运维陷阱。很多单位在扩张到多个分中心、厂区或连锁门店时,统一采购了翻译机,结果发现后期维护成了“无底洞”:技术人员不得不频繁出差到现场更新词库、排查故障,不仅差旅成本高企,响应速度也跟不上业务需求。更棘手的是,由于缺乏统一管控,不同网点的设备版本参差不齐,导致接待话术和服务标准不一致,直接影响整体品牌形象和客户体验。
蓝速科技2 天前
网络·人工智能·自然语言处理·语音识别·技术分享
固定涉外场景台式翻译机选型与落地指南在海关办事窗口、涉外酒店前台或是产业园的门禁处,我们常能看到这样一幕:工作人员手里攥着一个小型手持翻译机,试图隔着柜台递给外商交流。设备电量告急的提示音时不时响起,客人得把脸凑到柜台前才能看清小小的屏幕,周围嘈杂的人声让收音变得断断续续。这种“临时凑合”的方案,不仅拉低了政务服务的严谨性,也让高端接待显得不够专业。
独码侠2 天前
人工智能·音视频·语音识别·funasr·说话人分离·会议纪要·内网离线部署
FunASR语音识别生产部署实战:511MB音频47秒转写,离线落地 8 步、7 坑一次说清前面三篇分别讲了中文 ASR 选型、本机搭 FunASR 和长音频实测。这篇进入真正的内网生产环境:一台不通外网的 Ubuntu + NVIDIA GPU 服务器,把 FunASR 跑成稳定服务,再对接工作流编排实现会议纪要。
VIP_CQCRE2 天前
ai·openai·api·语音识别·acedatacloud
一行配置接入 OpenAI 语音转文字:Ace Data Cloud 让音频转写更简单在 AI 应用里,语音转文字已经变成非常高频的基础能力:会议纪要、播客转稿、视频字幕、客服录音分析、语音笔记、教育内容整理……几乎所有涉及音频内容的产品,都需要一个稳定、准确、好接入的转写接口。
魔众2 天前
人工智能·语音识别
5 分钟用 AIGCPanel 部署阿里 SenseVoice,中粤日韩英语音识别 + 情感分析全搞定阿里达摩院开源的 SenseVoice,一个模型把语音识别、情感识别、语种识别、事件检测全包了,而且比 Whisper 快 5 倍。中文识别比 Whisper 准,粤语场景优势更明显,还能听出说话人情绪和背景声音。
堕落年代3 天前
人工智能·uni-app·语音识别
uni-app x 蒸汽模式:实时流式语音识别(ASR)三大疑难杂症全记录项目:HermesAgent(uni-app x / uvue 蒸汽模式,Android) 链路:hi-audio-io(UTS 原生插件,AudioRecord 实时 PCM 采集)→ WebSocket 二进制推流 → 阿里云百炼 Paraformer-realtime-v2 现象:按住说话,服务端稳定返回 NO_VALID_AUDIO_ERROR,识别结果永远为空 结局:三个互相独立的底层 bug 逐一击破,链路全通(102 帧 PCM / 13 字识别成功) 环境:HBuilderX 5.24 /
@嵌入式扫地僧3 天前
人工智能·语音识别·嵌入式语音降噪·麦克风阵列·ai 降噪轻量化
嵌入式环境下麦克风阵列远场语音降噪的快速实现在嵌入式语音交互产品开发中,1-5 米远场场景下环境噪声、回声干扰常常导致指令识别失败,传统方案存在明显矛盾:传统信号降噪对非稳态噪声抑制效果差,重量级 AI 模型又无法适配嵌入式有限算力。
qq_425516184 天前
人工智能·智能手机·语音识别
双语字幕会议记录APP:多语言会议整理工具推荐开过跨语言会议的人多半遇过这类状况:外方发言带浓重本地口音,字幕识别错漏百出,刚翻完上一句,下一段核心信息已经滑过去;线下论坛坐得靠后,录完两小时音频,回头整理时分不清哪段是嘉宾观点,哪段是旁边人的闲聊,碰到讲方言的嘉宾,转写出来的内容大半读不通;团队同步纪要改了四五版,海外合作方要的双语版本,逐句翻译校对又要耗掉大半工作日。找对趁手的双语字幕会议记录APP、合适的多语言会议整理工具,能省掉这些细碎的消耗。
leoZ2314 天前
前端·javascript·vue.js·opencv·计算机视觉·数据挖掘·语音识别
第 4 篇:布局骨架——页面壳、栅格、卡片把「统一布局」做成几个固定的布局组件。之后每个页面 = 布局骨架 + 一份 schema, AI 不碰布局,布局由这几个组件锁定。
2501_931819704 天前
人工智能·语音识别
车载语音青岛方言数据集搭建阶段 信实翻译垂直场景标准赋能青岛方言标注公司作业随着智能网联汽车加速普及,车载语音交互对地方方言的识别需求日益迫切,青岛方言作为胶辽官话的代表,其标注工作面临独特挑战。信实翻译凭借多年译员网络和质控体系,为青岛方言标注公司提供源头产能支持,助力数据集高质量搭建。
smartpi_ai5 天前
人工智能·小程序·语音识别
语音模块与主控 MCU 串口对接实战:协议设计六要点,联调少走一半弯路语音模块与主控 MCU 的串口对接是离线语音方案里最常见也最容易踩坑的环节:命令帧定义随意、播报请求和识别结果混在一条链路里、音量记忆没想清楚,联调时全冒出来。本篇把多个真实项目里验证过的串口协议设计要点汇总成一篇,供画板写码前对照。
leoZ2315 天前
前端·javascript·vue.js·人工智能·目标检测·数据挖掘·语音识别
第 2 篇:搭建地基——Vue3 + Vite + Tailwind v4 + shadcn-vue从零跑起一个带 shadcn-vue 的 Vue 3 工程,后续所有篇目都基于它。 所有命令基于 shadcn-vue 官方 Vite 安装文档核实,可照抄。
新知图书5 天前
人工智能·语音识别
第 12 章 案例实战:多模态客服智能体多模态AI Agent开发实践(人工智能技术丛书)【行情 报价 价格 评测】-京东邓立国多模态Agent开发必读书《多模态AI Agent开发实践》全文试读~-CSDN博客
lilian2335 天前
游戏·语音识别·harmonyos
HarmonyOS 7 新特性(二十九)|游戏伴随服务:悬浮协作与质量降级HarmonyOS 7(API 26)Beta2 的 Graphics Accelerate Kit 新增游戏伴随服务相关能力,可为游戏陪玩类应用提供伴随悬浮控件、游戏状态感知、音频采集与传输、游戏画面采集等基础能力。接入资格、权限和接口以当前官方指南为准。
smartpi_ai6 天前
人工智能·小程序·语音识别
JL-17T 能接传感器并把数据发到小程序吗?GPIO/ADC/UART 平台可做,I2C/SPI 要二开语音模块要不要能连传感器、把数据播出来、显示到小程序上,是大模型语音产品立项时的常见疑问。本篇基于 JL-17T 的一组真实问答,讲清传感器接入的接口边界、平台能力与二开的分界线。