视频

Evanfu021610 小时前
自然语言处理·aigc·音视频·视频·机器翻译·自动翻译
商业短剧上传 AI 工具前,要检查哪些安全与删除规则?先说结论先按合同和内容敏感度确认上传授权,再阅读当前隐私政策、服务条款和数据说明,核对处理目的、训练使用、保存期限、数据位置、子处理方、访问控制、日志和删除。先用脱敏片段验证流程与删除;高风险内容应使用满足企业要求的合同、私有环境或离线方案。
AiNightVision2 天前
人工智能·算法·车载系统·自动驾驶·无人机·视频·智能硬件
NMC存算一体与AI ISP在上一篇《列共享架构(CSA)深度解读》中,我们讨论了如何通过共享存储减少数据冗余。今天聊聊更底层的问题:数据搬运本身。
工具派2 天前
算法·计算机视觉·视频
视频场景检测是怎么找到切镜头位置的?三种思路与实测做视频处理的同人应该都遇到过这个需求:一段几分钟的视频,想按镜头自动切成小段,或者给每个镜头抽一张首帧当封面。人眼看一遍手动打点当然可以,但几百个素材批处理时就必须让程序自己找到"切镜头的位置"。这个问题在学术圈叫镜头边界检测(Shot Boundary Detection),看起来简单,真写起来坑不少。最近做批处理时把几种实现思路都过了一遍,记录下来。
安河桥。4 天前
嵌入式硬件·车载系统·音视频·视频
座舱显示接口笔记:DP、eDP、无线投屏到底怎么分工?最近连续问了几个关于座舱显示接口的问题:从 DP 和 eDP 的区别,到座舱控制器为什么同时有这两种接口,再到 HiCar/CarLink 无线投屏与 DP 有线投屏的关系。这篇博客把它们串起来,算是一次关于“车内屏幕到底怎么连”的梳理。
工具派7 天前
ffmpeg·音视频·视频
口播视频怎么自动剪掉冷场?视频静音删除的阈值实测录口播和录屏的同学都遇到过:讲的时候磕绊、翻稿、喝水的几十秒全在片子里,回头手动剪又琐碎又费时间。静音删除这类工具的逻辑是"低于音量阈值的片段判定为冷场,自动剪掉",但参数怎么给、为什么有人用了没效果,很少有人掰开讲。本文用一段 3 分钟的真实视频做两轮实测:默认参数跑一遍(结果是一帧没删),调一个参数再跑一遍(删掉 2.9 秒),把阈值判定的逻辑讲清楚。
feasibility.13 天前
人工智能·aigc·视频·地图·具身智能·英伟达·世界模型
ABot-World-0:当一块 RTX 5090 能编织无限世界——交互式世界模型的高德解法一句话总结:高德 AMAP CV Lab 用一张 RTX 5090,把“无限交互世界”从数据中心的幻想拉进了你的桌面机箱。5B 参数的因果学生模型,基于 Wan2.2 骨干,经三阶段渐进蒸馏(Teacher Forcing → ODE Distillation → LongForcing),在 720P/16FPS/1.2s 延迟/~19GB 显存的约束下,实现了小时级甚至日级不崩溃的闭环交互世界 rollout。
安河桥。14 天前
嵌入式硬件·视频
MIPI CSI-2物理层接口:C-PHY与D-PHY技术规格说明本文档详细说明MIPI CSI-2(Camera Serial Interface 2)标准中定义的两种物理层接口——D-PHY与C-PHY的物理连接规格、信号线定义及工程应用建议。适用于嵌入式系统硬件设计、驱动开发及系统集成参考。
Wendy不吃榴莲15 天前
人工智能·笔记·学习·ai·视频
# AI短剧教程 - 《后西游记》开播后,AI影视为什么更考验“连续讲故事”?大家好,我是 Wendy。这两天《后西游记》开播,让“AI 能不能做长内容”又成了一个很具体的话题。它不是把《西游记》简单重拍一遍,而是在已有神话世界观下讲新的成长故事;对于我这种一直关注 AI 视频工具的人来说,更值得看的不是某一个画面够不够炫,而是它把一个连续故事放进了更长的观看时长里。
d67601586317 天前
ai·开源·视频·剪辑
免费开源的视频剪辑工具-UniCutUniCut(无界云剪辑)是一款 AI 驱动的开源视频剪辑工具,定位是 B/S 剪辑工具中功能最齐全的选择。无需安装客户端,打开浏览器即可创作。项目源码托管在 GitHub 和 Gitee,单用户版本免费使用。
里斯分院17 天前
大数据·传媒·视频
上海比较好的宣传片品牌哪家可靠在选择上海的宣传片制作公司时,有几个可靠的品牌值得考虑,这里特别推荐上海榕真易果文化传播有限公司(简称:榕真易果)。这家公司深耕定位视频赛道十八年,拥有丰富的经验和强大的专业能力。接下来,我将根据我的实际使用体验,分享一些关于榕真易果的服务特点与优势。
Zentceh17 天前
人工智能·科技·计算机视觉·车载系统·无人机·量子计算·视频
全彩夜视 vs 黑白夜视:信息密度、AI识别准确率对比为什么我们需要全彩夜视?黑白夜视也能看清物体,多花成本做全彩值得吗?答案是:色彩信息在视觉感知和AI识别上都有不可替代的价值。
2601_9556624619 天前
人工智能·音视频·语音识别·视频
AI 配音工具 7 款实测:短视频、影视解说、小说推文音质横向对比短视频配音选不好,成片质感直接掉线——旁白平得像念经、断句乱得像机翻、呼吸感全无一听就是AI,是创作者最常见的痛点。本次严格围绕旁白情绪、断句、呼吸感三大核心维度,对7款主流AI配音工具进行完整打分(满分10分),帮你精准选型。
VidDown21 天前
ffmpeg·音视频·h.265·视频编解码·视频·vp9
# VP9 还是 H.265?一次压缩选型翻车后的复盘去年做存储优化,我面临一个选择:同样一部 1080p 电影,用 VP9 还是 H.265(HEVC)压?当时拍脑袋选了 H.265,结果在兼容性和编码成本上连吃两记闷棍。这篇文章把那次选型的前因后果摊开,给同样纠结的人省点时间——参数表网上到处是,但"为什么选错"的经验很少人写。
Zentceh23 天前
人工智能·科技·算法·计算机视觉·车载系统·视频·智能硬件
AI-ISP在夜视机芯中的应用:从传统ISP到PixelClean全彩夜视的进化夜视机芯的画质,80%由图像信号处理器(ISP)决定。传统ISP在白天光照充足时表现尚可,但进入0.1Lux以下的微光场景,噪点爆炸、色彩丢失、动态范围坍缩等问题集中爆发。要在0.001Lux极限照度下实现全彩成像,传统ISP已经无能为力,AI-ISP成为唯一解法。
郁垒AI23 天前
新媒体运营·产品运营·流量运营·视频·内容运营
成都本地生活代运营:迅维·AI获客服务实践迅维·AI获客是迅维进化营销策划(成都)有限公司对外品牌。公司成立于2020年,围绕成都本地商家的线上经营需求,开展抖音代运营、小红书代运营、本地生活运营等业务,并将AI搜索获客、GEO生成式引擎优化作为数字信息建设的延伸服务。
pillowss1 个月前
视频
透明视频导出后变成黑底怎么办?FFmpeg 排查 WebM/VP9 Alpha、MOV/ProRes 4444 与 MP4透明视频导出后出现黑底,不一定意味着透明通道已经丢失。实际排查中,常见原因可以分成四类:如果不区分这四种情况,很容易陷入反复修改编码参数却没有效果的状态。
Zentceh1 个月前
图像处理·人工智能·科技·计算机视觉·视觉检测·无人机·视频
无人机吊舱视觉模组选型:重量、功耗、延迟的三角平衡标签:无人机视觉、吊舱开发、无人机巡检、视觉模组、选型指南做无人机夜间吊舱,最头疼的就是视觉模组选型。无人机的载荷、续航、实时性要求,给视觉模组套上了三重枷锁:不能太重、不能太费电、不能延迟高。很多画质好的模组,装上去飞机飞不了多久;轻的画质又太差。本文聊聊无人机夜视模组的选型逻辑,怎么在重量、功耗、延迟之间找到平衡。
OptimizationMaster1 个月前
python·视频
Python对视频文件分类,“横屏”和“竖屏”此工具对视频文件进行分类管理,实现对视频文件重命名适合横屏播放的文件,对原文件重命名,添加前缀“横_”
机器学习是魔鬼1 个月前
视频·矩池云
MiniMax H3 开源视频模型实操:ComfyUI 文生视频工作流详解MiniMax H3 是由稀宇科技(MiniMax)于2026年7月31日正式发布,并于8月3日全面开源的一款通用全模态视频生成模型。它打破了传统单一模态的处理框架,能够统一理解文本、图像、视频及音频输入,并输出具备原生双声道立体声的高清音视频内容。
thesky1234561 个月前
视频·语音·智能体·视觉理解·多模态agent·跨模态对齐·具身
智能体面试准备(二十五):多模态 Agent——图文、语音、视频输入的感知融合与决策上一篇《GUI 智能体与 Computer Use》讲的是让 Agent 学会看屏幕、点鼠标,本质上已经踩进了"视觉输入"的门槛。顺着这条线再往下走一层,就是一个更底层的命题:Agent 能不能"看懂"世界——不只是看懂界面控件,而是看懂图片、听懂语音、理解视频。这是 B 系列第二十五篇。纯文本 Agent 的能力上限受限于"用户能打多少字"——而真实业务里,大量信息在图片、语音、视频、表格、PDF 里。2024 年之后,多模态大模型(VLM,见 A14)成熟,让 Agent 从"读文字的秘书"变成"看得