技术栈
ai大模型
腾视科技-AIoT
1 天前
大数据
·
人工智能
·
科技
·
ai
·
ai大模型
·
ainas
·
腾视科技
腾视科技重磅推出TensorAI智能体平台,开启智能助手新体验
在人工智能技术飞速发展的当下,浙江腾视算擎科技有限公司(以下简称:腾视科技TENSORTEC)凭借深厚的技术积累与创新思维,正式推出腾视科技TensorAI类“豆包”应用平台(AI智能体平台),为用户带来全新的智能服务体验。
lee_curry
3 天前
ai大模型
·
dify
·
ollama
Dify+Ollama私有化部署方案
可以租赁云平台更新软件包索引 sudo apt-get update 安装一些必要的软件包,以便apt能够通过HTTPS使用仓库: sudo apt-get install apt-transport-https ca-certificates curl software-properties-common 添加Docker的官方GPG密钥:这一步是为了确保你从Docker下载的软件是安全可靠的。 curl -fsSL https://download.docker.com/linux/ubuntu/gp
aimmon
11 天前
二次开发
·
ai大模型
·
deepseek
·
harness
DeepSeek Harness 初探:1、一切皆插件的 Agent 框架
系列第 1 篇 · 入门 | 项目定位、架构全景与源码速览 本文基于 dsh v0.1.0-rc.5,API 可能随版本变化,一切以官方仓库与本地源码为准。
数据分析小兵
14 天前
人工智能
·
数据治理
·
数据安全
·
数据分类分级
·
ai大模型
·
数据中台
·
智能体
金融数据分类分级实战系列四:如何实现AI自动分级
摘要:本文是数据分类分级实战系列的第四篇,聚焦“执行”阶段。文章从圈定分类分级范围入手,讲解如何按业务分期筛选字段并剔除无需分类的字段;随后介绍分类规则与自动分级策略的配置方法,包括层级树维护、AI自动分类、定级规则设计与模板复用;最后演示如何创建并执行分类分级任务,通过规则引擎与AI协作生成初始结果,并给出落地建议,为后续人机协作复核留好接口。
韩曙亮
18 天前
人工智能
·
ai大模型
·
ai编程工具
·
ai智能体工作台
·
ai可视化工作流
【AI 大模型】AI 工具类型概述 ( AI 编程工具 | AI 智能体工作台 | AI 可视化工作流编排平台 )
2025 年以来 , 大模型技术从 " 对话交互 " 快速迈向 " 行动执行 " , AI 生产力工具进入爆发期 ; 面对市场上数百款 AI 工具 , 很多团队与开发者陷入选型困境 : 不清楚工具之间的品类边界 , 不知道哪类工具对应哪类需求 , 盲目选型往往导致投入产出比极低 , 甚至重复建设 ;
数据分析小兵
20 天前
数据治理
·
数据安全
·
数据分类分级
·
ai大模型
·
数据质量
·
数据中台
·
智能体
金融数据分类分级实战系列一:行业标准JR/T 0197深度解读
在数字化浪潮席卷全球的今天,金融数据已成为金融机构的核心资产与命脉。随着《数据安全法》《个人信息保护法》等法律法规的密集出台,金融行业数据安全治理已从"可选动作"转变为"必答题"。面对海量、异构、高价值的金融数据,如何科学分类、合理定级,构建既满足监管要求又贴合业务实际的数据安全防护体系,成为众多金融机构面临的共同挑战。JR/T 0197—2020《金融数据安全 数据安全分级指南》作为金融行业首个专门针对数据安全分级制定的推荐性标准,为这一难题提供了系统性的解决方案。本文旨在深入解读该标准的核心要义,从分
红信鸽
1 个月前
ai大模型
Spring Boot 3.4 集成阿里云 PAI-EAS 出现连接池耗尽问题的排查与修复
昨天凌晨两点,监控平台突然告警,生产环境的 AI 推理服务响应时间从正常的 200ms 飙升到 5000ms,随后大量请求直接超时。查看应用日志,满屏都是 org.apache.http.conn.ConnectionPoolTimeoutException: Timeout waiting for connection from pool。这个异常非常典型,通常意味着 HTTP 连接池被占满且无法释放。当时项目正在对接阿里云 PAI-EAS 模型在线服务,业务量激增触发了这个隐藏极深的资源泄漏问题。
红信鸽
1 个月前
ai大模型
端侧 AI 落地新解:DeepSeek-V4 在 Spring Boot 服务中的轻量化部署实践
上周有个需求,需要在一个内网环境中集成 DeepSeek-V4 模型进行实时文本生成,但环境资源极其受限——一台配置为 2GB 内存、单核 CPU 的老服务器,必须支撑日均 1000+ 次请求。传统方案要么无法运行,要么延迟超过 3 秒,完全无法满足业务要求。当前技术栈采用 Spring Boot 3.3.4 + JDK 17.0.12 + Redis 7.2.5,需在不引入外部依赖的前提下实现模型端侧部署。
红信鸽
1 个月前
ai大模型
从 InternAgentS 1.5 到 2.0:科研智能体工作台的 Java 后端重构实录
上周接手一个 AI for Science 项目时,团队正苦于 InternAgentS 1.5 版本在实验数据流转环节的卡顿问题。该平台由上海人工智能实验室开源,基于 DeepAgents 和 LangGraph 框架,核心功能包括论文阅读、实验分析、代码迭代及远程计算管理。我们决定在 Spring Boot 3.4.2 + JDK 17.0.12 环境中尝试迁移至 2.0 版本,重点解决旧版中实验数据处理延迟高、模型适配复杂等痛点。迁移过程不仅涉及依赖升级,更需对后端架构进行深度重构,以适应新版本的多
红信鸽
1 个月前
ai大模型
高并发视频生成场景下的后端资源调度优化:接入Seedance 2.0的多模态流控实战
上周五凌晨收到运维团队的报警短信,核心生产环境的服务器CPU占用率飙升至95%,随即下游调用方反馈视频生成接口响应超时。这是一个典型的“接入新模型带来的流量洪峰”场景:字节跳动的Seedance 2.0模型在豆包平台全面开放免费额度后,我们作为技术供应商,需要在短时间内承接数倍于往日的视频生成请求。Seedance 2.0采用统一的多模态音视频联合生成架构,支持文本、图片、音频、视频四种模态输入,这对后端服务不仅仅是接口层面的接入,更是对资源调度能力的极限考验。
红信鸽
1 个月前
ai大模型
模拟 AlphaChem 3.0 材料发现引擎:Spring Boot 向量检索系统的深度优化...
随着 DeepMind 发布的 AlphaChem 3.0 将新药研发周期缩短 90%,其背后的数据吞吐与检索能力成为了行业焦点。上周,我们团队接到了一项挑战:在现有的 Java 微服务架构中,构建一个能够支持百万级分子结构向量实时检索的后端引擎,以支撑内部科研平台的数据查询需求。项目采用 Spring Boot 3.4.2 作为核心框架,结合 PostgreSQL 16.2 的 pgvector 扩展与 Redis 7.4 缓存层,目标是解决传统数据库在处理高维向量相似性搜索时的性能瓶颈。
红信鸽
1 个月前
ai大模型
从 GPT-4o 多模态交互到 Spring Boot 后端适配:架构决策与工程化落地实录
某金融级微服务系统在接入 GPT-4o 原生多模态交互能力后,出现以下异常堆栈:```java org.springframework.http.HttpRequestNotSupportedException: Content type 'audio/wav' not supported by @RequestBody parameter at org.springframework.web.servlet.mvc.method.annotation.RequestMappingHandlerAdapt
红信鸽
1 个月前
ai大模型
Seedance 2.0 视频接入豆包:Java后端实现流式进度推送的工程化对比与选型决策
在构建多媒体内容生成平台时,视频生成的异步处理往往成为系统瓶颈。上周我们对比了三种主流方案:轮询回调、Webhook 推送和 SSE(Server-Sent Events)流式更新,发现传统方案在处理100+并发任务时存在显著性能差异。
红信鸽
1 个月前
ai大模型
Spring Boot 3.4 + Redisson 构建高并发AI工具索引:从“内存溢出”到...
上周处理一个日均PV突破50万的免费AI工具导航站时,我们遇到了典型的“读多写少”但热点集中的场景。传统的 MySQL 分页查询在热门工具(如 Midjourney、Copilot)被大量并发访问时,CPU 飙升且响应延迟超过 2s。既然近期社区讨论多集中于 AI 模型集成或大模型编排,本文将完全剥离 AI 业务逻辑,纯粹聚焦于后端基础设施层:如何利用 Redisson 的 RMapCache 和 Lua 脚本,在 Spring Boot 3.4 环境下构建一个具备自动过期、防穿透、支持缓存同步的高性能缓
红信鸽
1 个月前
ai大模型
文心一言 5.0 Preview 接入实战:Spring Boot 网关层如何处理多模态流式响...
上周有个需求,运营后台要接入文心 5.0 的「灵感探索」功能,用户上传一张电路板照片,后端要流式返回故障分析文本、生成的示意图、甚至短视频预览链接,同时财务要求每个请求的 Token 消耗精确到毫秒级入库审计。官方 Java SDK 文档还停在 4.0 时代,直接 HttpClient 调用?SSE 流里夹杂着 image/gif 与 text/event-stream 混合分块,Jackson 反序列化直接抛 MismatchedInputException。
红信鸽
1 个月前
ai大模型
文心 5.0 Preview 智能体「任务托管」落地:自研编排层 vs 厂商托管 vs 开源框...
上周接手一个 B2B「AI 数字员工」 SaaS 项目,核心诉求是把文心 5.0 Preview 的「任务托管」能力——长跑任务、跨设备状态同步、多模态中间产物落盘——包装成标准化 API 供前端调用。技术栈定在 Spring Boot 3.3.2、JDK 21.0.4、Redis 7.4.1、Netty 4.1.115 Final,网关层用 Spring Cloud Gateway 4.1.5。百度千帆 SDK 版本锁在 0.3.8(2026-04-30 发布,适配 5.0 Preview)。
红信鸽
1 个月前
ai大模型
从 Qwen-2.5 到 Qwen-4:企业级后端集成架构的代际跨越与兼容性重构
上周处理一个遗留的订单服务时,我们遇到了严重的上下文截断导致的逻辑错误。虽然通过增加重试机制勉强稳住,但那种“把大模型当黑盒调”的粗糙感让我意识到,随着通义千问(Qwen)系列从 2.5 迭代至 4.0 甚至 5.0,后端的集成方式必须彻底重构。过去那种简单的 HTTP 请求封装已经无法承载当前 1M+ token 上下文窗口带来的吞吐压力。
蚁小二官方
1 个月前
ai大模型
·
大模型算力
·
国产3d堆叠芯片
国产3D堆叠芯片技术落地:大模型算力降本增效方案解析
国内AI行业与智能化应用快速发展,但中小企业普遍遭遇算力难题。传统芯片成本高、传输效率低,且高端算力芯片依赖进口,严重制约了大模型落地普及。国产3D堆叠芯片技术逐步成熟,有效改善算力短板、降低算力成本,助力国内AI产业稳步发展。