本次共找到 73推理 相关的文章

3年前
知识图谱Knowledge Graph构建与应用
《新一代人工智能发展规划》明确提出了“建立新一代人工智能关键共性技术体系”的重点任务,特别强调了要解决“研究跨媒体统一表征、关联理解与知识挖掘、知识图谱构建与学、知识演化与推理、智能描述与生成等技术,开发跨媒体分析推理引擎与验证系统”的关键共性技术问题。一、知识图谱概论1.1知识图谱的起源和历史1.2知识图谱的发展史——从框架、本体论、语义网、链
4年前
TensorRT 开始
TensorRT是NVIDIA自家的高性能推理库,其列出了各资料入口,如下:本文基于当前的TensorRT8.2版本,将一步步介绍从安装,直到加速推理自己的ONNX模型。安装进选择版本下载,需注册登录。本文选择了TensorRT8.2.2.1.Linux.x8664gnu.cuda11.4.cudnn8.2.tar.gz,可以注意
4年前
Tengine快速上手指南(中文版)
Tengine是一个优秀的轻量级端侧/嵌入式环境深度神经网络推理引擎。兼容多种操作系统和深度学习算法,以AI推理框架为基础的AIoT开发套件。本文档将分别在x86Linux和Arm64Linux平台,以分类模型(TensorFlowMobileNetv1模型)为例,带你快速上手Tengine。Linuxx86平台编译
3年前
GPT大语言模型Vicuna本地化部署实践(效果秒杀Alpaca) | 京东云技术团队
Vicuna13B的推理效果据说达到了ChatGPT的90%以上的能力,优于LLaMA13B和Alpaca13B的效果。同时Vicuna的训练成本也很低,所以尝试本地化部署一下Vicuna7B,看看效果如何,说干就干。
3年前
Flutter ncnn 使用
Flutter实现手机端App,如果想利用AI模型添加新颖的功能,那么ncnn就是一种可考虑的手机端推理模型的框架。本文即是Flutter上使用ncnn做模型推理的实践分享。
2年前
使用Triton部署chatglm2-6b模型 | 京东云技术团队
一、技术介绍NVIDIATritonInferenceServer是一个针对CPU和GPU进行优化的云端和推理的解决方案。支持的模型类型包括TensorRT、TensorFlow、PyTorch(metallama/Llama27b)、Python(cha
2年前
京东广告算法架构体系建设--高性能计算方案最佳实践 | 京东零售广告技术团队
1、前言推荐领域算法模型的在线推理是一个对高并发、高实时有较强要求的场景。算法最初是基于Wide&Deep相对简单的网络结构进行建模,容易满足高实时、高并发的推理性能要求。但随着广告模型效果优化进入深水区,基于Transformer用户行为序列和Atten
2年前
京东广告算法架构体系建设--高性能计算方案最佳实践
1、前言推荐领域算法模型的在线推理是一个对高并发、高实时有较强要求的场景。算法最初是基于Wide&Deep相对简单的网络结构进行建模,容易满足高实时、高并发的推理性能要求。但随着广告模型效果优化进入深水区,基于Transformer用户行为序列和Atten
1年前
大模型推理GPT | DeepSeek | Doubao
AIGC发展到现在,大模型已经逐渐在大家的知识探索、学习知识、搜索领域的重要帮手,那么从普通大众认知角度,到底能做到什么程度,我们选三个当前知名度较高的大模型进行验证和对比。GPT4o:OpenAI大模型代表,大模型的标杆DeepSeek:深度求索的大模型,当前最火爆的大模型,低成本高效能的杰出代表。(也是作为开发者的我最喜爱的大模型)Doubao:字节跳动的大模型,也是国内断崖领先的大模型应用豆包的底层模型。(豆包App是基于该大模型的应用,做了大量其他辅助工作,如搜索等,因此该大模型表现的能力,不能完全和豆包App划等号)
1年前
DeepSeek-R1满血版性能飙升四倍,成本大降,竟是因为……
近日,天翼云DeepSeek模型推理技术迎来重大升级!该技术不仅支撑DeepSeekR1满血版模型实现性能的四倍提升,更将大规模部署模型的成本降至原来的25%以下,为AI应用落地铺就更为宽广的道路。
1年前
谷歌最强模型 Gemini 2.5 Pro 发布,近屿智能带你学AI大模型
近日,谷歌宣布推出“最智能的AI模型”Gemini2.5系列,实验版Gemini2.5Pro是该系列上线的首款推理模型。这个模型专为复杂任务打造,推理能力强大,一经诞生就横扫各大榜单、拿下各类TOP1,还创下了历史上最大分数飞跃纪录。目前,该模型已在Goo
1年前
OpenAI 最强推理模型o3 和 o4-mini 正式发布,近屿智能带你入局AI
近日,OpenAI正式发布了o3和o4mini模型,代表着ChatGPT能力的重大飞跃。o3堪称最强大的推理模型,o4mini则针对快速且具成本效益的推理进行了优化。这两款模型均展现出卓越的推理能力,能智能调用ChatGPT中的各类工具,像搜索网络、运用P
1年前
小米开源“Xiaomi MiMo”模型,近屿智能带你系统掌握AI大模型应用
近期,小米大模型团队通过“XiaomiMiMo”官方公众号发布重磅消息,宣布成立专注推理能力的大模型核心研发团队,并正式推出首款自研大模型XiaomiMiMo,同时实现全面开源。作为一个参数仅为7B的小体量模型,MiMo在数学推理测评集AIME2425及代
1年前
超越 DeepSeek-R1,英伟达新模型登顶,近屿智能专注大模型人才培养
近日,英伟达发布全新开源模型系列LlamaNemotron,凭借卓越性能引发业界关注,有望重塑开源AI格局。该系列在推理能力上超越DeepSeekR1,内存效率与吞吐量显著提升。其创新采用合成数据监督微调与强化学习训练,全方位增强模型推理能力。系列包含LN
3年前
【MindStudio训练营第一季】MindStudio 高精度对比随笔
MindStudio精度对比简介原因:训练场景下,迁移原始网络(如TensorFlow、PyTorch),用于NPU上执行训练,网络迁移可能会造成自有实现的算子运算结果与用原生标准算子运算结果存在偏差。推理场景下,ATC模型转换过
3年前
GPT大语言模型Alpaca-lora本地化部署实践【大语言模型实践一】 | 京东云技术团队
本文进行本地化部署实践的Alpacalora模型就是Alpaca模型的低阶适配版本。本文将对Alpacalora模型本地化部署、微调和推理过程进行实践并描述相关步骤。
  • 1
  • 2
  • 3
  • 4
  • Go toPage