Google更新XNNPACK加速函式库强化稀疏模型支援
开发者可以使用XNNPACK加速函式库和TensorFlow Lite框架创建稀疏模型,来缩小模型大小,并且加快模型在CPU上的推理速度
英伟达 TensorRT 8 上线,BERT 推理延迟仅有 1…
英伟达昨日发布了其 TensorRT 的 8.0 版本。TensorRT 可以看作是在英伟达各种 GPU 硬件平台下运行的...
拿下AI榜双冠背后 华为云ModelArts的性能秘密
就在上周三,斯坦福大学发布了最新的 DAWNBench 榜单,这是全球人工智能领域最权威的竞赛之一。华为云 M...
加速 3.47 倍!火山引擎助力 AIGC 突破性能瓶颈
AIGC(AI-GeneratedContent人工智能生成内容)一经推出火爆全网,各种画风和产品形态频频出现且快速演进。以StableDiffusion模型为例,一次完整的预训练大约需要在128张A
2023-01-05 资讯 我要分享机器学习推理引擎ONNX Runtime 1.8开始支援网页AI用例
ONNX Runtime 1.8加入网页支援,可以在浏览器中使用CPU和GPU来加速模型运算
Nvidia开源高效能推理平台TensorRT函式库元件
TensorRT支援热门的深度学习开发框架,可以最佳化这些框架开发的模型,并部署到嵌入式、自动驾驶或是资料中心平台
脸书开源服务器端推理函式库FBGEMM,以低精度运算加速机器学习推理
与科学计算中使用的传统线性代数函式库不同,FBGEMM不使用FP32或FP64精度,而是透过降低精度计算以加速深度学习模型。
TensorFlow释出最新1.7版!除了整合Nvidia推理优化引擎TensorRT,还新增追踪ML建模的除错仪表板
Google于3月27日时,正式释出TensorFlow1.7版,不仅能整合了Nvidia的TensorRT推理优化引擎,还增添了除错仪表板,让使用者可以随时暂停执行,来观察不同节点的执行情况
2.69 分钟完成 BERT 训练,华为 CANN 5.0 速度展示
快,着实有点快。现在,经典模型BERT只需2.69分钟、ResNet只需16秒。啪的一下,就能完成训练!这是华为全联接2021上,针对异构计算架构CANN5.0放出的最新性能"预热":4K老电影AI修
把视觉 TransFormer 的优势融进卷积模型里,入选 ECCV 2022 的这篇论文火了
当下,计算机视觉领域最热议的方向,莫过于近两年越来越火的视觉Transformer(ViT)和传统的卷积神经网络(ConvNet),谁才能主宰计算机视觉的未来?风头正盛的ViT,是计算机视觉领域过去十
2022-08-03 资讯 我要分享华为云ModelArts刷新斯坦福深度学习训练及推理…
日前,斯坦福大学发布最新的DAWNBench榜单,华为云ModelArts一站式AI开发平台,获得图像识别训练和...
MLPerf 最新发榜,浪潮 AI 服务器囊括数据中心推理全部冠军
2022年4月7日,全球权威AI基准评测MLPerf™公布最新AI推理(Inference)V2.0榜单,浪潮AI服务器以最高性能获得了数据中心(固定任务)的全部16项冠军。MLPerf™由图灵奖得主
超长序列,超快预测!深势科技联手阿里云,AI 蛋白质预测再下一城
(图:新冠病毒研究重点之一三聚体结构的刺突蛋白)摘要:强强联合,突破AI蛋白质预测模型推理性能瓶颈,支持最高6.6k长氨基酸序列蛋白质的预测计算,达到目前已知最优推理效果。近日,深势科技与阿里云机器学
2022-09-13 资讯 我要分享


