特斯联 NLP 自训练学习算法:降低人工参与,让机器“听得到”更“听得懂”
自然语言处理(NaturalLanguageProcessing,NLP)是计算机科学领域与人工智能领域中的一个重要方向,广泛应用于机器翻译、舆情监测、观点提取、语音识别等场景。自然语言处理技术在发展
南京大学团队 2040 张图片训练出 ViT,准确率 96.7%,连迁移性能都令人惊讶
ViT在计算机视觉领域取得了巨大的成功,甚至大有取代CNN之势。但是相比CNN,训练ViT需要更多的数据,通常要在大型数据集JFT-300M或至少在ImageNet上进行预训练,很少有人研究少量数据训
AI 自给自足,用合成数据做训练,效果比真实数据还好
AI生成的图像太逼真,为什么不能拿来训练AI呢?可别说,现在还真有人这么做了。来自香港大学、牛津大学和字节跳动的几名研究人员,决定尝试一下能否使用高质量AI合成图片,来提升图像分类模型的性能。为了避免
2023-02-24 资讯 我要分享更轻,但更好!科大讯飞首发工业级中文预训练模型
近年来,以超大规模模型、海量训练数据、自监督学习准则为特点的无监督预训练模型备受关注。具有高通用性的无监督预训练大模型,结合知识和海量数据进行融合学习,通过提取原始数据的深层表征,实现对于下游任务的通
2023-01-06 资讯 我要分享华为云ModelArts刷新深度学习模型训练世界纪录
近日,斯坦福大学发布了DAWNBenchmark最新成绩,在图像识别(ResNet50-on-ImageNet,93%以上精度)的...
跑步训练中你一定会问的,华为都有答案
对人体来说,跑步是一个复杂的工程。从外部摆动的肢体,到内部循环的脏器,每一次呼吸,每一个步伐,都涉及到数百块肌肉的和数十个循环系统的协同工作,这个过程用一场战役来形容也不为过。在身体各个部位精密配合下
PaddlePaddle升级解读|十余行代码完成迁移学习…
迁移学习 (Transfer Learning) 是属于深度学习的一个子研究领域,该研究领域的目标在于利用数据、任务、...
华为云ModelArts等你体验!128块GPU,ImageNet…
摘要:ModelArts实现了更少资源、更低成本、更快速度、更极致的体验。128块GPU,ImageNet训练时间从...
特斯联 CV 弱监督自训练引擎技术:降低研发门槛,促 AI 快速落地
机器学习是推动人工智能(AI)向前发展的核心技术,过往,AI领域的主要发展聚焦于拓展机器的能力,随着AI从早期的野蛮发展阶段步入落地应用阶段,在与各个行业的实际结合过程当中,如何能将人类经验与机器学习
一块 RTX3050 搞定 DLRM 训练!仅需 1% Embedding 参数,硬件成本降低至十分之一
深度推荐模型(DLRMs)已经成为深度学习在互联网公司应用的最重要技术场景,如视频推荐、购物搜索、广告推送等流量变现业务,极大改善了用户体验和业务商业价值。但海量的用户和业务数据,频繁地迭代更新需求,
2022-12-21 资讯 我要分享专栏|基于IR-transformer、IRGAN模型 解读搜狗语义匹配技术
机器之心专栏 搜狗搜索 NLP 本文介绍了搜狗搜索的 IR-transformer 模型和 IRGAN 强化学习训练框架。 摘要 搜索引擎作为上网冲浪的直接入口,其检索...
Claude语音录音可作训练数据 需用户主动同意
Anthropic开始在Claude应用中询问用户是否允许用语音对话录音训练模型。语音音频此前仅转写后即丢弃,这是首次允许留存训练。新开关默认关闭,与聊天记录训练授权相互独立,仅限消费级套餐,用户可随
2026-10-05 人工智能 我要分享论文:Optimus5秒内调度1.6万个节点中的10万个任务 面向深度学习集群的高效动态资源调度程序
这是另一篇承诺现在有望缩短深度学习训练时间的论文。香港大学和北京字节跳动公司的研究人员共同开发了Optimus,它不是改进编程模型及/或数据流引擎,而是...
小布助手:业界首个基于对话音频的小样本语音合成技术实践
01背景传统基于神经网络的语音合成方法TTS已成为主流,技术相对也比较成熟,但是需要大量发音人的原始录音数据,制作成本相对较高。因此,少量语音样本的自定义TTS技术是语音合成领域的一大热点子方向。由于
2023-02-12 资讯 我要分享


