腾讯基于预训练模型的文本内容理解实践

分享嘉宾:赵哲博士 腾讯 高级研究员 编辑整理:张书源 爱丁堡大学 出品平台:DataFunTalk 导读: 预训练已经成为自然语言处理任务的重要组成部分,为大量自然语言处理任务带来了显著提升。本文将围绕预训练模型,介绍相关技术在文本内容理解方面的应用。更具体的,本文会首先对已有的经典预训练工……

阅读全文

供应链十张图帮你理解供应链名词上篇

文章作者:冯维 清华大学博士 责任编辑:钱蕊 本篇文章来自 微信公众号智慧的流动: 十张图帮你理解供应链IT名词!(上篇) 欢迎原链接转发,转载请前往 @留德华叫兽 的主页获取信息,盗版必究。 敬请关注和扩散本专栏及同名公众号,会邀请 全球知名学者 陆续发布运筹学、人工智能中优化理论等相关干货、 知乎L……

阅读全文

腾讯技术交互式分析领域为何能够杀出重围

姜国强 腾讯云加社区 导语 | 在百花齐放的交互式分析领域,ClickHouse 绝对是后起之秀,它虽然年轻,却有非常大的发展空间。本文将分享 PB 级分析型数据库 ClickHouse 的应用场景、整体架构、众多核心特性等,帮助理解 ClickHouse 如何实现极致性能的存储引擎,希望与大家一起交流。文章作者:姜国强,腾讯实时检索研发……

阅读全文

图像检索在高德地图数据生产中的应用

作者 | 灵笼、怀迩 高德技术 稿 一 背景 POI 是 Point of Interest 的缩写。在电子地图上,POI 代表餐厅、超市、政府机关、旅游景点、交通设施等等 。POI是电子地图的核心数据。对普通用户而言,POI 数据包含的名称和位置信息,能够满足其使用电子地图“查找目的地”,进而唤起导航服务的基本需求;对电子地图而言,通……

阅读全文

源码系列倒排表

原文: https://www.amazingkoala.com.cn/Lucene/Index/2019/0222/36.html 本篇文章介绍如何生成倒排表,通过一个简单的例子来讲解倒排表的底层存储结构。文章中不会给出详细的源码介绍,只有一些必要的对象,感兴趣的朋友可以看我的 GitHub,对构建倒排表的源码给出了详细的注释: https://github.com/luxugang/Lucene-7.5.0/blob/master/solr-7.5.0/lucene/core/src/java/org/apache/lucene/index/DefaultIndexingChain.java ,此类中的该方法是开始构建倒排表的入口。 另外如果某些域使用了词向量(Ter……

阅读全文

一个更好更快更强的序列标注成分句法分析器

韦阳 华东师范大学 计算机科学与技术硕士在读 原文链接: Better, Faster, Stronger Sequence Tagging Constituent Parsers​godweiyang.com 为了看懂论文里的策略梯度,又去把强化学习看了一遍。。。 论文地址: Better, Faster, Stronger Sequence Tagging Constituent Parsers​arxiv.org 介绍 这篇论文主要是在之前的那篇论文 Constituent Parsing as Sequence Labeling​go……

阅读全文

腾讯大幅降低存储成本可搜索快照是如何办到的

作者: 腾讯 高斌龙 导语 | Elasticsearch 7.10 版本最近发布,该版本有一个重磅特性:Searchable snapshots (可搜索快照功能),可以大幅度地降低存储成本。那么 Searchable snapshots 的使用方式和实现效果是怎样的呢,下面就让我们来一探究竟吧!本文作者:高斌龙,腾讯云大数据研发工程师。 一、功能介绍 在 Searchable snapshots 可搜索快照功能发布之前,……

阅读全文

搜索引擎背后的经典数据结构和算法

原文: 码海 喜欢请关注文末公众号 前言 我们每天都在用 Google, 百度这些搜索引擎,那大家有没想过搜索引擎是如何实现的呢,看似简单的搜索其实技术细节非常复杂,说搜索引擎是 IT 皇冠上的明珠也不为过,今天我们来就来简单过一下搜索引擎的原理,看看它是如何工作的,当然搜索引擎博大精深,一篇文章不可能完全介……

阅读全文

主流预估模型的演化及对比

学习和预测用户的反馈对于个性化推荐、信息检索和在线广告等领域都有着极其重要的作用。在这些领域,用户的反馈行为包括点击、收藏、购买等。本文以点击率(CTR)预估为例,介绍常用的CTR预估模型,试图找出它们之间的关联和演化规律。 数据特点 在电商领域,CTR预估模型的原始特征数据通常包括……

阅读全文

的查询毛刺问题原因分析

如果业务对查询延迟很敏感,Elasticsearch 查询延迟中的毛刺现象就是比较困扰的一类问题,由于出现毛刺的时间点已经过去,无法稳定复现,对于根因的分析比较困难,无法用系统化调试的思想,从现象出发逐步推理,定位问题,能做的通常就是看一下监控系统对应时间点的指标情况,而在 es 中,导……

阅读全文

最近文章

福利派送

分类

标签

360搜索 58同城 Abtest AB测试 AdaBoost AdaDeltaW AdamW AdvancedFeaturesOfNetty AFM模型 AI AIGC AILab Airbnb AI平台 AKF架构 Alink Android ANN AnnotationFormatterFactory Announcement AOF AOP Apache ApacheFlink Apollo AQS ArchitectureDesign AresDB ASR AUC Augur Automaton AutoML Bagging Bandits Basic BERT BI BigGAN BI平台 Boosting BPR Checkpoint Clazz ClickHouse Cluster CNN Collection ConcurrentCoding ConcurrentProgramming Condition CRF Css Cto CTR CTR模型 CTR预估 CV CVPR DDD DDD实战 DeepFFM DeepFM DeepFM模型 DesignPattern Devops Dgraph DIN DKN模型 DMP平台 Docs Doris DPP DRN Druid DSP DSSM Dubbo EE问题 Elasticsearch ELK ELMo Embedding EncodingSpecification Epoll ESSM ETL Faraday Feed流 FFM FFM模型 FixedBitSet FixMatch Flink Flutter FM FM模型 Format FreeWheel FST FTRL FullGC Game GAN GBDT GBDT+LR融合 GBM GC Git Github Gitlab GNN Go Golang Google Graphql GraphScope GRU4REC Ha3 Hadoop Hbase Hologres Hystrix Iceberg IM ImageNet Impala InnoDB IntBlockPool IoC IOTechnologyBase IRGAN IT博士 IT移民 JanusGraph Java JavaScript Jdbc JDK JS Kafka KBQA Kubernetes KV存储 Lab LambdaMART LDA LearningExperience LinUCB方法 Linux LruCache LSTM LSTM网络 Lucence Lucene Message Milvus MKR模型 MLflow MMoE Mock MoE Monorepo MRR Mvc Mybatis MySQL Nacos NDCG NER Netty Netty主要组件源码分析 Netty多协议开发 Netty技术细节源码分析 Netty编解码 Nexp Nextjs Nifi NIO NIPS NLP Node2vec Nodejs Npm OCR OKR Olap One-Hot OPPO Oss PageRank Parser PersonalExperience Pinot PlaceholderResolver Printer PropertySource Pulsar Push系统 Python Pytorch Q&A Que2Search Query扩展 Query理解 Query纠错 R-Tree React Reactjs Reactor Redis Region Registry Remote RippleNet RMI ROC RocketMQ Rpc RTree Scala SD Select Sentinel Serverless SHAP Sharding SIGAI SimCLR Skleam Softmax Solr Spark SPI Spring Spring5新特性 SpringBoot SpringBootBatch SpringCloud SpringMVC SpringSecurity SpringTransaction Spring整体脉络 Spring源码故事(瞎编版) Sqllit Stable Diffusion Stage Storm Storybook SVM Tailwind TCP粘拆包 TensorFlow TFServing Tomcat Topk Trace Transformer TurboSearch TX Typora UX Vivo Vuejs Web Web3 WebRTC Wide&Deep Word2vec XDeepFM XDL XGBoost XLNet Yoo视频 YoshuaBengio ZeroSearch Zookeeper 一致性 丑小鸭定理 业务 业务线 个性化推荐 个性化海报 中关村 中文分词 中文纠错 主题建模 书籍 事件驱动架构 事务 亚马逊 交叉验证 人工智能 人机问答 供应链 依存句法分析 信息检索 信息流推荐 倒排索引 倒排表 假设检验 全文索引 全民K歌 全链路压测 公平锁 关系 兴趣 内容挖掘 内容理解 决策树 冷启动 出轨 分层实验 分布式 分布式事务 分布式系统 分布式锁 分词 创业 加权融合 北京 区块 区块链 协同记忆网络 协同过滤 协方差 单元测试 博士 博士offer 压测 原则 双塔模型 反作弊 反欺诈 反脆弱 变量 召回 召回率 可观测性 可解释性 合约 后厂村 向量召回 向量检索 向量索引 吴恩达 命名实体识别 响应式编程 商汤科技 回归模型 因果分析 图像检索 图像识别 图数据库 图灵平台 图片翻译 图计算 在线学习 坐标回归 基于Netty开发服务端及客户端 基础支持层 增量学习 多多 多模态 多目标优化 大数据 大数据开发 头条 奥卡姆剃刀 学习 学习资料 学习资源 学会提问 实体识别 实时推荐 实时数仓 实时数据 实时日志收集 实时计算 实验平台 容灾体系建设 对比学习 对话系统 小城市 小米 小米搜索 小群效应 工作 布隆过滤器 帮帮 年轻人 广告 广告系统 序列标注 建模调参 开源数据集 开源项目 异常检测 异步IO 张嘉佳 强化学习 归一化 待分类 微服务 微软EXP 微软亚洲研究院 思维 性能优化 情感分析 意图识别 房租 技术 拆分 招聘 拼多多 持续交付 持续集成 损失函数 排序 排序模型 排队 推理系统 推荐 推荐理由 推荐系统 推送平台 提问的智慧 搜索 搜索广告 搜索引擎 搜索排序 搜索架构 搜索系统 支持向量 支持向量机 数仓体系 数仓平台 数据中台 数据仓库 数据分析 数据分析平台 数据同步 数据平台 数据指标 数据挖掘 数据治理 数据湖 数据科学 数据结构 数据集 数据驱动 文字识别 文摘 文本分类 文本情感分类 文本挖掘 文本纠错 文本表征 新闻推荐 方法论 日志架构 日志检索 时序特征挖掘 智慧物流 智能合约 智能客服 智能物流 智能语音 智能问答 智能预警 服务 机器学习 机器学习爱好者 机器学习面试题 机器翻译 机器视觉 机器阅读 条件随机场 架构 架构师 标签 标签平滑 标签识别 标签选择 校招 样本 核心处理层 检索引擎 槽位识别 模型剪枝 模型压缩 模型融合 模型评估 模型部署 模型预估 模式匹配 模式识别 正则化 注意力机制 洋码头 流批一体 消息队列 深度 深度兴趣网络 深度学习 深度树匹配 深度树检索 混排 混沌工程 火焰图 热点挖掘 熔断降级 爬虫 爱奇艺 牛顿-莱布尼茨 物流 特征工程 特征平台 特征系统 猜你喜欢 用户建模 用户画像 电商搜索 白兔 百度 相关系数 真话 矢量语义 知乎架构 知识图谱 知识增强 知识蒸馏 短文本解析 短视频 短语抽取 短语挖掘 碧桂园 神经网络 神马搜索 离线计算 秒杀架构 秒杀系统 程序人生 程序员 稳定性规范 空间索引 窗口函数 端上智能 端智能 算法 类协同训练 类目识别 粗排 索引 线程 线程池 缓存 网络图 置信度 美团 美团大脑 美团点评 职场 联邦学习 腾讯技术 腾讯音乐 自动化测试 自动驾驶 自然语言处理 色情识别 花椒直播 苞谷 蚂蚁金服 规则平台 规则引擎 视频推荐 计算广告 计算机视觉 认知 讨论区 记忆建模 记忆网络 论文 评价指标 评测指标 词向量 词嵌入 词权重 语义分割 语义匹配 语义检索 语义模型 语义理解 语言模型 语音内容识别 语音识别 谷歌面试 贝叶斯个性化排序 贝壳找房 贝壳智搜 货币化 起步 趋势科技 路径规划 软实力 边缘计算 达摩院 迁移学习 过拟合 逻辑回归 逻辑思维 采购 重叠实验框架 重排序 重构 金融 银汤匙 链表 链表求交集 阿里 阿里云 阿里妈妈 阿里小蜜 阿里达摩院 陈薇 陌陌 降纬打击 随机变量 零拷贝 面经 面试 项目管理 预估引擎 预训练 领域设计 领域驱动 风控 风控系统 高可用 高并发 高斯热图 高维数据索引 黄峥 黑盒模型

友情链接

其它