当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek新专利“一种广度数据采集的方法及其系统”公布,可减少数据采集时网络资源消耗

7个月前 (04-02)Deepseek最新资讯585

国家知识产权局官网显示,4月1日,DeepSeek关联公司杭州深度求索人工智能基础技术研究有限公司申请的“一种广度数据采集的方法及其系统”专利公布。

摘要显示,本发明涉及数据采集领域,尤其涉及一种广度数据采集的方法及其系统,包括:建立网页元信息库;确定每日调度单元下载配额及当日下载总额度;从网页元信息库中选取相应数量的链接,分配下载额度;下载过程控制;下载文本进行后处理及数据清洗后进入回灌队列,通过信息回灌实现网页元信息库更新。本发明的有益效果在于:发现尽可能多的网页链接,并减少对网站的流量冲击;对已经下载的内容进行分析,对未下载的连接进行质量推断,通过择优下载分配额度的方式,减少低质量网页下载和重复下载,提高数据质量及下载效率,减少在数据采集过程中网络资源的消耗;采用单独的信息回灌队列,保证网页元信息库修改操作的原子性和稳定性。


“DeepSeek新专利“一种广度数据采集的方法及其系统”公布,可减少数据采集时网络资源消耗” 的相关文章

宿州:DeepSeek引领AI应用浪潮 打造“智”变引擎

宿州:DeepSeek引领AI应用浪潮 打造“智”变引擎

在当今科技飞速发展的时代,AI技术已成为推动各行业变革的核心力量。其中,DeepSeek以其独特的技术优势,不仅推动了AI应用的爆发式增长,更为产业变革带来了深远影响。近年来,宿州市将数字化转型作为赢...

DeepSeek致谢腾讯大模型网络提速技术方案贡献,助力大模型通信性能提升30%

DeepSeek致谢腾讯大模型网络提速技术方案贡献,助力大模型通信性能提升30%

5月7日,科技领域迎来一则备受瞩目的消息:腾讯技术团队针对DeepSeek开源的DeepEP通信框架展开了深度且细致的优化工作,经过不懈努力,成功让该框架在多种复杂多变的网络环境下均实现了显著的性能提...

超越DeepSeek?巨头们不敢说的技术暗战

超越DeepSeek?巨头们不敢说的技术暗战

无可置疑的,DeepSeek-R1模型的面世使中国AI技术发展有了极大的优势侧,也标志着人工智能领域的里程碑式突破。这款具有颠覆性意义的推理模型不仅在研发效率上展现出显著优势,其性能指标可与OpenA...

联想AI智能、AI一体机快速接入,满血版DeepSeek成国产AI鲶鱼

联想AI智能、AI一体机快速接入,满血版DeepSeek成国产AI鲶鱼

近期,各类终端企业“紧跟热点”,纷纷高调宣布接入满血版DeepSeek,正式开启DeepSeek接入潮。其中,联想不仅率先推出了首个国产DeepSeek一体机解决方案,其个人智能体“小天”和联想百应智...

车企“抢滩”DeepSeek背后:角力智能座舱,降低投资成本

车企“抢滩”DeepSeek背后:角力智能座舱,降低投资成本

DeepSeek掀起的技术革命正在席卷汽车行业。截至目前,超过20家车企宣布接入DeepSeek模型,涵盖了比亚迪、吉利、奇瑞、岚图、长城、理想汽车等主流品牌。这一情况与2023年ChatGPT爆火时...

DeepSeek-V3再发论文,梁文锋署名,低成本训练大模型的秘密揭开

DeepSeek-V3再发论文,梁文锋署名,低成本训练大模型的秘密揭开

机器之心报道机器之心编辑部关于 DeepSeek-V3,你需要了解的一切。虽然此前 DeepSeek 已经发布了 V3 模型的技术报告,但刚刚,他们又悄然发布了另一篇围绕 DeepSeek-V3 的技...