当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek新专利“一种广度数据采集的方法及其系统”公布,可减少数据采集时网络资源消耗

4周前 (04-02)Deepseek最新资讯160

国家知识产权局官网显示,4月1日,DeepSeek关联公司杭州深度求索人工智能基础技术研究有限公司申请的“一种广度数据采集的方法及其系统”专利公布。

摘要显示,本发明涉及数据采集领域,尤其涉及一种广度数据采集的方法及其系统,包括:建立网页元信息库;确定每日调度单元下载配额及当日下载总额度;从网页元信息库中选取相应数量的链接,分配下载额度;下载过程控制;下载文本进行后处理及数据清洗后进入回灌队列,通过信息回灌实现网页元信息库更新。本发明的有益效果在于:发现尽可能多的网页链接,并减少对网站的流量冲击;对已经下载的内容进行分析,对未下载的连接进行质量推断,通过择优下载分配额度的方式,减少低质量网页下载和重复下载,提高数据质量及下载效率,减少在数据采集过程中网络资源的消耗;采用单独的信息回灌队列,保证网页元信息库修改操作的原子性和稳定性。


“DeepSeek新专利“一种广度数据采集的方法及其系统”公布,可减少数据采集时网络资源消耗” 的相关文章

“调用量太大,经常造成网络拥堵”!DeepSeek推出新优惠,普通用户依然免费

“调用量太大,经常造成网络拥堵”!DeepSeek推出新优惠,普通用户依然免费

中国商报(记者 赵熠如)2月26日,DeepSeek宣布推出错峰优惠活动。即日起,北京时间每日00:30至08:30的夜间空闲时段,API(应用程序编程接口,通常用于应用开发)调用价格大幅下调:Dee...

梁文锋的秘密武器:DeepSeek R2或5月问世,成本仅GPT-4o的2.7%

梁文锋的秘密武器:DeepSeek R2或5月问世,成本仅GPT-4o的2.7%

五月将至,中美科技巨头或将迎来新一轮巅峰对决。先是在4月中旬,OpenAI一口气发布了GPT-4.1 o3、o4 mini系列模型;谷歌则拿出了Gemini 2.5 Flash Preview,一个混...

“联通元景+DeepSeek” 赋能重庆12345热线智慧升级

“联通元景+DeepSeek” 赋能重庆12345热线智慧升级

在人工智能技术快速发展的背景下,中国联通积极推进数字化建设,助力重庆12345政务服务便民热线接入DeepSeek R1国产大模型,并融合中国联通元景大模型技术,实现民生诉求场景下热点问题的全维度态势...

青岛AI企业积极“接入”DeepSeek 提升自家行业模型能力

青岛AI企业积极“接入”DeepSeek 提升自家行业模型能力

原标题:青岛AI企业如何高效拥抱DeepSeek青岛日报/观海新闻记者 孙 欣 周晓峰 杨 光美国当地时间2月17日晚间,马斯克旗下人工智能公司xAI发布了最新人工智能模型Grok 3。在这场直播发布...

可灵AI全面接入DeepSeek,降低AI创意内容门槛

可灵AI全面接入DeepSeek,降低AI创意内容门槛

36氪获悉,近日,快手可灵AI已全面接入DeepSeek-R1,在视频生成、图片生成等场景下,用户可通过DeepSeek协助生成或者优化提示词,轻松将灵感转化为专业提示词,打造高质量创意视频。在文生视...

中信证券:DeepSeek,当前AI产业链投资催化剂

中信证券:DeepSeek,当前AI产业链投资催化剂

中信证券发布研报称,认为Deepseek在模型训练成本降低方面的最佳实践,料将刺激科技巨头采用更为经济的方式加速前沿模型的探索和研究,同时将使得大量AI应用得以解锁和落地。算法训练带来的规模报酬递增效...