资讯
AI公司发现通过Wayback Machine抓取Reddit的历史数据,既无需遵守Reddit的平台政策(如付费、合规协议),又能获取训练所需的大量内容,于是就利用这一漏洞开始了违规“曲线获取数据”的行为。 Reddit发言人Tim ...
Reddit的成功部分归功于AI公司对该社区网站历史上人类原创帖子的需求,他们将这些内容用于模型训练。公司的数据许可业务(属于"其他收入"项目)达到3500万美元,同比增长24%。Reddit去年与 OpenAI ...
IT之家8 月 13 日消息,参考外媒 The Verge 当地时间 11 日报道,海外大型社区论坛 Reddit 宣布禁止互联网档案馆 (Internet Archive) 对该论坛非首页的绝大多数页面进行索引存档。 Reddit 发言人在向媒体解释这一变化时表示,这是因为一些 AI 企业以违反平台政策的方式通过互联网档案馆的存档页面抓取该企业数据。Reddit 允许企业付费抓取 AI 所需的数 ...
1 天
至顶头条 on MSNReddit封锁互联网档案馆阻止AI公司数据抓取
Reddit已开始阻止互联网档案馆索引其热门帖子,原因是发现AI公司绕过平台限制,通过抓取档案馆的存档内容获取Reddit数据。此前,互联网档案馆的时光机可靠地存档Reddit页面、用户资料和评论,但现在只能存档Reddit主页截图。Reddit发言 ...
markdown ...
IT之家 8 月 13 日消息,参考外媒 The Verge 当地时间 11 日报道,海外大型社区论坛 Reddit 宣布禁止互联网档案馆 (Internet Archive) 对该论坛非首页的绝大多数页面进行索引存档。Reddit 发言人在向媒体解释这一变化时表示,这是因为一些 AI 企业以违反平台政策的方式通过互联网档案馆的存档页面抓取该企业数据。Reddit ...
6 天on MSN
AI变革搜索方式,Reddit意外占据有利位置
由真人分享和整理的Reddit对话内容成为AI模型的重要信息来源,使Reddit在AI机器时代中意外脱颖而出。尽管广告仍是该公司主要收入来源,但AI授权业务也开始为其带来高利润增长。
最初,数据抓取只是业余爱好者的一种边缘策略,如今已演变成一个由商业数据聚合器驱动的、价值数百亿元的复杂生态系统——自动机器人在面向公众的网站上撒下大网,收集价格数据、产品列表、评论等,其速度通常比人类点击“刷新”的速度还要快。如今,这些实体经常绕过传 ...
AI超强说服力,已达人类的6倍 AI洗脑人类,成功率6倍暴击!苏黎世大学在Reddit秘密实验引爆全网,LLM假扮多种身份,历时4个月发表1700+评论,轻松 ...
Reddit(RDDT.US)宣布其首次自3月份上市以来的收购动作,目标是Memorable AI,这是一家利用生成式人工智能技术助力营销人员制作更具吸引力广告的创新 ...
一些您可能无法访问的结果已被隐去。
显示无法访问的结果