「数据科学」共找到 2709 篇相关文章
看似无害的提问,也能偷走RAG系统的记忆——IKEA:隐蔽高效的数据提取攻击新范式
研究聚焦RAG系统,提出全新黑盒攻击方法IKEA。它不依赖异常指令,通过自然查询提取私有信息。经多数据集测试,其效率和成功率高,还证实提取知识实用,揭示RAG系统潜在脆弱性。
谢赛宁等推出统一多模态模型!替代VAE实现图像理解/生成双SOTA,代码权重数据集全开源
谢赛宁等团队推出统一多模态模型Blip3 - o,用扩散Transformer生成CLIP图像特征,采用顺序预训练策略。对比多种设计方案,确定CLIP + Flow Matching最佳,模型在多任务测试表现卓越且全开源。
4.4k星!给Agent接上「本地免费搜索爬虫」,内置11个skill执行数据搜索、爬取、自动研究
文章推荐开源本地搜索工具wigolo,它是专门给Agent使用的本地网络能力层,可解决本地运行Agent查找资料时使用API麻烦费钱的问题。它功能多样,有搜索、缓存等工具,自带11个Skill。
比人类专家快2倍,斯坦福联合英伟达发布TTT-Discover:用「测试时强化学习」攻克科学难题
斯坦福与英伟达等机构联合提出 TTT - Discover 方法,让 LLM 在测试时强化学习。它在多任务上成绩出色,如在数学、GPU 内核等领域超越人类和其他 AI,计算成本低,或为持续学习打开新空间。
CSDN 创始人蒋涛:中国开源十年突围路、模型大战阿里反超 Meta,数据解析全球开源 AI 新进展
在GOSIM HANGZHOU 2025现场,CSDN创始人蒋涛发布两份报告。《2025全球开源发展报告(预览版)》显示美主导、中国崛起;《大模型技术体系开源影响力榜单》中,Meta、阿里等表现突出,强调大模型竞争关键在生态。
陶哲轩DeepMind梦幻联动,最强通用科学Agent来了!一口气解决芯片设计、矩阵乘法和300年几何难题
谷歌DeepMind与陶哲轩等打造的AlphaEvolve是LLM驱动的进化编码Agent。它能优化计算生态、调度数据中心等,还解决了数学难题,已在谷歌内部使用,现开启早期邀测试用。
AI让科研人发了3倍论文,但科学本身正在收缩:什么才是科研人真正需要的AI?
2026 年研究显示,用 AI 工具的科学家发文量是不用者 3.02 倍,但科研主题覆盖面缩减、虚假引用增多。通用 AI 提升效率却动摇科研基础,爱思唯尔 LeapSpace 注重可信度与发现力,已开放免费试用。
阿里通义开源「推理+搜索」预训练新框架:小模型媲美大模型,多个开放域问答数据集表现显著提升
阿里通义实验室开源通用预训练框架MaskSearch,引入检索增强型掩码预测任务,兼容两种训练方法。实验显示,它在多数据集提升模型性能,小模型能媲美大模型,还验证了训练方式、策略及奖励函数的效果。
入选 SOSP'25:百度智能云对象存储的分布式层级 Namespace 破解业界难题,彻底扫清 AI 时代大数据上云障碍
百度沧海・存储团队与高校合作的论文被 SOSP'25 录用,介绍了百度智能云对象存储 BOS 的分布式层级 Namespace 系统 Mantle。它攻克业界难题,融合文件和对象存储优势,性能卓越,已在 BOS 生产环境大规模上线超两年。
真6,上线几天,轻松斩获10k,首款开源通用AI智能体Suna:一句话自动处理Excel/爬数据/写报告,程序员私人助理诞生!
Suna是Kortix推出的全球首个开源通用型AI Agent,核心突破是“执行力”,能像人类员工操作数字工具。它开源透明,是全能数字员工,已落地多场景,有五大核心功能。还给出部署方法和同类对比。