「无本体数据」共找到 3013 篇相关文章
Agent 正在终结云计算“流水线”,Infra 必须学会“思考” | 专访无问芯穹夏立雪
InfoQ 专访无问芯穹联合创始人夏立雪,他分享了面向 Agent 的基础设施建设进展与经验,探讨从“处理”到“思考”的范式转变对基础设施的冲击,指出 Agent 规模化落地阻碍及解决办法,还谈及 Agentic Infra 等内容。
一个数据集,一年产稿7876篇!AI强力加持,垃圾论文海量爆发
利用美国NHANES公共数据集,结合AI工具,研究者批量生产质量堪忧的论文。这不仅是技术滥用,更是科研评价体系扭曲的缩影。背后有论文工厂作祟,根源在于学术生态的扭曲。
当AI成为预言家:大数据时代,我们正在失去理解世界的能力吗?
文章借神经科学家Grace Huckins观点,探讨AI时代人类理解世界能力问题。以‘微处理器论文’实验为例,指出大量数据未必带来理解。还阐述理解与预测分离、科学理解危机等,强调理解应是科学核心。
腾讯Youtu-agent 不会代码,也能搞定数据分析+深度研究+HTML报告
腾讯开源的Agent框架Youtu - agent灵活高性能,可用于数据分析等多任务。基于openai - agents构建,适配多种模型API等。突出优势是能自动化生成智能体及其配置,采用YAML配置方案,有内置‘元智能体’,还完全异步。
隐私优先的本地匿名化小模型:在数据离开设备前保护个人信息
最强 AI 模型在云端,安全数据在本地,这一矛盾困扰着想用 AI 处理敏感信息的人。Freysa 团队提出解法,不重写提示,只替换敏感信息,用小模型实现精准匿名化,有实用价值。
打造图像编辑领域的ImageNet?苹果用Nano Banana开源了一个超大数据集
苹果研究团队提出Pico - Banana - 400K数据集,基于Nano - Banana在OpenImages实拍照片生成编辑对。其系统化设计保证质量与多样性,还构建自我编辑评估流程,为图像编辑模型训练评测奠定基础。
POF|清华大学张宇飞团队:采用数据驱动湍流模型的三维增升装置模拟
传统RANS方法预测分离流动有挑战,数据驱动湍流模型泛化性能有局限。清华大学张宇飞团队研究其在复杂三维增升装置应用,验证SST - CND模型泛化能力及修正项迁移能力,证明其可用于真实工程流动问题。
19年不丢数据,擦写6万次不坏,原子级材料重新定义未来芯片
上海大学王震宇副教授团队在《自然·电子学》发文,用二硫化铌和二硫化钼做出新型非易失存储器,能保持数据约19年、擦写超6万次,还具备计算和存储两种本领,对未来低功耗计算和存内计算有吸引力。
智源研究院发布中英文高质量数据集CCI4.0,推动全球人工智能开源创新
2025年5月6日,智源研究院在全球开源创新论坛发布中英文高质量数据集CCI 4.0,同步在多平台开源。CCI 4.0规模大,处理严格,此前CCI系列反响好,未来将持续建设中文预训练语料库。
马斯克宣布:Grok学会看片了!无字幕看懂陶哲轩菲奖级难题
马斯克宣布Grok可分析任何视频。它能对伪造视频鉴假溯源,但也有处理画面靠字幕、有幻觉问题和效果不稳定的缺陷。实测中它能理解无字幕视频,还整理访谈内容。这功能虽便利,但引发人类能力退化担忧。