数据难题」共找到 3451 篇相关文章

开源动态7

11K+ Star!NotebookLM 最强开源平替来了,支持私有化部署!

NotebookLM好用但有数据隐私问题,GitHub上的SurfSense是其开源平替,支持私有化部署。它功能成熟,支持多种文件格式等,提供三种入门方式,虽缺PPT生成能力,但知识管理和问答功能够用。

开源星探
算法论文8

首次实现第一视角视频与人体动作同步生成!新框架攻克视角-动作对齐两大技术壁垒

新加坡国立大学等联合发布EgoTwin框架,首次实现第一视角视频与人体动作联合生成,攻克视角-动作对齐与因果耦合瓶颈。它基于扩散模型,通过三大创新设计解决难题,实验性能超基线。

量子位
开源动态8

「0污染」LLM理解基准来了!20000道题14个学科全覆盖,来自微软

MMLU-CF是微软亚洲研究院推出的无污染多任务语言理解基准测试,含20000道题、覆盖14学科。通过去污染规则和闭源测试集防数据泄露,保证评估结果可靠,已在Huggingface开放。

新智元
开源动态8

刷新复杂Agent推理记录!阿里通义开源网络智能体超越DeepSeek R1,Grok-3

互联网信息检索中,复杂问题让普通开源模型力不从心。阿里通义实验室提出WebSailor方案,通过SailorFog - QA数据集和DUPO算法等创新,提升模型能力,在多基准测试中超越诸多开闭源模型。

量子位
开源动态7

世界模型再迎新突破,兔展智能UniWorld-View登顶WorldScore榜单

近年来,世界模型成视觉 AI 重要研究方向。兔展智能联合研发的 UniWorld - View 登顶 WorldScore 榜单,完成昇腾算力适配与开源。它聚焦让 AI 理解未拍摄世界,解决了诸多技术难题

机器之心
新闻资讯8

40万次Claude Code会话实锤:这才是AI时代最值钱的本事!

Anthropic用40万次Claude Code会话数据得出结论,决定AI编程成败的不是代码功底,而是对行业的理解。人决定造什么,AI决定怎么造,懂行的人能从AI榨出几倍产能。

新智元
算法论文8

ACL 2026 Main | 不只是调用地图API,Spatial-Agent让大模型生成可执行地理分析工作流

大语言模型在空间领域应用广泛,复杂地理分析问题需组织自然语言成可执行流程。Spatial - Agent 加入 GeoFlow Graph 中间层,借用 GIScience 理论,实验显示能提升准确率,不过仍受数据质量等限制。

机器之心
算法论文8

RL是「点金石」还是「挖掘机」?CMU 用可控实验给出答案

卡耐基梅隆大学研究者构建基于GSM - Infinite的可控合成数据框架,分析预训练、中期训练和RL对模型推理泛化能力的影响,调和了RL有效性的不同观点,为改进训练策略提供基础。

机器之心
新闻资讯7

ChatGPT惊现“零点击攻击”,API密钥被轻松泄露,OpenAI暂未解决

ChatGPT存在“零点击攻击”安全问题,攻击者可通过向第三方应用文档注入恶意提示,窃取用户敏感数据和API密钥。OpenAI虽采取防范措施,但攻击者仍能绕过。专家为企业提出防范建议。

量子位
算法论文8

北航LiveRepoReflection: 扭转乾坤-仓库级代码反射

本文提出LiveRepoReflection基准,评估多文件仓库代码理解和生成能力,含1888个测试案例。创建RepoReflection - Instruct数据集训练RepoReflectionCoder,评估40多个LLMs,结果显示其能有效测模型反思修复能力。

PaperAgent