实时开放世界模拟」共找到 1729 篇相关文章

算法论文8

RAG新王:AccurateRAG屠榜SOTA

大模型记不住私有或实时信息,RAG 落地遇难题。AccurateRAG 是 Qualcomm 团队端到端工程方案,有 4 个模块化组件,在 6 个数据集上刷新 SOTA,解决 RAG 文档解析、检索和生成难题。

PaperAgent
新闻资讯8

3亿美金种子轮!ChatGPT大神联手DeepMind牛人,要造一个真正的“AI科学家”

9月30日,OpenAI的ChatGPT创造者之一William Fedus和谷歌DeepMind的GNoME项目负责人Ekin Dogus Cubuk成立Periodic Labs,获3亿美元种子轮融资。公司要创造“AI科学家”和自主实验室,从物理科学切入,解决超导、半导体等领域问题。

AIGC开放社区
推荐文章7

AI Coding 的下半场,何去何从?

文章回顾AI Coding三年演进,指出2023年范式落地、2024年Coding Agent上位、2025年形态之争加速且CLI成主战场。分析项目“火爆”逻辑,提及市场数据背书,还探讨应用与模型关系及技术堆栈。

AI科技大本营
算法论文8

自搜索强化学习SSRL:Agentic RL的Sim2Real时刻

本文由多机构联合完成,引入自搜索强化学习SSRL。它利用结构化prompt和format reward提取模型world knowledge,降低幻觉。还探索Sim2Real有效性,验证SSRL训练模型在真实场景泛化性,且所有训练数据等已开源。

机器之心
产品应用7

融云首发“通信+AI”闭环架构,让 AI 有情商、能落地|甲子光年

8月28日融云在AIM线上发布会推出“通信+AI”产品矩阵,围绕“能落地的好AI”理念打造高情商AI。通信与AI相互增强,构建四层知识体系数字分身,其产品可解决多场景痛点,还能降低开发门槛。

甲子光年
新闻资讯8

字节发布全球首个预测未来基准FutureX,Grok-4 拿下冠军

字节跳动发布全球首个实时未来预测基准测试FutureX,杜绝模型作弊。在25个模型评测中,Grok - 4夺冠。它从多网站构建问题,分四级难度。人类专家在部分等级仍领先AI 。

AGI Hunt
开源动态8

「0污染」LLM理解基准来了!20000道题14个学科全覆盖,来自微软

MMLU-CF是微软亚洲研究院推出的无污染多任务语言理解基准测试,含20000道题、覆盖14学科。通过去污染规则和闭源测试集防数据泄露,保证评估结果可靠,已在Huggingface开放

新智元
新闻资讯7

马斯克造了个AI女友

马斯克新推出Grok的AI Companions功能,有AI女友Ani等角色。不过需Super Grok会员,每月30美元,且仅iOS可用。AI陪伴赛道不太平,有付费和平台安全等问题,马斯克还有新计划。

量子位
新闻资讯8

新紫光集团三周年:智变跃升,交出硬核答卷

2025年7月11日新紫光集团完成战略重整三周年,交出硬核答卷,连续三年营收超千亿,专利增加。其聚焦智能科技主业,通过战略布局、技术攻坚、生态协同实现发展,未来将持续求新求变,深化合作。

芯师爷
算法论文8

通义实验室最新成果WebDancer:开启自主智能Deep Research的新时代

通义实验室推出 WebDancer,解决自主信息检索智能体构建难题。它创新合成训练数据,采用两阶段训练策略应对开放网络训练挑战,在多个基准测试中表现卓越,未来还将拓展能力。

机器之心