科学进展」共找到 585 篇相关文章

开源动态8

当世界模型不止「视频」该如何评估?WorldLens提出实用化评估新框架

生成式世界模型在多领域进展显著,但评估存在局限。WorldBench 团队构建 WorldLens 评测框架,从五个维度评测开源世界模型,其评测 EvalKit 已公开,可暴露模型能力边界与失效模式。

机器之心
8

AI 巨头对话:Sam Altman 与 Satya Nadella 论 AI 未来、算力与微软王牌

OpenAI的Sam Altman和微软的Satya Nadella在播客中探讨AI未来等话题。涉及1.4万亿算力投入、微软与OpenAI新合作协议细节,指出瓶颈在数据中心和电力,还谈及AI经济模型、未来愿景等。

宝玉AI
算法论文8

重新思考RLVR中的熵正则:从探索不足到探索过度的破局之路

2024年以来,RLVR使大模型在推理任务有显著突破,但实践中探索机制易失衡。传统熵正则化在LRM场景易走向极端,研究团队提出SIREN方法精准调控探索,实验显示其在多模型和数据集上性能提升显著。

深度学习自然语言处理
新闻资讯8

斯坦福AI虚拟实验室炸场了!几天设计92种纳米抗体,90%以上实验可行,这才是真正的AI科学家!

斯坦福大学和Chan Zuckerberg Biohub团队开发AI驱动的“虚拟实验室”,能自主研发COVID - 19纳米抗体,90%以上候选药物实验可行。AI在药物研发各环节优势显著,国内AI制药也有进展

AIGC开放社区
推荐文章8

大模型如何推理?斯坦福CS25重要一课,DeepMind首席科学家主讲

Google DeepMind首席科学家Denny Zhou在斯坦福CS25课程分享大语言模型推理见解,总结了四个关键点,阐述推理机制、优化方法及最新进展,还介绍多种推理方法并比较其优劣。

机器之心
算法论文8

突破40年Dijkstra算法瓶颈,清华教授等颠覆教科书!斩获STOC最佳论文

清华大学教授段然提出最短路径新方法,击败经典Dijkstra算法,突破40年排序瓶颈。该算法不依赖排序,运行更快,摘得STOC最佳论文,团队正优化追求更快速度。

新智元
算法论文8

GUI定位还在玩「非黑即白」?浙大团队提出GUI-G²,显著提升GUI智能体定位性能

在人工智能领域,GUI 智能体成技术风口,但现有 GUI Grounding 方法有缺陷。浙大团队提出 GUI - G²,将 GUI 交互转变为连续空间建模,在三个主流 GUI 定位基准测试中表现亮眼,重新定义了 GUI 交互本质。

机器之心
开源动态8

一句话复刻谷歌!我用智谱新开源的GLM-4.5,把Agent开发打回了简单模式。

智谱AI深夜发布开源的新一代旗舰模型GLM - 4.5,目标成为最强Agent基座。它能一句话复刻搜索引擎,多能力原生融合,在多项测试中表现出色,推理快、价格低,还通过多关压力测试,且开源成本低。

探索AGI
新闻资讯7

OpenAI 内部访谈流出:新 Agent 强到让我们害怕,已接近“自我进化”的边缘!

红杉资本访谈 OpenAI 打造新款 ChatGPT Agent 的核心成员。介绍 Agent 结合多工具、共享状态,能执行复杂任务。还谈及起源、训练方法、应用场景,以及安全挑战和未来规划等。

探索AGI
算法论文8

一篇120页AI4Research(科学研究AI)最新系统性综述

为填补AI在科学研究应用缺乏全面综述的空白,提出AI4Research调查。其主流流程和分类分五个关键领域,各领域细分任务,凸显AI在研究中多样角色,还介绍多学科应用。

PaperAgent