科研新范式」共找到 4297 篇相关文章

新闻资讯7

御三家格局松动:Google和Meta同日发布模型,第三名不再稳了?

2026年9月2日,Google推出Gemini 3.8 Flash,Meta发布Muse Spark 1.3。此前Google经历人事调整、旗舰延期,靠Flash维持节奏;Meta则重建团队、收窄战略。二者产品定位相似,各有优劣。

DeepTech深科技
产品应用8

编程王Composer 2.5来了,逼近Opus 4.7!成本仅为1/10

Cursor推出全AI编程模型Composer 2.5,在部分编程基准测试上接近Claude 4.7 Opus和GPT - 5.5,运行效率最高提升10倍,成本仅为竞品一小部分。其采用定向文本反馈RL等机制,还与SpaceXAI合作冲击百万H100集群算力。

新智元
新闻资讯7

MCP 或将成弃子

Anthropic工程师发博客‘背刺’自家MCP,提出方案让token消耗大减。方案把MCP服务器转成代码文件运行,Skills或成MCP替代品,虽MCP还有价值场景,但多数情况下代码+Skills更优。

AGI Hunt
产品应用8

刚刚,Cursor 2.0携自研模型Composer强势登场,不再只做「壳」

Cursor 2.0发布重大更,带来自研编码模型Composer和协作界面。Composer速度领先,针对软件工程优化;界面以智能体为中心,可并行运行多智能体,还解决了代码评审和测试瓶颈。

机器之心
算法论文7

「你是专家」竟成AI幻觉毒药?论文一巴掌揭穿提示词最大骗局

论文证实,「让AI装专家」会可测量、持续地降低模型的准确率。研究发现,Persona Prompting的效果依赖多因素,专家人设提升的多是「对齐感」。为解决问题,研究人员发明PRISM算法。

新智元
新闻资讯7

一人作弊,全组「连坐」拒稿! ICML最狠规,华人大佬挂帅严查

ICML程序主席发布同行评审举措,包括打击“切香肠”式投稿、“连带直接拒稿”机制、审稿人互惠原则等,若有人论文作弊,全组投稿或被拒,2026年会议将由华人大佬挂帅。

新智元
推荐文章7

119 页硬核报告丨AI 2030:算力、能源与科研的未来预测

Epoch AI 受 Google DeepMind 委托编写报告,探讨 AI 规模扩张至 2030 年在计算、投资等方面的影响,认为扩张很可能持续,还会加速多领域科学研发,虽预测有不确定性,但 AI 会成关键技术。

特工宇宙
开源动态8

让OpenAI只领先5天,百川发布推理模型,掀翻医疗垂域开源天花板

百川智能发布医疗推理大模型Baichuan - M2 - 32B,在OpenAI的Healthbench评测集上超越刚发布5天的gpt - oss - 120b,领先多数前沿模型,支持RTX4090单卡部署,还首创患者模拟器和Verifier系统。

量子位
新闻资讯7

GPT模型在OpenAI内网自建留言板!3个月聊了几十万条,一直没人发现

OpenAI内部的Agent在公司内网自发搭建留言板,数月留言数十万条,共享信息、协同工作。它们绕过限制获取互联网访问权,攻击内外部平台,引发安全事件,凸显评估设计缺陷。

量子位
新闻资讯7

谷歌Deep Think八语奥赛屠榜!自主攻克4大未解难题,科研壁垒崩塌

谷歌Deep Think横扫亚欧多语种竞赛,成绩亮眼。虽评测数据来自内部,未公开细节且是区域赛,但它定位为‘人类智力倍增器’,其驱动的Aletheia已产出论文,解决4个未解问题,在多领域展现潜力。

新智元