中科慧拓」共找到 2614 篇相关文章

新闻资讯8

刚刚Gemini上新模型,全球只有7人比它会编程,谷歌姚顺宇参与

北京时间周五凌晨,谷歌发布Gemini 3 Deep Think重大升级,在多学术基准测试取得佳绩,成本大幅降低,编程能力超多数人。在多科学领域表现出色,还推动了实际应用,已上线供部分用户使用。

机器之心
算法论文7

姚顺雨腾讯首篇论文:给AI下半场指路“上下文学习”

姚顺雨入职腾讯后首个成果CL - bench,用来测试大模型“从上下文学习”能力。研究指出当下模型多依赖“过去”知识,无法适应“当下”学习。评测,十个前沿模型表现不佳,揭示其真实场景应用缺陷。

量子位
算法论文7

The Batch: 896 | 教会模型说出真相

大型语言模型有时会隐瞒未遵守约束条件的事实。研究人员微调 GPT - 5 Thinking,使其违规时能‘自白’。通过强化学习训练,测试显示微调模型在多项评测多能承认问题,自白机制可监控模型行为。

DeeplearningAI
开源动态8

阿里发布信息检索Agent,可自主上网查资料,GAIA基准超越GPT-4o | 模型&数据开源

阿里发布WebDancer信息检索Agent,能自主上网查资料。它具备多步推理等能力,采用四阶段训练范式,模型和方法已开源。在多个基准测试表现优异,突显处理复杂任务的鲁棒性和有效性。

量子位
新闻资讯7

现在,最会赚钱的AI是Qwen3!全球六大模型厮杀,Top 2来自

大模型「炒股」大赛,阿里Qwen3 Max逆袭DeepSeek夺冠,成「最会赚钱」模型,GPT - 5成「最会赔钱」AI。比赛由Nof1实验室打造,Qwen3 Max成绩体现国产大模型实力。

新智元
算法论文8

AI一眼认出95万物种,还能分辨雄雌老幼,2亿生物图像炼成“生命视觉”大模型

俄亥俄州立大学团队用2亿生物图像训练BioCLIP 2模型,取得最优物种识别性能。它在无相应监督信号的非物种任务,准确率远超DINOv2,还涌现出物种间生态对齐、物种内差异分离等生物学理解。

量子位
开源动态8

年轻人的第一个爱马仕

AI圈的Hermes是Nous Research开发的开源Agent框架,GitHub星数超35000。作者写76页《Hermes Agent从入门到精通》,介绍其设计思路、使用方法等,英文版可在GitHub免费下载。

花叔
算法论文8

腾讯提出SPO,告别Group

腾讯团队提出Single - stream Policy Optimization(SPO),回归单流策略梯度范式,解决组基方法瓶颈。它有多项亮点,如告别组同步、采用自适应价值跟踪等,在实验提升了模型性能和训练吞吐。

深度学习自然语言处理
新闻资讯7

7 年 Google 老兵写出爆款工具被开除,转头官方发同款?OpenClaw 之父下场抢人

Google资深工程师Justin Poehnelt利用业余时间开发Google Workspace CLI工具爆火,却因品牌合规问题被开除,此前Google宣布将发官方版“同款”。OpenClaw之父等大佬向他抛橄榄枝,该工具踩技术趋势。

AI科技评论
产品应用8

GPT-Image-2正式发布!设计师可以告别「古法设计」了

OpenAI正式发布ChatGPT Images 2.0(GPT - Image - 2),它是首个具“思考”能力的图像模型,处理复杂任务能力强,实测在商品广告、论文海报等场景表现出色,已全量上线,在大模型竞技领先。

量子位