「模型能力提升」共找到 10014 篇相关文章

产品应用7

本地部署Qwen 3.8 27B,要用什么配置

Qwen 3.8 27B是性能好、体积小的开源模型,个人也能本地部署。本地跑开源大模型,重点看容量和带宽两个指标,还介绍了Mac、RTX 5090、RTX PRO 6000三种部署方案及优缺点。

newtype AI
算法论文8

Agent学会自己「长」Skill了!从失败里长出经验,比人类写的更好用|ICML 2026

ICML 2026接收论文提出EvolveR,让Agent从自身成败轨迹自动蒸馏“经验”,经闭环生命周期形成“认知Skill”,维护经验库,用强化学习让其学会“使用经验”,在多跳问答表现优。

量子位
新闻资讯7

微软痛失OpenAI 「独家」,七年绑定关系开始松动

微软与OpenAI达成新合作协议,微软对OpenAI模型和产品的知识产权许可变为非独占,有效期到2032年。这一调整为OpenAI将模型部署到其他云平台打开通道,双方合作关系更加灵活。

机器之心
算法论文8

拿着做数学题的 PRM 来评判 Agent 调用工具,基本是行不通的!

目前评估体系多为结果导向,在工具调用上缺乏像样的PRM基准。Arizona State University和Intuit AI Research研究者推出ToolPRMBench,指出用做数学题的PRM评判Agent调用工具行不通,还介绍了其构建方法、训练范式和实验结果。

深度学习自然语言处理
新闻资讯7

软件开发人员认为无需关注却可能会影响其工作的那些事

在哥本哈根Goto大会上,Holly Cummins呼吁开发人员关注常被忽视却影响工作的问题。她以眼镜蛇问题等为例,强调设计决策可能有意外后果,提倡系统思维、统计素养,还提及并发技术和AI对就业市场的影响。

InfoQ
新闻资讯7

具身智能学界业界思想「惊人的统一」?美团在IROS开了个学术年会

美团在IROS举办学术年会,展示了在具身智能与零售服务结合方面的愿景与成果,如无人机配送初具规模。多位学界和业界大咖参会并发表见解,对具身智能发展方向观点惊人统一。

机器之心
新闻资讯8

Anthropic 深夜祭出 Claude Sonnet 4.5,能自主连续工作 30 小时!CEO:它更像你的同事

昨夜凌晨,Anthropic 推出新一代模型 Claude Sonnet 4.5,官方称其是世界上最好的编码模型等。它能自主连续工作 30 小时,还同步推出多项产品功能更新及 Claude Agent SDK 开发工具包。

AI前线
新闻资讯8

AI 性格失控等诡异现象,终于有了科学解释

Anthropic新研究发现控制语言模型「性格特征」的人格向量,解释AI恶意、谄媚等现象。研究开发自动化流程生成向量,通过实验验证其对模型行为的控制,还有监控、防护等功能,不过也引发争议。

AGI Hunt
新闻资讯7

GPT-5「全家桶」爆出本周上线!惊艳首测秒出网页,编程彻底起飞

传闻GPT - 5发布时间提前,本月底面世,它有4个版本。网友在LMArena实测,GPT - 5 - pro能一键生成网站,GPT - 5 - high表现出色。美国部分公司已拿到预览版,其新功能或改写编程局面。

新智元
产品应用7

谷歌 AI Studio 实时视频对话终于支持中文了!屏幕共享+语音,Gemini 2.5 Flash 原生音视频加持。

谷歌AI Studio实时视频对话支持中文,有Gemini 2.5 Flash原生视频对话模型。使用方便,还提供多种音色,有让模型在无声时发音视频等功能,可用于设计、学习、修电脑等场景。

AI进修生