「模型性能提升」共找到 9424 篇相关文章

算法论文8

TPAMI 2025 | AI对抗迁移性评估的「拨乱反正」:那些年效果虚高的攻防算法们

本文第一作者赵正宇来自西安交大,针对现有迁移攻击方法缺乏系统公平对比分析的问题,将其分为五大类,在 ImageNet 上对 23 种攻击与 11 种防御方法开展评估,证实评估缺陷会误导结论,解决后有新见解。

机器之心
推荐文章7

从 ReasoningBank 到 MetaAgent,RL 未必是 Agent 自进化的必要解?

业内对智能体自进化的探讨开启多路线探索模式。除 RL 优化,记忆系统改进成新方向,如 ReasoningBank 机制。此外,业内还从智能体自我识别、工具和策略辅助等机制探索其他技术路线。

机器之心
新闻资讯7

奥特曼亲自操刀,为日韩定制「AI强国」蓝图

OpenAI近日接连发布《日本经济蓝图》和《韩国经济蓝图》,标志其亚太战略从「产品输出」升级为「国家级合作」。在韩提出「双轨战略」,在日以「三支柱」计划为核心,助力两国借AI提升全球地位。

新智元
新闻资讯8

Anthropic这两天真没闲着:上线网页版Claude Code,还让Claude搞科研

Anthropic推出Claude Code网页版,无需本地安装命令行工具,还提供Claude iOS应用预览版。其有并行处理多任务等亮点。此外,还发布Claude生命科学版,搭载Claude Sonnet 4.5模型,能助力科研。

AI前线
开源动态8

HAMi 2.7.0 重磅发布 | 异构芯片全面拓展,调度更稳、生态更强

Dynamia密瓜智能宣布发布HAMi 2.7.0版,在硬件生态、调度器、应用层生态等方面有显著进展。硬件上支持昆仑芯、燧原、AWS等芯片;调度器优化了资源计算和可观测性;应用层与vLLM、Xinference等整合。

InfoQ
产品应用8

刚刚,Anthropic 发布 Claude for Life Sciences,目标生物科研全流程

Anthropic推出Claude for Life Sciences,全方位布局生命科学领域。它配备Skills功能,生物学测试表现提升,能解读图像、分析数据。还深度整合科研生态,应用场景广,获众多药企、学术机构青睐,还有AI for Science计划。

AGI Hunt
新闻资讯7

AI正在改写地图APP!这一次轮到谷歌了

谷歌让开发者可通过Gemini API调用谷歌地图工具,整合位置感知功能。支持多模型,按查询次数收费。玩法多样,能个性化、实时化处理需求。国内高德早有相关尝试,AI正改写地图APP。

量子位
产品应用8

首创“AI+真人”双保障模式!刚刚,百度健康推出7x24小时「能聊、有料、会管」AI管家

百度健康推出7x24小时AI管家,首创“AI+真人”双保障模式,提供全链路服务。它能精准咨询、推荐就医、管理健康档案,靠三层模型架构支撑,标志医疗AI向“智能健康伙伴”跃迁。

量子位
新闻资讯7

State of AI 2025:霍桑效应下,AI 是「赚钱机器」还是「泡沫机器」?

Air Street Capital发布2025年度《State of AI Report》,证实AI成重要经济增长动力,但技术突进伴随矛盾。报告提及AI推理能力有‘霍桑效应’,或成泡沫,不过AI - first公司商业化加速,付费工具采用率和合同价值飙升。

机器之心
开源动态8

具身智能迎来ImageNet时刻:RoboChallenge开放首个大规模真机基准测试集

近日,RoboChallenge推出全球首个大规模、多任务真机基准测试。它构建开放、公正、可复现的‘真实考场’,为视觉 - 语言 - 动作模型提供评估标准,推动具身智能发展,还提供远程测试服务等。

机器之心