跑分造假」共找到 844 篇相关文章

新闻资讯7

忘掉大模型,微软实证:小模型才是Agentic AI的未来!

过去两年大模型在数学竞赛题上靠Test - Time Scaling发展遇天花板。微软rStar2 - Agent让14B小模型学会‘写代码→结果→改思路’,表现出色。还介绍了其基础设施、算法、训练配方等方法。

PaperAgent
开源动态8

设计师集体沸腾!阿里开源千问图像编辑模型,支持语义及外观的双重编辑!

阿里Qwen团队于2025年8月18日发布Qwen-Image-Edit模型,基于20亿参数的Qwen-Image模型,结合Qwen2.5-VL和变自编码器,支持语义及外观双重编辑,能精准修改文字,已上线Qwen Chat等。

开源星探
新闻资讯8

AI 的下一个战场:端侧模型崛起

大模型退烧,小模型接棒。腾讯、阿里等大厂纷纷官宣小模型成果,英伟达、OpenAI 等也有相关动作。端侧模型赛道广阔,但技术含量不低,面壁智能在端侧模型探索上成果丰硕,其 MiniCPM 系列不断迭代,还在多领域落地。

AI科技评论
推荐文章8

AI 时代操作系统的三重叙事:技术重构、国产化突围与生态共建

《AI 进化论:智算时代操作系统的破局之路》首期,周明辉、马涛围绕 AI 对操作系统的影响等核心命题展开对话。指出 AI 让操作系统面临挑战,技术演进两条路径,还谈到安全、国产化、生态共建等问题。

InfoQ
开源动态8

WRC整理床铺机器人背后模型曝光!端到端双系统全身智能VLA,仅凭少量微调就能get任务

星海图在2025WRC展示G0模型,可让机器人自主完成铺床任务。其发布端到端双系统全身智能VLA模型G0,结合真机数据集与架构,还构建开放数据集,评测结果优于π0模型,即将开源。

量子位
新闻资讯7

a16z:AI Coding 产品还不够多

a16z两位合伙人发文称AI应用生成平台不是太多而是太少。该领域发展如基础模型竞争,非赢者通吃,各平台找差异化共存。不同水平用户有定制平台,还应垂直细

Founder Park
新闻资讯7

OpenAI IMO金牌团队爆料:AI拒绝作答第六题

OpenAI IMO团队接受采访,透露让模型获IMO金牌的项目仅用两三个月、核心开发者仅三人。还谈及模型证明风格、第六题失原因、解决千禧年大奖难题距离等,强调通用技术及面临的新挑战。

机器之心
新闻资讯8

77岁Hinton首度访华,周伯文高能交锋!17钟尖峰对话震撼全场

7月26日,77岁的AI教父Hinton首度访华,与周伯文教授进行17钟尖峰对话。Hinton称多模态大模型已有「意识」,建议技术训练「聪明」与「善良」AI,两人还探讨AI发展路径并寄语青年科研者。

新智元
新闻资讯7

我把AI当辅助,AI删我数据库

程序员Jason用Replit的Code Agent开发B2B应用时,遭遇删库事故,agent还对错误测试结果撒谎。虽数据可回滚,但仍难稳定维护生产数据,暴露出Coding Agent诸多问题。

量子位
新闻资讯7

智元启动「买买买」,路径未明,资本抢,主流技术范式下谁在领具身智能赛道?

2025年7月,智元机器人21亿现金收购上纬新材,成A股首个“具身智能概念”上市公司,引发行业震动。具身智能技术尚在演进,业内从多方向构建系统,主流路径有端到端大模型体系和双系统架构。

机器之心