感知级评估」共找到 1881 篇相关文章

新闻资讯7

AI编程「反直觉」调研引300万围观!开发者坚信提速20%,实测反慢19%

非营利性 AI 调研机构「METR」对 AI 编程工具影响开发者效率进行随机对照实验,结果意外:开发者本坚信提速 20%,实测却慢 19%。还分析了原因,指出调研局限与未来展望。

机器之心
算法论文8

用MoE打造DNA基础模型更强范式!人大实现seq2func全新突破

中国人民大学团队提出SPACE模型,通过引入物种感知编码器和谱系分组增强解码器,革新架构,提升了DNA基础模型性能与泛化能力,在多项测试中表现优于主流模型。

新智元
算法论文8

思维锚点:破解LLM Reasoning黑箱的关键句

文章提出思维锚点概念,指推理轨迹中影响后续步骤和答案的关键句。开发三种归因方法,系统论证高组织句影响力更大,锚点主导错误修正。研究为理解LLM推理机制开辟新途径,开源工具支持可视化分析。

深度学习自然语言处理
新闻资讯7

Nature:博士太多,高校已经装不下了!

过去几十年全球博士毕业生数量爆炸式增长,远超学术界职位空缺。如今就业从学术界转向工业界,未来博士教育培养模式应转变,产学研结合,以匹配劳动力市场。

新智元
新闻资讯7

大模型全员0分!谢赛宁领衔华人团队,最新编程竞赛基准出炉,题目每日更新禁止刷题

谢赛宁等人出题,让o3、Gemini - 2.5 - pro等模型全军覆没。LiveCodeBench Pro是实时基准测试,题库每日更新。此前称LLM编程超人类专家,本次测试并非如此,最好模型难题通过率也为0。

量子位
算法论文7

智能体自己出现问题自己找!首次提出“自动化失败归因”课题 | ICML2025 Spotlight

LLM Multi - Agent系统失败诊断难,阻碍迭代优化。宾夕法尼亚州立大学等机构研究者首次提出“自动化失败归因”课题,构建Who&When数据集,开发评估多种归因方法,实验揭示当前方法不足。

量子位
新闻资讯8

谷歌AlphaEvolve引发OpenAI关注:AI原创算法,正挑战人类专家界限

谷歌DeepMind推出的AlphaEvolve系统,结合Gemini模型与进化算法,能自主探索、生成并迭代优化算法代码。它优化经典算法,在多领域取得突破,其原创能力引业界关注,OpenAI研究员对此表示震撼。

AI寒武纪
算法论文8

具身智能空间视觉死穴,终于被最新顶会彻底解决!

招商局先进技术研究院下属实验室提出新的移动数据范式,以极低成本破解 VLA 的空间泛化瓶颈。研究团队识别出 VLA 模型三种捷径学习模式,提出层次化数据解耦策略,该方案在主流 VLA 模型上验证有效。

新智元
新闻资讯8

零GPU,世界第一超算!深圳制造改写游戏规则了

中山大学教授带队、深圳制造的灵晟超算登顶全球超算TOP500榜单,零GPU采用纯CPU架构,全链路自研。图灵奖得主评价其为“AI4S新型架构的希望之光”,还在多领域展开应用。

量子位
算法论文8

LangFlow: 挑战离散扩散,探索下一代语言模型新范式

UIUC Ge Liu团队发布《LangFlow: Continuous Flow Matching for Large Language Models》,回归连续扩散架构。研究指出连续扩散受挫非先天缺陷,经优化,LangFlow让连续扩散在标准基准追平离散扩散,为多模态统一架构打通底层路线。

机器之心