极字问题」共找到 390 篇相关文章

开源动态8

设计师集体沸腾!阿里开源千图像编辑模型,支持语义及外观的双重编辑!

阿里Qwen团队于2025年8月18日发布Qwen-Image-Edit模型,基于20亿参数的Qwen-Image模型,结合Qwen2.5-VL和变分自编码器,支持语义及外观双重编辑,能精准修改文字,已上线Qwen Chat等。

开源星探
算法论文8

大模型“拼好”,45K数据撬动18%提升,数学拒绝死记硬背 | MathFusion

上海AI Lab等团队提出MathFusion,通过三种“融合策略”生成新的融合数据集MathFusionQA,仅用45K合成指令,在多基准测试中平均准确率提升18.0个百分点,增强模型解决数学的能力。

量子位
产品应用8

首个高考数学满分AI诞生!海淀名师审大,给出惊艳超高分

豆包爱学App的AI挑战高考数学全国卷,经6位资深名师严格把关,获Ⅰ卷144分、Ⅱ卷150分满分。其解过程出色,虽有小但可解决,对师生帮助大,预示AI教育将变天。

新智元
新闻资讯8

陶哲轩再爆:一个月三破18年未解难!AlphaEvolve彻底改写数学研究规则

一项封尘18年的数学难,在短短30天内被AlphaEvolve与人类联手三度突破,和差集指数θ从1.173050提升至1.173077,刷新加法组合学天花板,展示了AI与人类协作的新范式。

新智元
新闻资讯7

别再什么工作被AI取代!Karpathy直指本质:你的工作「可验证」吗?

前特斯拉AI负责人Andrej Karpathy提出,软件1.0自动化能指定的任务,软件2.0自动化能验证的任务。判断任务能否被AI接管,关键看是否满足可重置、可高效试错、可自动奖励三条准则。

新智元
算法论文8

Codeforces难不够刷?谢赛宁等造了个AI出机,能生成原创编程

LiveCodeBench Pro团队推出AutoCode框架,利用LLM自动化竞赛编程创建与评估。该框架结合验证器 - 生成器 - 检查器框架与双重验证协议,在测试用例生成上可靠性佳,还能生成新,同时揭示了LLM在创作上的优劣势。

机器之心
新闻资讯7

具身智能落地四:路线图、陷阱、生态位与破局思路|甲子引力X

在「渡口——甲子引力X2025科技产业投资大会」上,梅卡曼德创始人邵天兰探讨具身智能落地。他指出落地有陷阱,企业应耐心发展;智能机器人对手是人工与专用设备,要找生态位,梅卡曼德做通用组件应对挑战。

甲子光年
新闻资讯7

GPT-5“变笨”实锤,退休教授出了道井字棋送分,结果它真送了

退休经济学教授用井字棋简单测试GPT - 5,其表现拉胯,与“博士级AI”宣传不符。后续操作离谱,或因OpenAI策略调整。此外,OpenAI在测ChatGPT新功能,奥特曼开始炒GPT - 6。

量子位
算法论文8

用「进化+压力测试」自动生成的竞赛级编程,各家大模型谁更hold住?

北京大学与通用人工智能研究院联合提出 UniCode 框架,构建进化式评测系统,能自动生成高质量算法目与抗污染测试用例。通过对 19 个前沿大模型测试,展现高挑战性与强判别力,为代码能力评估开辟新路径。

机器之心
算法论文8

230个大模型在婴幼儿认知上集体翻车!揭秘多模态大模型的核心知识缺陷

ICML 2025研究揭示多模态大模型在基础认知能力上表现不佳。研究者建测评库CoreCognition测试230个主流模型,发现其存在核心知识缺陷,扩规模难补短板,还需补齐核心知识。

量子位