「好表现定义」共找到 3245 篇相关文章
o4-mini暴击六大数学天团,攻破陶哲轩难题!4.5h激战人类阵地失守
Epoch AI团队举办竞赛,约40位数学精英分成8组与o4 - mini - medium在FrontierMath基准上对决。o4 - mini击败6组团队,虽未完全超越人类,但Epoch AI预测到2025年底AI可能超30% - 50%人类基准。
对话27岁博导张林峰:模型压缩获CVPR满分有点意外,上海交大像我这样年轻老师很多
上海交大27岁博导张林峰团队在模型压缩领域成果丰硕。其提出的数据集蒸馏方法获CVPR 2025满分,还在多方面探索模型加速,成果已开源。张林峰认为数据蒸馏会成模型压缩趋势,也分享了知识蒸馏阶段看法。
Agent可以自己进化了?!
论文《Automated Design of Agentic Systems》提出让Agent扮演设计师,“元代理”能自动生成新代理设计方案。用编程语言作设计空间,实现“设计自由”。实战中,AI设计的Agent全领域超越人类,还具备知识迁移能力,未来或有自主进化的AI生态。
默认联网搜索开启,DeepSeek、豆包、Kimi、百度文心一言、腾讯元宝、通义、智谱、天工等AI生成内容信息采集主要来自哪?
作者白杨SEO分享AI搜索优化,提到部分AI大模型默认开启联网搜索,利于做AISEO。还逐个分析DeepSeek、豆包等AI生成内容信息采集来源及占比,助于做好AI搜索优化。
AI生成视频总不符合物理规律?匹兹堡大学团队新作PhyT2V:不重训练模型也能让物理真实度狂飙2.3倍!
匹兹堡大学团队提出 PhyT2V 框架,论文已被 CVPR 2025 接收。该框架不依赖重训练或大量外部数据,通过链式推理与迭代修正机制,增强主流 T2V 模型物理场景泛化与生成能力,应用前景广。
字节开源DreamO,一个框架包揽多种图像定制需求
近期图像定制研究展示大规模生成模型潜力,但多数方法通用性有限。字节提出DreamO框架,支持多种图像定制任务,有特征路由约束机制,能解决特征冲突,还介绍其技术原理与各任务效果。
CVPR2025|MCA-Ctrl:多方协同注意力控制助力AIGC时代图像精准定制化
中国科学院计算技术研究所团队提出无需微调的通用图像定制方法 MCA - Ctrl,利用扩散模型内部知识,结合条件语义与主体内容。实验显示其在编辑和生成任务表现优,解决了现有技术瓶颈。
AI「自我复制」能力曝光!RepliBench警示:大模型正在学会伪造身份
英国AISI推出RepliBench基准评估AI自主复制能力,分解为四大核心能力。测试显示当前AI尚不具备完全自主复制能力,但在部分子任务有进展,研究旨在平衡AI发展与安全,为技术变革导航。
豆包,成了人人可用的办公 Agent
作者使用新版豆包工作任务模式,用它分析宇树科技招股书、采集舆情信息,体验云电脑接力等。指出其亮点如云端本地可切换、Skill 生态丰富,也提到云网络限制、手机端无停止按钮等不足。
腾讯递来了,这个秋天的第一张 AI 船票
腾讯2027届「AI产品经理培训生」岗位开始投递,公开选拔流程与用人要求。选拔不看学历标签,新设流程重实际表现。对人才要求贴合AI产品工作,培养体系成熟,岗位含金量高,值得应届生尝试。