「AI自我提升」共找到 11438 篇相关文章
ACL 2025杰出论文!用能力显著向量让大模型下游任务性能预测更精准
上海人工智能实验室与复旦大学联合研究成果《Capability Salience Vector》获ACL 2025杰出论文奖。提出能力显著向量(CSV)解决验证损失与下游任务能力脱节问题,实验验证其提升了下游任务表现可预测性。
工业异常检测新突破,复旦等多模态融合监测入选CVPR 2025
复旦大学等机构联合发布高精度多模态数据集Real - IAD D³,提出多模态融合检测方法D³M,成果被CVPR 2025收录。该数据集含多类数据,提升检测性能,此前相关工作也被CVPR 2024收录。
前两天刚被群嘲,ChatGPT转头就解决了一个数学难题
前些天,OpenAI研究员宣称GPT - 5‘发现’数学难题解法被指只是检索文献引群嘲。但加州大学洛杉矶分校教授用ChatGPT解决凸优化未决问题,还有教授用其发现命题反例,甚至要将其列为论文一作,AI正成研究伙伴。
黄仁勋人生首条推文力挺开源,“Kimi恐慌”成为风暴眼
当地时间7月24日,英伟达创始人黄仁勋发首条推特分享联名信力挺开放权重AI。此事与新开源模型Kimi K3引发的‘Kimi恐慌’相关,‘开源vs闭源’路线之争因此推向高潮。同时,围绕模型蒸馏是否侵权争议不断。
Monet:赋予多模态大模型如人类一般的抽象视觉思考能力
文章介绍了Monet模型,它实现了训练MLLM直接在连续隐空间思考的方法,内化视觉思考能力。还阐述了多模态模型隐式推理训练的难点,提出SFT+RL训练框架,构建数据集,经测试,Monet提升了视觉推理能力。
Anthropic:警惕评测排行榜!差别可能只是机器的内存更大,而已
Anthropic发工程博客指出,AI编程评测排行榜上排名前列的模型分差小,而运行环境硬件配置能让分数波动6个百分点。同一模型在不同沙箱策略下分数不同,资源配置影响评测结果,排行榜分数差距或因硬件。
狂发钱的元宝派,除了领红包还能用来干嘛?
元宝派是腾讯的AI社交新实验,用10亿新春红包引流。它类似群聊,有24小时在线的“元宝”。能当裁判活跃群聊,还能做图、看文件等,融入搭子文化元素,依托腾讯生态拉不同好友入群。
今年TRAE写的代码:100000000000行!超50%程序员每天在按Tab键
2025年末TRAE发布年度产品成绩单,一年写1000亿行代码、超50%用户高频用Tab键。其Cue功能助行业进入人机共生,SOLO模式让开发者成指挥者。它历经三阶段,指标优、构建生态,是中国AI IDE领域领先者。
机器人的 GPT 时刻比我们以为的更近|AGIX PM Notes
文章认为机器人的 GPT 时刻可能比想象更近,未来 2 - 3 年或出现较通用机器人,3 - 5 年有望规模化部署。还分析了当前机器人发展情况、瓶颈及数据获取方式,同时介绍了上周市场动态和多家公司的 AI 相关事件。
奥特曼纳德拉同台回应一切:合作细节、OpenAI未来路线曝光
OpenAI完成“股改”,奥特曼和微软纳德拉露面回应诸多外界关注话题,包括OpenAI新组织结构影响、微软与OpenAI后续合作、AI未来等,还谈及营收、算力投资、上市计划等细节。