测评提升」共找到 3030 篇相关文章

新闻资讯7

扎克伯格正在打造自己的「AI分身」,并计划裁掉1.6万人

路透社称Meta酝酿大规模裁员,或超1.6万人。《华尔街日报》报道扎克伯格正打造“CEO Agent”辅助工作。Meta内部AI工具普及,与员工绩效挂钩,但效率提升也带来裁员压力,因AI投入巨大。

机器之心
新闻资讯7

Anthropic融了250亿,却说:AI时代的学习,只剩下这3件事了。

Anthropic估值3500亿,融资超250亿后与哈佛、伯克利学生探讨AI时代学什么。指出AI是照妖镜,能区分混子与学霸,还介绍AI学习法,强调对抗舒适区用AI提升自己。

探索AGI
算法论文8

大模型推理学习新范式!ExGRPO框架:从盲目刷题到聪明复盘

上海人工智能实验室等团队提出经验管理和学习框架ExGRPO,能科学管理经验。与传统RLVR方法比,它在不同基准提升性能,尤其复杂推理任务,还揭示滚雪球效应,为模型推理训练提供新思路。

量子位
算法论文8

RL 将如何提高具身大模型 VLA 泛化性?清华大学团队NeurIPS 2025文章分析 RL 与 SFT 泛化性差异

清华大学团队在NeurIPS 2025发表文章,揭示强化学习(RL)提升具身大模型VLA泛化能力的优势,对比其与SFT差异,还提出评测基准和训练方法,为VLA训练提供新方向。

机器之心
算法论文8

Depth Anything再出新作!浙大&港大出品:零样本,优化任意深度图

浙江大学与港大团队推出「Prior Depth Anything」,融合深度传感器数据与AI深度图,一键补洞、降噪、提分辨率。无需额外训练,可提升3D模型深度质量,零样本刷新多项深度处理纪录。

新智元
开源动态8

集合通信库VCCL释放GPU极致算力,创智、基流、智谱、联通、北航、清华、东南重磅开源

在超大规模智算集群需求下,创智、基流等多方联合开源集合通信库VCCL。它基于NCCL开发,有智能调度、容错、细粒度观测机制,实测能提升算力利用率、降低故障率,还解决了服务器异构等问题。

机器之心
开源动态8

开源复现o3图像思考!快手让AI不再被动看图,模型自主生成代码调用工具

Kwai Keye团队提出Thyme新范式,构建技术方案,赋予开源模型“超越图像思考”能力。包括设计训练策略、构建开源配套资源,拓展多模态模型工具使用与决策水平,在基准测试中性能提升显著。

量子位
新闻资讯7

GPT-5:我更强了,就这?“看不见”的升级

OpenAI 发布 GPT - 5,它未带来 AGI 相关的震撼升级,而是更注重实用。其训练有新特点,具备推理强、编程能力提升等特性,是 AI 从‘模型炫技’到‘产品体验打磨’转变的标志。

MacTalk
新闻资讯7

AI圈深夜大乱斗!OpenAI、谷歌、Anthropic发布新模型,集体翻车?

昨晚,OpenAI时隔六年再次开源`gpt-oss-120b`和`gpt-oss-20b`,Anthropic发布`Claude Opus 4.1`,Google发布Genie 3及写故事书功能。不过OpenAI新模型幻觉率高,Anthropic更新提升有限。

探索AGI
开源动态8

阿里深夜开源王炸Agent!硬刚OpenAI,性能全面SOTA!

过去半年,开源Agent在解决复杂难题时难敌OpenAI。昨天阿里通义开源WebSailor模型,用完整可复现方法论挑战闭源霸权,通过构造L3合成数据、取精华训练轨迹、两步走训练策略提升性能。

PaperAgent