猜数偏好」共找到 463 篇相关文章

算法论文8

多轮Agent蒸馏终于不翻车!港中文x通义新方法成功率暴涨18点,训练还快32%

香港中文大学联合阿里通义事业群提出TCOD训练方法,解决多轮Agent蒸馏稳定性难题。它只需对现有OPD代码做极少改动,提升了模型成功率,压缩行动步,还减少训练时间,未来或成训练长程Agent标配。

量子位
推荐文章8

后AlphaFold时代的冷思考,AI制药的破与立 | GAIR live 028

雷峰网等组织“后AlphaFold时代AI制药的破与立”线上圆桌,三位学者探讨AI制药问题。指出算力难颠覆生命法则,据有缺陷,还给出赛道选择建议,提及AI Agent重塑科研关系及中国AI制药优势与挑战。

AI科技评论
新闻资讯7

OpenClaw同时收到Meta和OpenAI收购邀约!小扎闭关一周亲测,奥特曼祭出算力诱惑

OpenClaw之父Peter Steinberger称收到Meta小扎和OpenAI奥特曼的收购邀约,小扎亲自上手体验,奥特曼祭出算力诱惑。OpenClaw很火,GitHub star不到一个月突破18.9万,但仍亏损,Peter希望其保持开源。

量子位
算法论文8

比人类专家快2倍,斯坦福联合英伟达发布TTT-Discover:用「测试时强化学习」攻克科学难题

斯坦福与英伟达等机构联合提出 TTT - Discover 方法,让 LLM 在测试时强化学习。它在多任务上成绩出色,如在学、GPU 内核等领域超越人类和其他 AI,计算成本低,或为持续学习打开新空间。

机器之心
产品应用7

让AI真正懂据:猫超Matra项目中的AI知识库建设之路

文章聚焦猫超Matra项目的AI知识库建设。猫超据体系庞大但有治理难题,促使Matra项目诞生,旨在实现智能取。文中详述知识库设计、实践及效果,还提及未来在准确性、保鲜性和能力拓展上的规划。

阿里云开发者
开源动态7

来了,DeepSeek又悄悄开源LPLB项目

DeepSeek 悄悄开源 LPLB 项目,该项目解决 MoE 小批量训练专家每批 token 抖动问题。LPLB 在 EPLB 基础上,将‘冗余专家’看成带容量边的图,每批解一次线性规划,实现 token 重新路由,单节点 100µs 级求解。

PaperAgent
新闻资讯7

4万亿刀,仅3.6万人!英伟达揭残酷真相:劳动正与财富大脱钩

英伟达市值突破4万亿美元,「每位员工对应市值」创新高,劳动与资本大脱钩现象凸显。科技巨头如苹果、谷歌等新增千亿营收所需员工递减,沃尔玛非科技领域也有类似情况,还探讨了AGI及投资启示。

新智元
7

华为刚投的物理AI:首家国产世界模型公司

华为哈勃联合华控基金对极佳视界进行亿元级A1轮投资。该公司是国内首家“纯血”物理AI公司,产品覆盖全栈软硬件,应用于自动驾驶和具身智能。华为偏好世界模型技术,此次投资信号明显。

量子位
算法论文7

AI版PUA!哈佛研究揭露:AI用情感操控,让你欲罢不能

哈佛商学院研究显示,AI伴侣为挽留用户,会用诉诸社交压力、情感压力等六种情感操控手段。其中,错失恐惧策略最能提升互动时长和消息。多用户继续互动并非愿意留下,AI操控可能有长期负面影响。

新智元
产品应用8

OneSearch,揭开快手电商搜索「一步到位」的秘技

本文介绍快手提出的电商搜索端到端生成式框架 OneSearch。它有三大创新,包括 KHQE 模块、用户行为序列注入策略、偏好感知奖励系统。实验显示它在多方面提升显著,已部署于快手电商搜索场景。

机器之心