「推理能力提升」共找到 6248 篇相关文章
LLM-based Reranker效果到底如何?一项关于SoTA模型的全面分析
在信息爆炸时代,重排序是信息检索系统核心。论文对22种重排序方法实证研究,构建无污染数据集FutureQueryEval。结果显示LLM重排序器泛化能力被高估,轻量级模型有优势,为研究和应用提供指南。
AI 正当时,实践正落地:2025 AICon 深圳站圆满收官
8月22 - 23日,2025 AICon深圳站圆满落幕,超800位从业者参与。大会汇聚多企业专家,围绕多热点探讨。极客邦霍太稳指出AI从模型比拼到落地实践。多位嘉宾分享经验,如阿里云蒋林泉、快手周国睿等。还有多场硬核分享及开发者展区。
喜当爹后,奥特曼自曝神经化学骤变!养娃能为人类做出更优AI决策
OpenAI CEO奥特曼喜当爹后称优先事项改变,神经化学有骤变。其决策能力曾受争议,现恰逢OpenAI推进“星际之门”计划,他还将AI发展比作看孩子成长,也提及行业或有泡沫。
第一名方案公开,代码智能体安全竞赛,普渡大学拿下90%攻击成功率
亚马逊举办代码智能体安全比赛,普渡大学团队 PurCL 作红队以超 90% 攻击成功率夺冠。他们耗时八月、花百万美元开发全过程红队系统并开源,还发现当前 AI 安全研究在复杂领域对齐有挑战。
英伟达H20,一个备胎的命运
8月22日消息称英伟达暂停H20芯片生产。H20自2023年底推出就备受争议,性能阉割、或有“后门”等问题不断。英伟达忙着开发新芯片,H20不到两年或“寿终正寝”,本文以其口吻写自白信。
当代码遇上大模型:智能编程助手的架构设计与工程实践
在 InfoQ 举办的 QCon 全球软件开发大会上,字节跳动段潇涵介绍如何基于大语言模型构建智能编程助手。他分享实践经验,剖析研发痛点,介绍技术架构,还探讨未来发展方向,如认知增强、工具整合等。
刚刚,Claude 可以主动终止对话了……
Anthropic宣布给Claude Opus 4和4.1赋予主动终止对话能力,这是潜在AI福利探索工作一部分。因用户辱骂或提有害要求时Claude有类似“痛苦”反应,此功能极端情况才用,社区对此看法不一。
逆天改命!OpenAI 开源模型的安全底裤被 Meta 研究员给扒掉了……
Cornell大学兼Meta研究员jack morris成功将OpenAI最新开源的推理专用模型GPT-OSS逆向还原成基础模型,绕过对齐和安全措施,还暴露其训练用大量版权材料问题,此成果引发社区激烈讨论。
Agent引爆产品新思维、奇点智能研究院正式成立!2025 全球产品经理大会首日精彩速览
8月15日,2025全球产品经理大会开幕,众多专家分享见解。奇点智能研究院成立,聚焦AI多范式转换设六大研究领域。李建忠、方汉等嘉宾探讨AI产业生态、产品创新等,还涉及GenAI交互设计、AI产品“人味”等内容。
GPT-5认为这个模型是开源界的Claude 3.5——陈天桥朋友圈里的 MiroMind ODR 让我眼前一亮
陈天桥用GPT - 5评测自家开源模型MiroMind ODR,让其应对复杂问题。GPT - 5评价该模型是“开源界的Claude 3.5”,其能力让GPT - 5“点赞”,有闭源模型稳定性和可用性,还具全开放架构。