「飞书大会」共找到 6064 篇相关文章
ICML 2026 | Agentic强化学习训练的信息自锁问题
随着大语言模型走向真实交互,强化学习训练LLM agents时出现信息自锁问题。香港中文大学等研究者分析其原因并提出AREW方法,在多场景实验中表现稳定且具鲁棒性。
胜率直逼人类大师!这套Agent揭开中国AI「玄学真相」
在无信息泄漏的术数题库中,Claude、GPT等主流模型准确率低,而Tianfu Agent系统将准确率提至50%,逼近人类Top20选手。它采用多Sub - Agent协作等策略,还在工具管理、规则使用等方面有创新。
起底腾讯 AI Lab 的十年沉浮
本文讲述腾讯AI Lab十年沉浮,从2016年成立,早期学术探索为主,后转向工程落地。期间经历领导更迭、与优图实验室竞争等,2022年后,腾讯混元大模型发布晚,团队整合深度不足。
上海AI Lab新研究:SFT能泛化,只要满足这三个条件
上海人工智能实验室等团队研究指出,“SFT泛化能力差”定论有局限。SFT泛化能力受优化过程、数据质量与结构、模型基础能力共同制约,研究还揭示其训练中的现象及副作用。
700多个「坏模型」喂出AI测谎仪?Anthropic审计神器让AI自曝黑料
Anthropic故意训练近700个「有问题」模型,训了LoRA适配器(IA)让模型自报家门。IA在AuditBench平均成功率59%,但也存在幻觉、成本高、训练分布无指南等局限。
传感器如何赋能精细化工行业?丨郭源生细说传感器
文章聚焦精细化工行业的智能传感器,阐述其应用前景、产业现状等。指出传统传感器短板,介绍前沿技术与传感器融合方案,预测市场规模与用量,分析智能化瓶颈并给出突破路径与建议,推动行业高端化升级。
终端已死,Agent终端万岁:Warp一天暴涨1.2万星背后的开发者工具革命
4月29日,Warp在GitHub单日涨近12000星,总星数破4万。其定位从普通终端转变为Agent式开发环境,这表明开发者对AI原生终端需求真实且被低估,Agent化已成产品核心竞争力。
给AI发100美元去二手市场捡漏,结果它给自己买了19个乒乓球
2025 - 2026年,Anthropic进行“Project Deal”实验,让69个Claude智能体在真实双边市场自主交易,完成186笔超4000美元交易。实验发现模型能力影响交易结果,还揭示了AI代理交易存在的问题和隐忧。
GPT之父把AI扔回1930年:没见过一行代码,却「发明」了Python!
GPT之父Alec Radford带队发布总参数130亿的大模型「talkie」,其训练数据冻结在1930年,没学过编程却能写Python代码,证明LLM可用旧知识推理。团队后续还有升级计划。
刚刚,Claude Code 推出手机通知功能。被催着干活的打工人,从此不能再摸鱼……
Claude Code 新增手机推送通知功能,任务完成会主动 ping 手机,开启方式简单。它还支持桌面通知,与此前功能形成派活、执行、汇报闭环,解决了人如何知晓 AI 完成任务的问题。