「论文自动审阅器」共找到 1556 篇相关文章
破解人机协作密码:工作技能拆成两层,AI执行人类决策成功率狂飙 | ICML 2025
耶鲁和南大研究人员合作的论文提出数学框架,把工作技能拆分为决策层和执行层子技能,揭示人类与AI在这两层面各有所长,优势互补可提升成功率,还为机构适应新工作体系提供指南。
用户痛批GPT-5,哭诉「还我GPT-4o」,奥特曼妥协了
OpenAI发布GPT - 5,移除ChatGPT模型选择器,将其设为默认模型并自动分配子版本。这引发用户不满,有人做梗图、吐槽、发起签名信。奥特曼发话,允许ChatGPT Plus用户继续用GPT - 4o。
借助CoT监管AI?OpenAI、谷歌、Anthropic等罕见联合发文:AI系统安全的新机遇!
OpenAI等支持新研究论文,其指出高级AI不透明性有潜在风险,而‘推理模型’用自然语言推理带来可解释窗口,CoT监控可检测不当行为、发现早期信号等,但也存在使监控性下降的因素。
刚刚,OpenAI发布CoT监控,增强AI Agent自主能力
今天凌晨,OpenAI发布思维链(CoT)监控技术论文,用于监督AI Agent,增强其自主性。思维链监控可调试故障、合规审计,是构建安全透明AI的蓝图,文中还提及CoT监控必要性及有效方法。
综述:LLM 驱动AI Agent通信协议与策略
文章指出传统互联网用户完成行程繁琐,而代理互联网可让代理自动完成。随着LLM驱动智能体应用深入,其发展专业化,需多智能体协同,有效通信成关键。介绍了智能体通信定义、分类及多种通信协议。
数学推理热潮下的冷思考!如何训练真正"全能"的推理模型?
论文评估20余个开源推理模型在多领域表现,发现多数模型数学成功难迁移。揭示微调方法(RL vs SFT)决定能力泛化,SFT像‘填鸭’,RL似‘思维健身’,为构建通用推理智能体提供新路径。
一种基于滑动层合并的高效深度修剪大模型的方法
文章指出深度修剪可加快推理速度,但直接丢层会降低性能。为此提出滑动层合并法,根据相似度阈值融合连续层,简化结构且保持性能。实验显示该方法优于现有技术,还揭示了与宽度修剪结合的潜力。
9B“小”模型干了票“大”的:性能超8倍参数模型,拿下23项SOTA | 智谱开源
智谱发布并开源仅9B大小的模型GLM-4.1V-9B-Thinking,在28项评测中拿下23个SOTA,成10B级别最佳VLM模型。它引入思维链推理机制,通过课程采样强化学习提升能力,还获10亿投资。
AICon上海演讲精华回顾:《GMI Cloud 全球化高性能分布式推理服务构建实践》
AICon2025上海站,GMI Cloud资深架构师Frank Lee分享《GMI Cloud全球化高性能分布式推理服务构建实践》,介绍其推理平台,拆解扩缩容等能力,分享架构设计、部署及优化实践,揭秘推理提效关键路径。
0%通过率!Code神话泡沫!LiveCodeBench Pro发布!
国际算法奥赛金牌得主团队测试20个顶级大模型,在584道编程赛题上,高难度题目AI通过率为0%。论文发布LiveCodeBench Pro评测方法,揭示AI编程能力神话泡沫,指出其问题并给出提升方向。