上科大」共找到 6393 篇相关文章

开源动态7

MIT和加州联手打造多智能体语言模型的金融交易框架TradingAgents

MIT和加州联手打造多智能体语言模型的金融交易框架TradingAgents,将交易任务分解为专业角色,含分析师、研究员等。介绍了安装、CLI使用、包的实现细节等,还提及项目地址。

GitHubStore
推荐文章7

彻底说清 Human-in-the-Loop:企业级 Agent 系统的关键挑战与LangGraph解法【

文章围绕企业级Agent系统中Human-in-the-Loop(HITL)展开,介绍其必要性、常见模式,以LangGraph为框架解读关键挑战与实践,涵盖核心机制、原理解析,还阐述HITL下工具调用的两种管控模式。

AI大模型应用实践
推荐文章7

DeepSeek-R1发布100天后:全面复盘推理模型复现研究及未来!

推理语言模型(RLMs)发展显著,DeepSeek - R1发布引发广泛影响且未完全开源。MiroMind等总结其复现研究,关注SFT和RLVR方向,介绍数据构建、方法设计、训练过程细节及实验关键发现。

PaperAgent
算法论文8

ICML 2026 |让模型边想边说:这篇文章把「何时开口」变成可学习策略

论文《When to Think, When to Speak: Learning Disclosure Policies for LLM Reasoning》针对推理模型的‘沉默税’问题,提出Side - by - Side(SxS)Interleaved Reasoning,将‘何时披露内容’变为可学习决策,经实验验证效果良好。

机器之心
算法论文8

迈向无缝共生:模型GUI Agent的「屏幕图灵测试」与拟人化之路

多模态模型使GUI Agent能模拟用户执行任务,但也引发与平台的利益冲突。论文提出“屏幕图灵测试”和AHB基准评估拟人化能力,探讨拟人化策略及权衡,为Agent在数字世界共生提供指南。

AI科技评论
新闻资讯7

o3-pro通关“推箱子”,人类怀旧小游戏成了模型新Benchmark

推箱子、俄罗斯方块等经典小游戏成模型benchmark,o3 - pro挑战这两款游戏表现出色,突破benchmark限,成绩远超o3。Lmgame含多款游戏,有不同评价方式,且开源可用于模型测试。

量子位
新闻资讯7

梁圣一涨价,马斯克的订阅突然成了地球最划算的。

DeepSeek官发涨价第三天,峰谷定价且整体涨幅,实际体感比价格表夸张,Opencode go也涨价降额度。而马斯克的Supergrok heavy成全球性价比之王,买它送Cursor ultra,还附赠多项权益。

探索AGI
算法论文8

AMS | 西工董戴玮、张伟伟等:求解偏微分方程的残差级联极限学习机

本文设计残差级联极限学习机(RC - ELM)缓解极限学习机(ELM)求解偏微分方程的病态问题。将多个ELM块级联,配备相同隐藏层,传递残差求解。实验显示,相比经典ELM,RC - ELM精度优势显著,误差降约4个数量级。

力学与人工智能
开源动态8

Agent记忆赛道洗牌!LoCoMo-Refined重磅发布,主流记忆框架迎来核心检验

南京学与海人工智能实验室联合推出 LoCoMo-Refined,这是严苛的 Agent 记忆评测基准。它指出当前记忆评测基准有两漏洞,在其标准下主流记忆框架得分普降,且相关数据集和评测脚本已开源。

AI科技评论
算法论文8

VLM剪枝新SOTA:无需重训练,注意力去偏置超越6主流方案

常用的attention机制存在位置偏置和padding异常,影响剪枝效果。学曾丹团队提出无需重新训练的attention去偏方法,在多模型、剪枝策略及基准验证有效,为多模态模型部署提供新思路。

新智元