Paper2Agent」共找到 4252 篇相关文章

新闻资讯8

微信技术架构部斩获CVPR 2025大赛冠军,攻克AI图文匹配评估难题

微信WXG技术架构部IH-VQA团队在CVPR2025大赛夺冠,首创iMatch图文匹配质量评估方案。文中介绍赛事背景、规则,团队通过双模型驱动等策略获胜,还构建iMatch-Benchmark评估主流T2I模型。

腾讯技术工程
新闻资讯7

Claude 4被诱导窃取个人隐私!GitHub官方MCP服务器安全漏洞曝光

瑞士网络安全公司发现,GitHub官方MCP服务器面临新型攻击,可诱导AI Agent将私有仓库敏感数据泄露至公共仓库。GitLab Duo近期也有类似漏洞。公司还提出初步缓解举措。

量子位
算法论文8

人类打辩论不如GPT-4?!Nature子刊:900人实战演练,AI胜率64.4%,还更会说服人

瑞士洛桑联邦理工学院等机构研究人员让900名美国参与者与人类或GPT - 4就社会议题辩论。发现GPT - 4知晓对手信息时胜率64.4%,说服效果提升81.2%,低/中争议话题更易受其影响。

量子位
产品应用8

AI发现新物质,仅用200小时!不写一行代码,筛选36.7万种物质

微软在Build大会推出企业级AI科研平台Microsoft Discovery,结合专业AI Agent与高性能计算。它能让无编程背景人员用自然语言使用超算与模拟系统,200小时筛选36.7万种物质找新冷却剂。

量子位
8

浙大开源HugAgentOS:三引擎一体自进化,每步可归因/回放/回滚

过去一年,Agent任务执行能力提升,但不会自主积累与进化。浙大开源的HugAgentOS把Harness拆成三个可自我成长的引擎,设归因和本体两道关卡,解决经验成能力等问题,还覆盖智能体完整链路。

新智元
开源动态8

刚刚,Anthropic开源Claude挑战黎曼猜想的4篇论文

Anthropic开源未公开版本Claude挑战黎曼猜想的4篇论文。Claude虽未证出猜想,但将零点在临界线上的比例下界从41.6%推到67.2%。整个过程由多智能体自主完成,还建立严格验证体系。

PaperAgent
开源动态8

大部分token根本不该重复计算,不止于KVCache

斯坦福研究显示,AI Agent每次调用62%内容重复,现有前缀缓存虽有优化但天花板低,阿里云数据表明多数缓存块利用率低。LMCache将缓存管理独立,解决性能问题,其CacheBlend技术复用缓存,适配多引擎和存储后端。

AI工程化
产品应用8

Claude Code太难?Coze帮你3分钟做出可变现的 Skills

Claude Code和AI Skills很火,但靠其变现困难,如安装调试复杂、不知如何推广等。Coze 2.0更新解决了这些问题,还提供长期计划能力和新年福利,可让用户无需工程能力参与AI生态价值分配。

歸藏的AI工具箱
产品应用7

Claude Opus 4.5 发布,我又把 Claude Max 续回来了

Claude Opus 4.5发布,价格相比Opus 4.1暴跌至1/3,收获全面好评。作者又续了Claude Max,还分享了几个Coding Agent使用感受,最后发布招人信息。

AGI Hunt
新闻资讯7

80%到25%逆转!大模型代码能力最新排名:Anthropic不再是唯一的神?

OpenRouter网站有模型使用排行榜,按不同使用场景分类。2024年12月到2025年2月,Anthropic模型编程流量占比曾达80%,后谷歌Gemini 2.5 Pro等抢占份额,其跌至25%以下,Claude 4发布后份额回升。还介绍了OpenRouter特点。

AI寒武纪