FinanceAgentBench v2」共找到 2234 篇相关文章

算法论文8

超越MLA!新架构MLRA百万token,解码最高2.8倍速 | ICLR'26

大语言模型处理长文本时,自回归生成受限于显存带宽。为减少KV缓存开销,业界尝试多种方法,但MLA有缺陷。宾夕法尼亚州立大学等研究人员提出MLRA,拆分KV缓存为四个并行分支,降低显存占用,实现4路张量并行,性能更优。

新智元
新闻资讯7

算力都去哪儿了?这个 Seedance 2.0 生成的梗视频给出了答案

有人用Seedance 2.0将Anakin and Padmé梗做成AI视频讽刺AI行业。视频对话暗示算力用途与宣称不符,最后几秒AI将帕德梅形象处理成擦边画风,揭示算力真实去向。

宝玉AI
开源动态7

Clawdbot再次更名:新名OpenClaw,官宣支持Kimi K2.5和小米MiMo

两个月前Peter Steinberger搭建的项目,最初叫WhatsApp Relay,现获超10万GitHub星标、单周200万访问者。1月29日正式更名为OpenClaw,它是开源AI助手平台,此次发布新渠道、支持新模型等。

AI寒武纪
新闻资讯8

清华给电子显微镜加上Agent,DeepSeek V3全程调度,数天流程缩短至几分钟

清华大学牵头,联合多机构推出电镜领域AI Agent AutoMat,它能把原子级STEM图像转成标准CIF结构并给出关键物性,将人工流程缩短至几分钟。它还构建数据集验证,性能超现有工具,不过也有瓶颈待解决。

量子位
新闻资讯7

2025全球前2%顶尖科学家榜单发布!清华国内第一、Bengio全球前十

当地时间9月19日,斯坦福大学和爱思唯尔发布2025全球前2%顶尖科学家榜单。清华746位学者入选,全球大学排第四超斯坦福。周志华、张正友进全球前1000,图灵奖得主Bengio进年度前十。

新智元
产品应用8

Claude Sonnet 4.5发布,多领域性能超越GPT-5和Gemini 2.5 Pro

Anthropic发布Claude Sonnet 4.5,是目前最强编程模型,在多领域性能超GPT - 5和Gemini 2.5 Pro。操作电脑、数学推理能力提升,产品更新功能丰富,安全性增强,价格不变,获多家公司认可。

AI工程化
开源动态7

Qwen又立功,全球最快开源模型诞生,超2000 tokens/秒!

全球最快开源大模型K2 Think诞生,速度超2000 tokens/秒,由阿联酋机构与公司合作推出,基于Qwen 2.5 - 32B打造。实测速度快且答案准确,主要为数学推理开发,团队已发布技术报告。

量子位
产品应用8

基于浏览器请求录制与AI代码生成的E2E接口自动化测试实践

文章以阿里云DataWorks为例,介绍通过浏览器录制插件捕获请求数据,结合AI编程工具生成接口封装与测试用例,解决复杂平台自动化测试难题,对比传统与新范式,剖析新范式优势、协作机制等。

阿里云开发者
产品应用8

刷榜风波惊动OpenAI后,这家中国团队拿回Agent硬核榜单第一

在OpenAI主导的MLE - Bench基准测试上,百度伐谋2.0击败对手登顶。此前有团队刷榜引发风波,官方新增清洁赛道。伐谋2.0在多方面优化,还在汽车、金融、科研等产业落地解决难题。

机器之心
产品应用8

骗过所有人!这首燃炸了的「女团神曲」,竟是AI直出

2026开年,AI冲击艺术领域。昆仑天工的Mureka V8改写AI音乐规则,超越Suno V5,跨越“像音乐”到“是音乐”的鸿沟。它引入MusiCoT技术,还配套Studio、API等,定义“好的AI音乐”新品类。

新智元