「多领域推理」共找到 6435 篇相关文章
华尔街彻夜难眠!Gemini 3屠榜金融「最难考试」,AI砸了「金饭碗」?
被誉为「黄金职业通行证」的CFA考试被AI攻陷,推理模型不仅全部通过三级考试,部分科目接近满分。如Gemini 3.0 Pro在一级考试创97.6%最高纪录。不过AI仍有局限,还不能完全替代分析师。
OpenAI拉响红色警报!暂停广告和Agent,下周发布新模型硬刚Gemini 3
面对Google等对手的竞争,OpenAI宣布进入‘红色警报’状态,下周将发布新推理模型硬刚Gemini 3 pro。Altman暂停部分项目,调配资源升级ChatGPT,重点修补‘模型行为’,提升产品体验,还注重图像生成。背后是融资需求压力。
刚刚,Dexbotic开源!VLA性能+46%,机器人叠盘子100%成功,统一具身智能底座
Dexmal原力灵机开源的Dexbotic是具身智能VLA模型一站式科研服务平台,可提供基础设施。其预训练模型在多仿真器中提升传统VLA策略,还推出开源硬件DOS - W1,覆盖训练需求,架构有创新。
打通企业智能化最后一公里,腾讯云做了一件关键事
腾讯云在全球数字生态大会发布智能体开发平台3.0,它是整合多能力的完整平台,能帮企业快速打造数字员工。新版本解决诸多痛点,还展示多个成功案例,腾讯云也在加码开源。
基于LLM的Agentic Reasoning框架综述:从方面到场景的全面总结
近年来,大型语言模型虽能力强但有局限,研究者构建基于LLM的智能体系统。此综述论文提出系统、统一分类法梳理智能体推理框架,建立统一描述语言和通用算法,分析其在不同场景表现与评估方法。
全球首次,「AI记忆」开源落地!MIRIX同步上线APP
加利福尼亚大学圣迭戈分校博士生王禹和纽约大学教授陈溪联合推出并开源全球首个多模态、多智能体AI记忆系统MIRIX,还上线桌面端APP。MIRIX性能远超传统方法,首次将记忆分六模块,用多智能体系统控制。
字节扣子空间上新一键转播客功能,现在我们真成同事了|甲子光年
5月27日,字节跳动旗下AI协同办公平台扣子空间新增播客功能。其播客音频生成功能让AI从‘说什么’跨越到‘怎么说’,适用于多场景。扣子空间还具备跨模态协作等能力,引入MCP协议,免费开放核心功能。
智谱公布“降智”的秘密:Scaling不可避免的痛
智谱最新技术博客大倒苦水,称从GLM - 5以来遭遇「Scaling Pain」。团队排查出高负载下推理状态管理等问题致异常,还给出避坑指南,如在线异常监控策略,优化后系统更稳定,吞吐量提升。
英伟达叫板DeepSeek?怒投260亿美元,要打造最强开源模型
英伟达已成为人工智能时代基础设施的一部分,2023年11月推出首个Nemotron模型进入通用大模型领域。未来五年将投260亿美元构建开源模型,还发布了性能最强的开源模型Nemotron 3 Super。
给 OpenClaw 装上“全网眼睛”:我把这个 3K+ Star 项目果断集成到了个人skills里。
作者用OpenClaw /Claude Code读推特遇难题,各平台上网关卡多。后发现开源2天获1.1K Star的Agent - Reach项目,将上网工具统一打包,技术选型实用,强调AI时代想法和判断力比技术重要。