「智能测试平台」共找到 5742 篇相关文章
斯坦福吴佳俊「计算机与思想奖」获奖演讲全文:从一张照片,逆推一个世界|IJCAI 2026
8月20日,斯坦福大学吴佳俊在IJCAI 2026发表“计算机与思想奖”获奖演讲。他指出像素是表象,物理结构才是因果,提出以物理代码为桥,融合基础模型泛化力与物理模拟因果性,构建视觉与物理智能。
Qwen3.8-Max 正式版终于发布了,能不能打过 GPT 看这里
Qwen 3.8 Max 正式发布,沿用 Qwen 3.5 架构,参数量扩展,重点提升 Coding、Work 和 Agent 能力。它将开放权重,价格有优势。在多项测试中表现出色,还新增多模态能力,已可使用并有优惠。
让VLA真正跑上机器人:北大团队开源Jetson-PI,Jetson Orin控制频率提升8.66倍
文章聚焦让VLA模型在机器人上高效运行难题。北大等团队提出Jetson - PI方案,从异步推理算法等三层面优化,在Jetson Orin上控制频率提升8.66倍,推动具身智能向工业应用跃迁。
谷歌搜不到的80%互联网,AnySearch全打通了!开发者连夜接入
2026年5月11日海外上线的AnySearch,定位AI时代「搜索基础设施」,专为AI Agent打造统一高质量搜索入口。上线一周在海外开发者圈爆火,经测试性能优于同类产品。通过不同场景实战,展现聚合广度、专业深度等四层能力。
清华系团队出手!一张 4090 即可「爆改」,1.3B小钢炮震撼开源
5月11日,清华系团队面壁智能联合多方开源端侧多模态大模型MiniCPM-V 4.6。它参数仅1.3B,性能超阿里、谷歌等同级对手,效率翻倍,还实现两项架构创新,适配主流开源生态,降低开发门槛。
最强开源搜索再升级,研究、预测能力实测超惊艳!
MiroMind团队发布新一代模型MiroThinker-1.7和MiroThinker-H1,定位为重型推理智能体。其研究能力强、推理可靠,还能生成网页报告。新版本升级显著,靠两项关键技术实现有效交互,且预测案例表现出色。
机器人终于「懂」家务了!伯克利MomaGraph让机器人像人一样做家务
过去家用机器人做家务存在诸多难题,最近加州伯克利和马里兰大学联手推出 MomaGraph 技术。该技术采用「Graph - then - Plan」思路,团队搭建了完整体系,在星动 Q5 上测试效果好,让家用服务机器人迈向实用。
深度拆解:如何在 LangChain DeepAgents 中复现 Claude 的 Skills 机制 ?
本文探讨在LangChain的DeepAgents框架复现Claude的Skills机制。先回顾Skills,它是Anthropic提出的Agent能力注入方式,有渐进式加载特点。接着介绍让通用框架支持Skills的环节,最后测试验证其效果和收益。
一句「你还好吗」值40亿?斯坦福博士出走xAI,押注AGI共情力
AI已足够聪明,却不够温柔。斯坦福博士Eric Zelikman离开xAI,创立Humans&,以40亿美元估值筹集10亿美元,要打造具「情感智能」的模型,让AI学会理解人,资本也开始为「共情」下注。
AI时代的天工开物:分子之心掀起生物经济“操作系统”革命 | 甲子光年
生物经济正迈向工程化时代,分子之心作为AI蛋白质设计领军企业,携核心产品MoleculeOS入驻礼来上海创新孵化器。该平台升级后能力强大,还在构建生物经济‘新基建’,解决产业难题。