「功能测试」共找到 3122 篇相关文章
刚刚,OpenAI发布「科研写作神器」Prism,Overleaf危
今天凌晨,OpenAI推出专为科学家打造的AI原生协作平台Prism,由GPT - 5.2驱动,解决科研工具碎片化问题。即日起向ChatGPT个人账户用户免费开放,功能或覆盖Overleaf,也引发数据安全等讨论。
谷歌翻译重大更新:实时翻译,全球无障碍交流摩擦苹果
Google搜索产品副总裁宣布Google翻译引入Gemini模型,翻译能力飞跃。更新含顶尖文本翻译、实时语音对话翻译(Beta版)及扩展语言练习功能,适用多平台多语言,谷歌期待用户反馈以优化体验。
英伟达发布 Jet-Nemotron 系列小模型,理论最大加速比 56 倍
英伟达发布 Jet - Nemotron 系列小模型,在多项基准测试中表现出色,实现高吞吐量加速和高准确率。其训练采用 PostNAS 方案,对既有模型针对性优化,展示了在小模型优化上的可行技术路径。
斯坦福开源复杂推理AI Agent,融合超10种工具
传统AI助手应对复杂任务能力有限,斯坦福开源OctoTools,这一复杂推理AI Agent融合11种工具。它在16项基准测试中准确率高,能应对多领域复杂场景,框架含工具卡片、规划器等构件。
综述解读:Memory in the Age of AI Agents
文章围绕《Memory in the Age of AI Agents》展开,指出传统方案难解决Agent长期智能问题,Agent Memory是关键。介绍其形式、功能、动态机制,分析挑战并预测未来方向,为设计记忆系统提供指南。
AI人格分裂实锤!30万道送命题,撕开OpenAI、谷歌「遮羞布」
Anthropic联合Thinking Machines研究,用30万个场景和压力测试拷问OpenAI、谷歌等前沿大模型。发现模型规范有矛盾漏洞,不同模型价值优先模式不同,如Claude重道德,Gemini重情感等。
动动嘴,AI自己打开小红书、高德地图帮你干活了,国产Agent深度体验
作者为测试AutoGLM能否提高AHPU,用两个实测案例展示其功能,还拆解产品技术,介绍其进化历程。AutoGLM虽有不足,但已接近作者期待的产品形态,未来有望持续进化。
AI赋能创新玩法点燃星际热浪,2025星际争霸2锦标赛冠军出炉!
近日,2025星际争霸2锦标赛总决赛结束。赛事有全新种族加入、视角移动功能增加等创新,玩法和观赛体验升级。经多轮比拼,XingMing击败caonima夺冠,赛事重塑玩家与游戏关系。
狂揽6.9K star!!微软又来一款王炸项目,实时跟踪、透明可控,牛皮!
微软开源项目Magentic-UI狂揽6.9K star。它是“以人为本”网页智能助手,基于AutoGen框架,可让用户全程掌控,能实时跟踪、透明可控,有协同规划等功能,适合测试、分析等人员。
你和ChatGPT的私密对话正在全网裸奔!网友炸锅:我把ChatGPT当知己,它却把我隐私挂网上
近日,谷歌搜索惊现4500条ChatGPT对话,其中含大量用户深层个人信息。OpenAI称是用户主动分享致索引,将移除该功能并清理。但聊天记录仍在其他搜索引擎现身,引发网友质疑。