技能评估」共找到 1021 篇相关文章

算法论文8

打破学科壁垒!400篇参考文献重磅综述,统一调查「人脑×Agent」记忆系统

哈工大等多机构联合发布重磅综述,打破认知神经科学与人工智能学科壁垒,统一审视人脑与 Agent 记忆系统。文中剖析记忆定义、作用、分类、存储、管理等,还提及评测、安全问题及未来多模态记忆、技能迁移方向。

机器之心
新闻资讯8

医疗AI质变时刻来临!国产医疗AI率先突破,临床诊疗能力问鼎全球

文章指出当前医疗AI真实能力与临床期待有落差,为此中国医生联合制定全球首个评估医疗AI临床适用性标准,完成对主流模型测评,中国企业打造的MedGPT夺冠,还推出‘未来医生’平台服务患者。

量子位
产品应用7

不再迷信Hackathon,把Agent推翻重做了4次!Notion负责人复盘:做AI产品如何避免“逆流而上”?

Notion负责人复盘Agent开发历程,指出AI替代的是流程。他们将模型、产品和权限接入同一框架,历经多次重构,还探讨了组织管理、评估体系、软件工厂等内容,分享对CLI和MCP的看法及产品定价策略。

AI科技大本营
产品应用7

在 Mac 上安装最新版 OpenClaw 并接入企业微信之后,一切都改变了

文章介绍在Mac上安装最新版OpenClaw及接入企业微信的方法。新版本功能增强,安装后可连接多种工具。接入企业微信后,能实现诸多功能,如分析股价、制定健身计划等,还能拓展写作等技能

MacTalk
产品应用8

刚刚,智谱砍掉OpenClaw最大门槛!1分钟装好,一键塞进飞书

OpenClaw爆火但安装门槛高,催生天价代装生意。智谱发布AutoClaw(澳龙),将其打包为一键安装桌面应用,小白1分钟上手。内置Pony - Alpha - 2模型,支持模型热插拔与飞书集成,50 + 技能开箱即用。

新智元
产品应用7

专治AI生图「人脸崩坏」,8倍速碾压GPT!新版FLUX.1多方位刷新SOTA

FLUX.1 Kontext是融合即时文本图像编辑与文本到图像生成的新一代模型,支持文本与图像提示,角色一致性强,速度快达GPT - Image - 1的8倍。它能解决AI生图“人脸崩坏”等问题,评估显示性能优异。

新智元
新闻资讯7

Altman 嘲讽 Meta 挖走的不是顶尖人才,OpenAI 高管首曝内幕:ChatGPT 如何让我们一夜“封神”

AI 领域人才抢夺激烈,Meta 招募 AI 人才触动 OpenAI。OpenAI CEO Altman 嘲讽 Meta 没挖到顶尖人才,还透露正评估薪酬。同时,OpenAI 播客揭秘 ChatGPT 幕后,包括名称由来、传播、内部辩论等,也谈到模型问题及应对。

InfoQ
推荐文章8

Anthropic:我们如何构建多智能体研究系统

Anthropic分享构建多智能体研究系统的经验,该系统用多个Claude智能体探索复杂主题。介绍了多智能体系统优势、架构、提示工程、评估方法,也提及生产环境的挑战,此系统处理开放式研究任务价值大。

宝玉AI
新闻资讯7

世界模型混战,Momenta率先冲刺IPO

当下世界模型是AI领域热门且混乱的概念,主流路线有四类。Momenta的R7世界模型已量产,其CEO定位公司为物理AI基座模型构建者。Momenta率先冲刺IPO,商业模式正转型,为后续玩家提供价值评估体系。

量子位
新闻资讯7

价格狂飙6倍!Claude凌晨上线极速模式,网友集体破防:比OpenAI还黑

Anthropic深夜上线Claude Opus 4.6极速模式,速度提升2.5倍但价格飙6倍,引发开发者不满。不过Opus 4.6实力强劲,多项评估领先。Fast Mode是市场试探,反映AI行业关注从‘能做什么’到‘多快做到’转变。

新智元