「通用漏洞披露系统」共找到 995 篇相关文章
Agent记忆赛道大洗牌!LoCoMo-Refined重磅发布,主流记忆框架迎来核心检验
南京大学与上海人工智能实验室联合推出 LoCoMo-Refined,这是严苛的 Agent 记忆评测基准。它指出当前记忆评测基准有两大漏洞,在其标准下主流记忆框架得分普降,且相关数据集和评测脚本已开源。
首个实时端侧部署世界模型,20万小时人类视频,BeingBeyond实现「两级跃迁」
4月14日,BeingBeyond发布具身世界模型Being - H0.7,将人类视频规模扩至20万小时,采用隐式推理范式,6项权威评测综合第一。还率先实现端侧实时部署,打通数据闭环,推动模型通用与专家能力跃迁。
清华发布世界模型评测新标尺:直击机器人感知与行动鸿沟
清华大学等机构推出 WorldArena 评测基准,用于测试 EWM 真实能力。它融合感知与功能评估,含十六项视频指标,结合主客观评价生成 EWMScore。测试揭示模型在感知与行动上的差距,转型为实用型模型是行业挑战。
交大系杀出具身赛道重围!1万台订单在手,以世界模型重塑万亿城市基建
物理AI成新征途,通用机器人面临工程难题。酷哇科技发布COOWA WAM 2.0世界模型,实现范式升级。其有四大技术支柱,助力机器人发展。酷哇预计2026年交付超万台机器人,还构想了“Robo City”图景。
Agent框架各自为战?谷歌&微软:用Agent-KB让经验自由流动
当前不同框架的Agent知识无法互通,谷歌、耶鲁、字节、oppo等团队联合提出Agent KB,这是通用记忆基础设施,能让异构Agent框架共享经验。它有师生双阶段检索机制,实验验证其能带来显著增益。
阶跃星辰豪揽超50亿融资,“天才创始人”印奇重掌帅印
通用人工智能公司阶跃星辰完成超50亿元B+轮融资,刷新中国大模型领域单笔融资纪录。同时,印奇出任董事长。该公司坚持“基础大模型”与“AI+终端”战略,商业化探索也在多方向推进。
DeepSeek V4即将发布?先读懂梁文峰这份86页的技术底牌
据报道,DeepSeek计划2月中旬发布V4,此前将R1论文从22页扩充到86页。新增内容涵盖训练细节、成本、数据配方等,还公开失败案例、基础设施和安全报告,或为V4铺路并回应质疑。
又一 AI 视频创作产品火了,用户抢着付费,附实测
Flova 这款 AI 视频创作产品火了,用户抢着付费。它是人和 AI 协作共创的通用视频创作 Agent,无需专业知识,通过对话和故事板完成创作,还支持修改部分内容、一键回溯等,有多种高级玩法。
Notion 3.0 |AI转型最成功的互联网产品是怎么做的?
Notion更新3.0,可视为有所有上下文的通用Agent产品,能调用顶尖模型。它有基础AI能力,如选模型、加上下文等,还升级了Agent创建、MCP等功能,依托生态让提示词可变现。
字节跳动Seed推出「机器人大脑」Robix:让机器人学会思考、规划与灵活互动
近日,字节跳动Seed团队发布「机器人大脑」Robix,它将推理、任务规划与人机交互整合到单个端到端多模态模型。通过层次化架构分工,它能灵活互动,经三阶段训练,在多方面表现出色,为具身智能体发展奠基。