超体」共找到 3418 篇相关文章

算法论文8

NTU等联合提出A-MemGuard:为AI记忆上锁,投毒攻击成功率暴降95%

在AI智能依赖记忆系统的当下,记忆投毒攻击兴起。A-MemGuard作为首个为LLM Agent记忆模块设计的防御框架,通过共识验证和双重记忆结构,解决防御难题,使投毒攻击成功率暴降95%。

新智元
新闻资讯8

GPT-5.4「原生操控电脑」实测封神!OpenClaw天选模型来了

OpenAI发布GPT-5.4,首次实现原生电脑操控能力,几乎可操作电脑所有应用。它被认为是最适合跑OpenClaw的模型,在多方面表现出色,其发布标志AI从对话式到智能的跨越。

新智元
产品应用8

3B激活参数,干翻GPT-5.4和Opus4.6,商汤绝影把龙虾塞进了车里

商汤绝影发布端侧多模态大模型Sage,32B总参数、3B激活参数,在PinchBench评测Claude Opus4.6等。自研SCOUT和ERL技术助力,从多维度领先同量级端侧模型,为座舱智能提供支撑。

量子位
新闻资讯8

Clawdbot开发者:未来一大批应用都会消失,提示词就是新的interface

Clawdbot开发者Peter Steinberger在采访中分享诸多观点,认为今年是「个人助理」之年,每个人应构建智能探索记忆机制;指出GUI糟糕,多数MCP应做成CLI;还称未来大批应用会消失,提示词是新界面。

Founder Park
开源动态8

首发 | 陈天桥盛大团队,推出最强开源记忆系统EverMemOS

EverMind团队发布面向人工智能智能的长期记忆操作系统EverMemOS。它在主流评测集表现此前工作成新SOTA,受人类大脑记忆机制启发设计,有四层架构和三大特点,已开源,后续将推云服务。

机器之心
新闻资讯7

4B Qwen3逆袭671B DeepSeek!字节DAPO微调方法这么猛的吗

最新模型Jan - nano引发关注,它在智能任务上671B的DeepSeek - V3 0528,在SimpleQA基准获80.7分。它基于Qwen3 - 4B用字节&清华DAPO微调方法。其研发团队是Menlo Research,有开源产品和长远规划。

量子位
新闻资讯7

推理能力大比拼,《推理模型综合测评报告 2025 》正式发布

过去半年,推理能力成大模型新分水岭。InfoQ研究中心评测八款热门模型,围绕五大维度,用90%原创试题。发现各模型在不同维度表现有差异,推理模型发展正从‘一个大脑’变为‘带工具的多能智能’。

InfoQ
8

AI首胜人类博士,顶会论文秒变代码!港大90后开源刷爆8k星

香港大学黄团队开源的DeepCode,能分析论文、生成可运行代码。在四大基准测试中全面领先,首人类专家,还优于现有AI Coding。它有三大核心能力,采用三阶段框架实现代码自动转换。

新智元
新闻资讯7

百亿机器人独角兽冲刺IPO,细分赛道收入第一

镁伽科技是中国收入最高的机器人自主智能供应商,近期向港交所递交招股书。其面向生命科学和智能制造领域,产品有“机器人科学家”之称。背后有博世、药明康德等巨头及明星资本加持,估值105亿。

量子位
新闻资讯7

二十年老牌 IDE 栽在 AI 上!JetBrains 被差评逼疯批量删除评论,用户怒打更多1星抗议

JetBrains 2023 年 12 月发布的 AI 助手插件下载 2200 万次,但评分仅 2.3 分。该公司批量删负面评论引用户不满,其还存在安装难移除、验差等问题。虽推出免费套餐和 Junie 智能,仍面临成本和竞争压力。

InfoQ