「向量能力」共找到 3260 篇相关文章
Karpathy:很多App就不该出生、人类唯一护城河只剩理解、CPU将沦为配角
在Sequoia Ascent峰会上,AI先驱Andrej Karpathy分享对2026年技术浪潮思考。他认为LLM是新物种,让部分旧软件多余,未来软件接口或为说明文本,还谈及模型能力不均匀性、创业机会、智能体经济及人类价值。
你的AI“体检”了吗?开源AI红队测试平台,一键自查三大风险
AI圈一边是顶尖模型发布,一边是大模型被“越狱”输出有害内容。腾讯朱雀实验室开源A.I.G平台,能模拟真实攻击对AI产品全方位风险扫描,有大模型体检、基础设施漏洞扫描、MCP Server风险检测三大核心能力。
数学编码超越O3-high,英伟达版「DeepSeek R1二代」推理模型开源~
Nvidia开源OpenReasoning-Nemotron系列模型合集,采用Qwen2.5架构,基于500万条轨迹训练。评测输出长度最高64K token,多版本刷新SOTA。其‘heavy’模式有独特能力,32B版在数学与编程基准超越O3(High)。
FDE 火了:两个追求 AGI 的公司,为什么都开始「雇人上门」了?
OpenAI 收购 Tomoro 获 150 名现场部署工程师,Anthropic 联合机构成立新公司派工程师驻场。两家顶尖 AI 公司均用几十亿美元买人,引入 FDE 概念,表明强大模型需结合现场服务释放 AI 能力。
这张信息图,居然是8B开源模型做的??
商汤新开源的 8B 多模态模型 SenseNova U1,架构独特,图像评测表现好,信息图生成能力强、延迟低。它具备图文交错能力,适合自媒体、敏感行业等,有在线体验和开源代码入口。
硅谷豪赌2万亿!DeepSeek登顶Nature,Meta却成2025最大输家?
2025年全球AI领域风起云涌,AGI祛魅,ASI登台。AI模型能力跃升,投资热潮推动基建扩张,劳动力变革加速,应用扩展到生活。科技领袖对AGI和ASI到来时间存分歧,中国开源AI崛起,DeepSeek成黑马。
沉默的进化:LatentMAS 如何通过“潜意识通信”重塑多智能体协作?
这是对多智能体协作领域突破性研究的深度解读。论文提出LatentMAS框架,让智能体直接交换“思维向量”,实现“机器心灵感应”,在性能、速度和Token消耗上全方位碾压传统文本交互模式。
均值至上假繁荣!北大新作专挑难题,逼出AI模型真本事
当强化学习成大模型后训练核心工具,主流方法陷入「均值优化陷阱」,推理能力停滞。北大团队提出RiskPO,将风险规避理念融入优化目标,用MVaR+捆绑策略双管齐下,三大任务表现优异。
哈佛发现基础模型比你想象中更强大:纯采样方法可超越RL
论文提出基础模型本身已具备强大推理能力,通过“幂采样”纯采样算法,在多推理任务上媲美或超越RL后训练,挑战“RL才能提升推理”观念,为理解基础模型潜力开新视角。
麻省理工 NANDA 研究发现,只有 5% 的组织把 AI 工具大规模用于生产
麻省理工 NANDA 报告指出,95%企业组织的 AI 投入无回报,仅 5%将 AI 工具规模化用于生产。原因是 AI 系统存数据、适应变化及持续学习能力不足,领导层对 AI 项目信心下降。