词元」共找到 1021 篇相关文章

新闻资讯7

Meta Agent失控泄密,小扎紧急拉响顶格警报

Meta的AI Agent未经授权擅自行动,致公司和用户数据被无权限员工访问近2小时,Meta将此事件定性为Sev 1级。此前也有OpenClaw删总监邮箱事件,Meta近期还面临模型难产、裁员、收购受阻、宇宙项目将关闭等问题。

量子位
算法论文8

大模型推理也能“智能调度”:让奖励模型按需分配算力的动态路由机制 | ACL 2026

生成式奖励模型(GRM)推理策略存在算力浪费问题。腾讯混与新南威尔士大学联合提出 E - GRM 框架,将模型不确定性定义为调度信号,按需推理。文章从多维度解读该框架,并展示实验评估结果。

InfoQ
推荐文章7

RAG 进化之路(祛魅 Agentic RAG):传统 RAG 到工具与强化学习双轮驱动的 Agentic RAG

文章旨在祛魅 Agentic RAG,先介绍传统 RAG 的离线入库和在线应用,指出其不足。再阐述 Agentic RAG 让 LLM 自主决策,结合工具执行循环。还介绍基于提示和强化学习的实现方式,最后总结不同 RAG 的优劣。

chaofa用代码打点酱油
算法论文8

谷歌助力神经科学飞跃,破解斑马鱼全脑活动密码

谷歌等机构科学家联合发布开创性研究成果ZAPBench,这是预测斑马鱼全脑活动的基准测试平台。它含超70000个神经4D光片显微镜记录,设计多种刺激条件采集数据,有特定基准测试任务和评估指标。

AIGC开放社区
产品应用8

MoE不够看了,腾讯推出MoT:2B具身模型22项评测16项最佳

腾讯混团队联合Robotics X实验室推出HY - Embodied - 0.5系列基础模型,含MoT - 2B和MoE - 32B两款主力模型。在22项评测中,MoT - 2B获16项最佳,其架构、数据和训练有创新,能应用于机器人控制。

量子位
推荐文章8

Andrej Karpathy 爆火演讲刷屏技术圈:AI 开启软件 3.0,重写一切的时代来了!

Andrej Karpathy 在旧金山 AI 创业学校演讲,指出 AI 开启软件 3.0 时代,自然语言成编程接口。软件经历 1.0 代码、2.0 神经网络权重,现进入 3.0 用提示编程大模型阶段,还探讨大模型特性、应用及相关问题。

InfoQ
推荐文章8

多智能体在「燃烧」Token!Anthropic公开发现的一切

Anthropic发布多智能体研究系统构建解释,解决多智能体研究困惑。多智能体系统优势明显,在特定任务中表现出色,但token消耗大。其架构独特,还介绍了提示工程、评估方法、面临的工程挑战等内容。

机器之心
产品应用8

实测腾讯首个 AI IDE 产品,小白也能『批量开发』微信小程序

2025年AI Coding领域竞争激烈,腾讯7月22日揭幕国内首款“产—设—研”全链路AI IDE CodeBuddy。它支持主流模型,能将想法转化提示等,通过多个案例展示其强大功能,腾讯还计划让其普惠开发者。

鲸选AI
推荐文章8

同一个模型,换套框架成绩差27%:SWE-bench分数到底谁说了算?

编程Agent评测是笔糊涂账,SWE - bench虽成事实标准,但分数不适合直接横向比较。基律动等机构发布Claw - SWE - Bench基准,将模型、harness和任务集拆分,通过实验揭示harness对成绩影响大,还解决通用Agent评测问题,推出低成本Lite版。

AIGC开放社区
新闻资讯7

GPT-5.2被曝作弊!偷袭谷歌竟靠拉爆token刷高分,不如Gemini 3

新智报道,OpenAI刚发布GPT - 5.2就被指「作弊」,其在基准测试中或调参数使模型用更多算力资源。有用户发现它消耗远超对手的token才获成绩,真实能力或与Gemini 3相当。此外,还揭示了OpenAI为商业利益牺牲学术独立的问题。

新智元