安全训练」共找到 2978 篇相关文章

产品应用8

陶哲轩DeepMind梦幻联动,最强通用科学Agent来了!一口气解决芯片设计、矩阵乘法和300年几何难题

谷歌DeepMind与陶哲轩等打造的AlphaEvolve是LLM驱动的进化编码Agent。它能优化计算生态、调度数据中心等,还解决了数学难题,已在谷歌内部使用,现开启早期邀测试用。

量子位
产品应用7

Pinterest 部署生产级模型上下文协议生态系统,赋能 AI 智能体工作流

Pinterest 工程团队搭建内部模型上下文协议(MCP)生态系统,驱动 AI 智能体,实现工程任务自动化。架构上线生产级服务器等,替换零散对接方式,让语言模型调用工具、访问数据,还能执行多种任务。

InfoQ
推荐文章7

GitHub 已被各类Agent霸榜,今天挑选5个高star Agent

文章挑选5个GitHub高star Agent项目。如Hermes Agent是开源自改进AI Agent,有自主技能创建等特性;GitNexus是纯浏览器端代码智能工具;Shannon是白盒AI渗透测试工具等。

GitHubStore
算法论文8

ICLR 2026 Oral | 告别多步去噪!清华团队推出MVP,实现机器人动作单步极速生成

清华大学智能驾驶课题组 iDLab 与加州大学伯克利分校人工智能研究院 BAIR联合发表研究,提出 MVP 策略。它引入瞬时速度约束解决均值流学习问题,设计复合生成与选择机制,在多任务测试中表现出色。

机器之心
开源动态8

彻底告别VE与VAE!商汤硬核重构多模态:砍掉所有中间编码器

商汤科技联合南洋理工大学发布NEO - unify,这是“原生、统一、端到端”多模态模型架构,砍掉VE和VAE,用混合变换器架构打通视觉与语言能力,提升数据与算力利用效率,为跨模态智能系统奠基。

量子位
新闻资讯7

又走一个!OpenAI研究VP离职,转投Anthropic做RL研究员

OpenAI研究副总裁Max Schwarzer宣布离职,转投Anthropic做RL研究员。他曾主导o1、o3和GPT - 5系列post - training,因渴望回归一线研究而离开。OpenAI近年人才流失严重,而Anthropic虽面临与五角大楼交锋危机,但仍吸引人才。

新智元
算法论文7

Veo何止生成视频:DeepMind正在用它模拟整个机器人世界

通用型机器人策略发展带来挑战,传统评估方法有局限,前沿视频模型虽有潜力但面临困难。Google DeepMind团队提出基于Veo的机器人策略评估系统,经实验验证有效,展示了视频仿真评估的可行路径。

机器之心
算法论文7

Meta|提出RECAP,通过动态目标重加权回放,解决RLVR遗忘【文末送书!Agent相关】

近年来,可验证奖励强化学习(RLVR)提升了大模型在多任务上的性能,但带来“能力退化”问题。Meta等提出RECAP策略,结合“回放”与“动态目标重加权”,保持模型通用能力,提升推理性能,还提高推理效率。

AINLPer
新闻资讯7

网友晒 21 页 PDF 质疑 Grok 3 套壳 Claude,Grok 3 自己承认了!xAI 工程师被喷无能

网友 GpsTracker 爆料,埃隆·马斯克旗下 xAI 公司的 Grok 3 模型在“思考模式”下自称是竞争对手 Anthropic 公司的 Claude 3.5。网友提供对话记录和 21 页 PDF 佐证,引发社区对模型异常原因的讨论。

InfoQ
新闻资讯7

全球首例!科学家将腿部肌肉线粒体注入盲人眼球,瞳孔光反射短暂恢复

对于视神经严重受损致盲,临床缺有效修复手段。美国研究人员从失明女性腿部肌肉提取线粒体注入其双眼,初步验证了自体线粒体眼内移植的安全性,患者眼部有生理变化,但未恢复视力,实验疑问多。

DeepTech深科技