训练技术」共找到 4642 篇相关文章

新闻资讯8

来自MIT最强AI实验室:OpenAI天才华人研究员博士毕业了!

OpenAI华人研究科学家陈博远完成MIT博士论文答辩。他不到4年读完博士,辅修哲学,是GPT图像生成核心成员和Sora视频团队成员,将推进世界模型技术,强调视觉世界模型对具身智能至关重要。

新智元
新闻资讯8

行业首场丨00 后 Agent 应用创业者的行业观察

外滩大会智能体论坛举办全员 00 后的 Agent 主题圆桌。嘉宾探讨 2025 是否为 Agent 元年,还分享 Agent 应用方向、场景价值、落地卡点、AI Coding 发展及基模与垂直 Agent 关系等观点。

特工宇宙
开源动态8

人人都能炼专属Agent,上海交大开源端侧Agent全栈工具链,真实场景性能超GPT-5!

上海交大开源端侧Agent全栈工具链MobiAgent,将构建手机Agent全流程开放。它在真实场景性能超GPT - 5,还设计“潜记忆加速器”,通过三步养成Agent,评测表现出色,降低移动智能体开发门槛。

机器之心
算法论文8

大突破!实验证明,RL能为LLM注入“创新”能力

此研究挑战‘RL不教新技能’观点,通过‘字符串转换预测’实验证明,RL能让LLM学会组合已有原子技能,形成可泛化、迁移的元技能,还给出模型能力提升路径。

深度学习自然语言处理
开源动态8

社区供稿 | 开源多模态大模型新突破,书生·万象3.5发布,通用能力、推理能力与部署效率全面升级

2025年8月26日上海AI实验室开源发布书生·万象InternVL3.5,通过创新技术实现推理、部署和通用能力全面升级。它有多种尺寸模型,多项性能领先,还加强了智能体核心能力,应用场景广泛。

Hugging Face
算法论文8

突破Pass@1瓶颈:一种让LLM自我博弈、永不枯竭的RL新范式,超越基线22.8%!

近年来,基于可验证奖励的强化学习(RLVR)在提升大型语言模型(LLM)推理能力上有关键作用,但存在熵崩溃问题。论文提出SVS创新策略,让模型自我合成变分问题形成自我提升循环,实验效果惊人。

深度学习自然语言处理
7

代码里插广告,腾讯 Codebuddy 们 “背锅”?DeepSeek “极你太美”事件,其他模型也逃不掉?

网友发现腾讯 Codebuddy 改写代码时插入广告,字节 Trae 国内版有随机出现“极”字的 bug,根源指向 DeepSeek V3.1。此外,Gemini、Grok、Qwen3 等模型也有类似问题。目前对原因有三种猜测,部分被学者否定。

AI前线
产品应用8

基于 Elasticsearch 创建企业 AI 搜索应用实践

Elastic 中国社区首席布道师刘晓国,分享基于 Elasticsearch 创建企业 AI 搜索应用实践,介绍其向量搜索技术及 RAG 应用开发,还提及智能时代搜索需求变化、混合搜索优势及 Elasticsearch 优化改进等内容。

InfoQ
8

“智元机器人收购A股上市公司是创新需要…现金流能撑三年”

智元机器人收购A股上纬新材后公开亮相,董事长邓泰华透露融资、出货等规划。其团队高管回应收购舆论、技术成果及合作等问题,如远征A2高温行走突破、与上市公司合作原因等,还提及出海和工业场景ROI规划。

量子位
新闻资讯7

老外给中国 AI 开源厂商打分:第一梯队是 DeepSeek 和 Qwen。

Nathan Lambert发布“中国开源模型开发商排名”,评估19家实验室贡献,第一梯队是DeepSeek和Qwen。还介绍字节跳动豆包、小米、百度文心一言发展情况,如豆包月活全球第二,小米模型效率突破,文心一言企业应用领先。

AI进修生