后训练方法」共找到 4822 篇相关文章

算法论文8

ICCV2025 | One image is all you need,多模态指令数据合成,你只管给图,剩下的交给Oasis

近年来多模态指令数据合成依赖人工设计提示词,成本高。本文提出 Oasis 方法,仅靠图像生成数据,打破传统输入模式,还开源代码库 MM - INF。实验显示其数据多样,能提升 MLLM 性能。

机器之心
新闻资讯8

黄仁勋交流会万字实录:谈中美芯片、H20、CUDA兼容,点赞DeepSeek、Qwen和Kimi

英伟达CEO黄仁勋在华媒交流会上称,中国供应链发达、AI人才多、电动汽车发展出色,H20芯片解禁,英伟达会继续投资。他还谈到CUDA兼容、中美贸易等问题,鼓励年轻人投身AI。

Founder Park
算法论文8

ICML 2025 Oral!北大和腾讯优图破解AI生成图像检测泛化难题:正交子空间分解

OpenAI推出GPT - 4o图像生成功能,AI生图安全挑战凸显,区分生成与真实图像成难题。北大与腾讯优图研究人员用正交子空间分解解决AI生图检测泛化难题,论文被ICML 2025接收。

机器之心
算法论文8

年度AI论文!全球三大顶尖模型的防蒸馏机制全面告破:小模型“套出”大模型隐藏思维链,Kimi-K3重现概率异常

这篇论文指出三大前沿AI模型厂商API有密码学旁路漏洞,攻击者用轻量级模型就能恢复大模型隐藏思维链数据。还揭示部分模型训练或借鉴大模型思维链,此漏洞也致企业数据隐私安全问题。

AI前线
新闻资讯8

一条被开发者踩出来的路:OpenClaw“涌进”飞书

在中文社区,越来越多开发者将 OpenClaw 接入飞书,飞书接口生态开放且更新快。这波热度并非官方推动,开发者先实践,飞书将路径官方化,补齐链路,其优势在于便捷实用,正朝“入口级”智能平台转变。

InfoQ
算法论文8

ICLR 2026 | 异常需要定义!中传团队提出开放世界视频异常检测新范式

现有视频异常检测(VAD)方法泛化能力不足,无法适应开放世界需求。中传吴晓雨团队在ICLR 2026发表论文,提出LaGoVAD模型,联合建模视频与异常定义,解决样本密度下降等问题,实验显示泛化性强。

机器之心
产品应用7

Dia 没死,人家转手就发了 1.x 版本

OpenAI 发布浏览器 Atlas 引发讨论,有人认为其有缺陷会失败,也有人觉得初创 AI 浏览器会被巨头收割。以 Dia 为例,它被收购加快迭代,推出 Skills Gallery、Research 等功能,还新增连接 App 等特性。

MacTalk
推荐文章7

深刻理解Token:大语言模型(LLM)是如何看待这世界?

文章指出在大语言模型(LLM)中,Token是处理文本的基本单位。介绍了Token的概念、分词方法、向量化过程,还阐述了分词对模型性能的影响,如导致模型在数学、多语言处理上表现不佳等。

AINLPer
新闻资讯7

Figure机器人分拣快递新视频曝光,网友:太像人类

Figure 02机器人开启打工模式,创始人放出其分拣快递新视频,它动作流畅像人类,由端到端通用控制模型Helix自主驱动。此前它还在宝马生产线连续20小时轮班作业,Figure与OpenAI分道扬镳推出Helix。

量子位
算法论文8

与Gemini Diffusion共振!首个扩散式「发散思维链」来了

西湖大学齐国君教授团队提出扩散式「发散思维链」,这是面向扩散语言模型的新型推理范式。它与传统思维链不同,能非线性生成,已应用于两种模型,增强的模型在相关任务上超越现有模型。

机器之心