有监督微调」共找到 6443 篇相关文章

新闻资讯7

【完整名单】2024-2025年度中国科技产业投资榜 | 甲子引力X

当前中国股权投资市场处于关键“渡口”,科技投资曾困境重重,现“止跌回暖”但仍“堵点”。投资正校准重构,硬科技成主导,AI相关成热点。2025年大会颁布「2024 - 2025年度中国科技产业投资榜」。

甲子光年
新闻资讯8

挤不动的世界机器人大会上,自变量秀出了真·通用具身智能

2025世界机器人大会上,自变量机器人展示多项成果。通用轮式双臂机器人“小量”“小白”能完成制作香囊、家务整理等任务;“量子2号”仿人形机器人动作精准自然;其具身智能基座模型WALL - A强大泛化性。

机器之心
算法论文7

AI集体“听不懂”!MMAR基准测试揭示音频大模型巨大短板

MMAR基准测试对30款音频相关模型进行测试,结果显示,多数开源模型面对复杂音频推理任务远未达实用水平,音乐任务中所模型表现不佳,且显式推理能力的模型表现更优。

量子位
产品应用8

Meta「轻量级」KernelLLM颠覆GPU内核生成,8B参数碾压GPT-4o

Meta推出基于Llama 3.1微调的8B参数KernelLLM,能将PyTorch代码转高效Triton GPU内核。实测单次推理性能超GPT - 4o和DeepSeek V3,多次生成得分更高,让内核开发更易上手。

新智元
开源动态8

让视觉语言模型像o3一样动手搜索、写代码!Visual ARFT实现多模态智能体能力

上海交大等团队推出多模态智能体训练方法 Visual-ARFT,让视觉语言模型「工具智能体」能力,还开源项目。它能自动调用工具、拆解任务,团队构建 MAT-Bench 评测,其在多任务超 GPT-4o。

机器之心
8

现实版“盗梦空间”?欧洲极客论文全网爆火,一战戳破三大巨头安全神话,35万机密在公网裸奔

欧洲两位安全研究员的论文《从专 LLM API 中窃取推理轨迹》爆火。他们揭示 OpenAI、Anthropic 和 Google 用的“无状态架构”漏洞,能利用小模型解码大模型推理轨迹,导致隐私泄露等风险。

AI科技大本营
新闻资讯7

DeepSeek秘密造芯!专攻推理,一年前已启动,招聘全程不公开

路透社消息,凭借算法震动硅谷的中国AI公司DeepSeek正秘密开发自研AI芯片,定位推理,项目约一年前启动,现处早期。全球模型公司自研芯片成趋势,虽挑战大,但DeepSeek资金支撑。

量子位
开源动态7

Mimo Code 爆火:我们挖开源代码,找到小米 AI 的真创新

6月11日小米MiMo团队开源MiMo Code项目,定位终端编程Agent。它基于anomalyco/opencode,虽创新但引发争议,人肯定工程设计,也人质疑fork行为和运营节奏,本文还探讨了Harness方向与开源意义。

AI科技评论
推荐文章7

端侧跑大模型,现在也太简单了

作者Vicki Boykis分享本地运行AI模型体验,指出如今本地模型性能提升大,像GPT - OSS、Gemma 4系列表现出色。还介绍运行本地智能体流程的设置,虽问题,但优势多,生态值得投资。

机器之心
产品应用8

Marvis 实测:6 个 AI“牛马”扎根桌面之后

作者实测腾讯 Marvis,它能实现终端调度、多 Agent 协同、跨模态任务链执行等。虽在编码、审美等方面不足,但定位安全实用,适合普通用户,体现 AI 助手从对话工具向执行系统转变。

腾讯技术工程