AI模型训练」共找到 13744 篇相关文章

新闻资讯7

韩松贾扬清之后,又一家清华系AI公司卖给英伟达,黄仁勋亲自招募95后联创

继韩松、贾扬清后,又一家清华系AI公司Nexusflow被英伟达收购。黄仁勋招募其联合创始人,公司成果亮眼,如开源模型表现超GPT - 4等,这或与生态联系有关,收购也是英伟达活跃布局的一环。

量子位
算法论文7

60%情况下,主流大模型没理解风险只是装懂!别被模型的“安全答案”骗了

研究发现超60%案例中主流推理模型生成合规答案却未真正理解风险,存在系统性漏洞。淘天集团团队引入“表面安全对齐”术语,推出Benchmark研究该现象,还介绍了数据集生成流程及评测指标。

量子位
新闻资讯8

“我可能不再建议学计算机”!图灵奖得主炮轰半个行业,并断言:AI Agent最后全是数据库问题

图灵奖得主 Mike Stonebraker 在访谈中炮轰数据库行业,直言计算机科学未来或不再是增长型行业。他批判 Oracle、Google、AWS 等公司的数据库方案,还指出大模型写 SQL 在真实数据仓库中准确率极低,agentic AI 未来将成数据库问题。

AI前线
开源动态8

小米模型实现声音理解新SOTA!数据吞吐效率暴增20倍,推理速度快4倍 | 全量开源

小米全量开源MiDashengLM - 7B模型,它基于Xiaomi Dasheng和Qwen2.5 - Omni - 7B Thinker,实现声音理解新SOTA。性能领先,推理效率高,革新训练范式,全栈开源,将赋能多场景。

量子位
新闻资讯8

突发!OpenAI推出首款自研AI芯片:能效暴打当前SOTA,今年底G瓦级部署

OpenAI和博通联合发布自研AI推理芯片Jalapeño,它专为大模型推理设计,每瓦性能优于当前最先进水平,九个月完成设计制造,是全栈战略一部分,2026年底开始吉瓦级部署。

AI寒武纪
新闻资讯7

幻觉率降 27%、成本忽略不计:GPT-5.3 与 Gemini 新品对今年AI走向释放什么信号?

3月3日,OpenAI和Google几乎同时发布新模型,OpenAI推出GPT - 5.3 Instant,主打日常对话顺畅;Google发布Gemini 3.1 Flash - Lite,强调规模化智能。二者不追高端能力,分别从成本和体验着手,反映AI竞争重心转移。

深度学习自然语言处理
算法论文8

读万卷书,大模型就能「看」懂视觉世界?Meta揭秘LLM视觉先验的起源

Meta超级智能实验室与牛津团队新论文发现,只见过文本的大语言模型(LLM)能学到可迁移到视觉任务的先验能力。研究通过超100组受控实验、耗费50万GPU小时,揭开LLM视觉先验来源,还给出预训练数据配方。

机器之心
新闻资讯8

用人类脑电波教 AI 开车,这位清华 90 后学者直言隐式信号里藏着 AGI 的关键 | 万有引力

清华大学龚江涛团队用人类驾驶员脑电波教会自动驾驶模型“思考”,成果E³AD发表于NeurIPS 2025。龚江涛从计算机转向人机交互,在多段科研经历中积累经验,探索将人类“直觉”赋予AI

AI科技大本营
算法论文8

“掩码即武器”,四款扩散LLM全部破防 ? 上交&上海AI Lab发现dllm致命安全缺陷

上海交通大学、上海人工智能实验室等团队研究指出,扩散语言模型(dLLMs)有根本性架构安全缺陷。他们提出DIJA攻击框架,能让多个dLLMs大概率生成有害内容,还呼吁从多方面加强dLLM安全。

深度学习自然语言处理
新闻资讯7

AI取代放射科医生还早!Karpathy最新发声:软件工程师也不会失业

Andrej Karpathy发文推荐‘AI并未取代放射科医生’文章,并分享对AI与就业市场关系看法。他指出外界对AI影响就业有‘天真预测’,还阐述用AI取代放射科医生不易的原因及工作因AI变化的标准。

AI寒武纪