双重效应」共找到 114 篇相关文章

产品应用8

美团提出全新多模态统一大模型STAR,GenEval突破0.91,破解“理解-生成”零和困局

近日美团推出多模态统一大模型 STAR,以“堆叠自回归架构 + 任务递进训练”实现理解与生成双重突破。它解决行业痛点,通过三大核心设计统一能力,实验在多任务中表现顶尖,还给出后续探索方向。

机器之心
算法论文8

斯坦福发布预警信号:生成式AI正如何重塑就业市场?年轻职场新人首当其冲

斯坦福大学Erik Brynjolfsson教授领衔的论文,用海量高频薪资数据研究AI就业效应。发现高AI暴露职业中年轻职场新人就业显著下降,自动化型AI应用致就业降,增强型则无,还给出年轻人受影响大的原因。

深度学习自然语言处理
新闻资讯8

专访中科第五纪黄岩:在具身智能的狂热中,做一位技术实干家

机器之心专访中科第五纪黄岩,他在具身智能狂热中是技术实干家。其有学术和工业界双重身份,技术覆盖多领域。团队解决行业数据利用瓶颈,推出超少样本大模型等成果,在商业落地表现出色。

机器之心
推荐文章7

视频播客不是内容升级,更像是一场分发补偿

文章从创作者视角出发,阐述部分主播需考虑做视频播客的原因。指出媒介融合下“节目”成最大公约数,美国主播因生存需做YouTube,中国播客靠切片传播,专业创作者做视频成本低且杠杆效应大。

乱翻书
算法论文8

Codeforces难题不够刷?谢赛宁等造了个AI出题机,能生成原创编程题

LiveCodeBench Pro团队推出AutoCode框架,利用LLM自动化竞赛编程问题创建与评估。该框架结合验证器 - 生成器 - 检查器框架与双重验证协议,在测试用例生成上可靠性佳,还能生成新问题,同时揭示了LLM在创作上的优劣势。

机器之心
算法论文8

ICML2025 | 揭示MLLM的图文联动推理能力

当前多模态大语言模型(MLLMs)在图文深度融合推理能力上面临挑战,现有评测基准无法真正检验该能力。EMMA基准应运而生,它从四大领域精选题目,采用双重过滤机制和细粒度标注体系,评测发现MLLMs存在多模态推理危机。

深度学习自然语言处理
推荐文章7

2个月,20亿美元估值、硅谷7500万美元投资,Manus给中国AI创业者指了条什么路?

文章以Manus为例,分析其国内被质疑、海外却受青睐的原因。指出它虽无自有模型,但为巨头带来增量价值。还借量子隧穿效应说明其先发红利,最后探讨其挑战、目标及对“套壳”看法。

Founder Park
开源动态8

快慢思考不用二选一!华为开源7B模型实现自由切,精度不变思维链减近50%

华为发布openPangu-Embedded-7B-v1.1,参数7B却有双重“思维引擎”。采用渐进式微调策略和快慢思考自适应模式,可自由切换快慢思考,在多评测中精度提升,思维链减近50%。还推出openPangu-Embedded-1B小模型。

量子位
算法论文8

首次披露!DeepSeek V3 发布软硬一体协同训练论文,公开「降成本」秘诀

DeepSeek团队发布论文《洞察DeepSeek - V3:规模的挑战和对AI架构硬件的思考》,从硬件架构和模型设计双重视角,探索其经济高效的大规模训练和推理方法,介绍了设计原则、低精度驱动等多方面内容及降成本秘诀。

AI科技评论
算法论文8

腾讯发布SpecExit算法,无损压缩端到端加速2.5倍!解决大模型长思考效率难题

腾讯发布 SpecExit 算法,将思考早停与投机采样融合,利用轻量级草稿模型预测“退出信号”,在不引入额外探测开销的前提下,实现动态、可靠的思考早停,在 vLLM 上推理端到端加速 2.5 倍,准确性和推理效率得到双重保障。

机器之心