联发科」共找到 580 篇相关文章

算法论文8

UC伯克利新作颠覆认知:LLM靠「自信爆表」学会推理?无需外部奖励超进化

UC伯克利华人团队现,LLM不靠外部奖励,仅靠「自信爆棚」就能学会复杂推理。他们提出基于内部反馈的强化学习(RLIF)新范式,用INTUITOR方法让模型用自身置信度作内在奖励,在多任务中表现良好。

新智元
新闻资讯7

智能体崛起,AI+软件研到新拐点了?

InfoQ《极客有约》X AICon 直播探讨 LLM 时代软件研新范式。嘉宾认为 AI 在研中是提效工具,距原生开尚远;部分开环节已由 AI 接手,落地面临稳定性等问题;未来智能体协作是趋势,部分工程师价值将放大。

InfoQ
新闻资讯8

陶哲轩亲测!GPT-5 Pro 40分钟破解3年难题,登顶最难数学考试

数学家陶哲轩将几何难题交给GPT - 5 Pro,虽推理完美但无解。同一周,GPT - 5 Pro在FrontierMath测试集夺冠。陶哲轩测试现AI在研不同层面表现有别,也揭示了AI理解力受限及人类与AI的分工边界。

新智元
开源动态8

让强化学习快如闪电:FlashRL一条命令实现极速Rollout,已全部开源

清华AIR、字节合团队曾布DAPO实现大规模LLM强化学习。刘力源、姚峰团队现DAPO-32B中rollout生成是瓶颈,推出FlashRL,应用INT8/FP8,用TIS解决不匹配问题,加速显著且不牺牲性能,一条命令即可使用。

机器之心
开源动态8

全能高手&学明星,上海AI实验室开源布『书生』学多模态大模型Intern-S1 | WAIC 2025

7月26日,上海AI实验室在WAIC 2025上布并开源『书生』学多模态大模型Intern-S1。它首创‘跨模态学解析引擎’,在多学专业任务基准上超越顶尖闭源模型,还具备体系化技术创新。未来将持续开源,打造更懂学的AI助手。

GiantPandaLLM
开源动态7

压缩之外,Visual Tokenizer 也要理解世界?

MiniMax和华中技大学布视觉tokenizer新研究VTP,引业界热议。该研究揭示传统仅以重建为目标的视觉tokenizer缺乏高层语义表示,提出在预训练中引入语义理解,还现Scaling Law现象,虽有争议但为研究提供新视角。

机器之心
开源动态8

通过零开销逐层权重卸载技术将SGLang Diffusion wan2.2的推理速度加速60%

文章介绍在优化SGLang对Wan2.2视频生成模型支持时,现双Transformer架构下第1步和第19步推理慢的问题。通过零开销逐层权重卸载技术,将整体推理速度提升60%,还突破显存墙,且该优化可扩展到其他模型。

GiantPandaLLM
开源动态8

腾讯开源混元世界模型1.1,视频秒变3D世界,单卡推理仅需1秒

腾讯布并开源混元世界模型1.1,是统一的端到端3D重建基座大模型。它支持从多视图或视频一键生成3D世界,单卡秒级推理完成高精度重建,性能达SOTA,还具多特性,打破技术壁垒。

量子位
新闻资讯7

5个月估值翻10倍,AI数据赛道跑出一家新独角兽

成立约18个月的AI训练数据公司AfterQuery正筹新一轮融资,估值达32亿美元,5个月涨超10倍。它最初想开AI智能体,后转收集训练材料。此赛道已有多家高估值公司,且数据隐私和安全风险待解。

DeepTech深科技
产品应用7

深度体验DeepSeek Harness,我原谅它涨价了

本文深度体验了DeepSeek Harness,它已布并开源代码。其一切如模型、工具等皆为可插拔积木,官方内置超百个插件。介绍了安装方法、使用特点,还对比了与Codex差异,认为它是Agent时代的安卓,有望推动自进化。

量子位