「DeepSeek 3.1」共找到 3720 篇相关文章
大模型推理也能“智能调度”:让奖励模型按需分配算力的动态路由机制 | ACL 2026
生成式奖励模型(GRM)推理策略存在算力浪费问题。腾讯混元与新南威尔士大学联合提出 E - GRM 框架,将模型不确定性定义为调度信号,按需推理。文章从多维度解读该框架,并展示实验评估结果。
告别「盲目自信」,CCD:扩散语言模型推理新SOTA
华为小艺香港团队等研究人员提出上下文一致性解码算法(CCD)。它解决传统DLM推理“短视”和采样预算固化问题,在开源DLMs上实现3.48倍加速和3.9%性能提升,适配多种解码设定。
圣路易斯联邦储备银行报告:美国大量人口已使用生成式AI
圣路易斯联邦储备银行报告显示,截至2024年末,美国18至64岁近40%人口用生成式AI,职场23%劳动者每周至少用一次。还对比其与PC、互联网普及情况,分析使用差异及对经济的生产力提升。
陶哲轩再爆:一个月三破18年未解难题!AlphaEvolve彻底改写数学研究规则
一项封尘18年的数学难题,在短短30天内被AlphaEvolve与人类联手三度突破,和差集指数θ从1.173050提升至1.173077,刷新加法组合学天花板,展示了AI与人类协作的新范式。
Synk收购Invariantlabs-AI安全技术的强强联手
2025年6月24日,安全AI软件开发领导者Snyk宣布收购AI安全研究公司Invariant Labs。Snyk CEO称收购增强了抵御新兴威胁能力。Invariant Labs在MCP领域领先,成果丰富,Snyk也有多样产品,合并有望带来1+1>2效果。
代码榜刷满分,AI科研却撞墙?140道真实研究题撕开「自进化」真相
新工作MLS - Bench覆盖12领域、140个研究任务,评测前沿模型科研能力。虽模型工程执行强,但科学发现能力弱,当前仍难提出有效算法创新。其评测已纳入Kimi K3和Qwen3.8 - Max官方发版表。
PyPI遭投毒!LiteLLM用户Python启动就中招,个人凭证秒泄露
PyPI被投毒,LiteLLM的1.82.7和1.82.8版本被植入信息窃取程序,安装后SSH密钥等数据会泄漏。该漏洞源于Trivy被篡改,攻击者借此发布恶意版本。已给出自检流程,供应链攻击或常态化。
代码、多模态检索全面登顶SOTA!智源BGE向量模型三连击,并全面开放
检索增强技术在代码及多模态场景作用大,向量模型是关键。智源研究院联合高校研发三款向量模型BGE - Code - v1、BGE - VL - v1.5、BGE - VL - Screenshot,登顶多领域测试基准,已全面开放助力研究与应用。
Reddit 上爆出大猛料,Claude 为何封号中国用户又快又准?
Reddit大佬逆向Claude Code 2.1.196版本,发现Anthropic为防中国用户,早在2.1.91版本就装监控程序。它用隐写手段标记并回传用户信息,代码也经加密混淆。Claude Code负责人称是防滥用实验,将回滚检测逻辑。
史上首个被奥斯卡公开支持的AI,终于来了!Utopai模型又被刷屏了
AI原生影视工作室Utopai Studios年入1.1亿美元后又刷屏。其PAI模型可3分钟视频直出,获奥斯卡编剧Roger Avary公开站台,实测效果佳,还与哈登合作。Utopai走皮克斯全链路管线路线,开启AI电影制作新时代。