「推理路径调控」共找到 2521 篇相关文章
Kimi新架构让马斯克叹服!17岁高中生作者一战成名
17岁高中生陈广宇作为共同一作的论文提出Attention Residuals技术,将注意力机制“旋转90度”。该技术可让模型“回头看”,经Kimi Linear 48B大模型验证,训练效率提升25%,推理延迟增加不到2%。
GPT-5.4发布:OpenAI首个大一统模型,简直是龙虾原生
OpenAI发布GPT - 5.4,这是其首个大一统模型,将推理、编程等能力融合,且单项性能领先。它在知识工作、计算机使用、编程调试等能力提升,定位AI数字员工,虽单价高但有省钱机制。
国产模型编程能力卷到这个程度了?MiniMax-M2.5 深度实测
文章深度实测MiniMax-M2.5编程能力,用其开发多款游戏和点名工具,结果出色。还分析其底层技术,如原生Agent RL框架、过程奖励机制等,指出它性价比高,虽有不足但值得关注。
BigQuery 新功能:SQL 直调 17 万 + AI 模型,3800 万行数据处理成本仅 2 美元
Google为BigQuery推出面向开源模型的第三方生成式AI推理功能,允许数据团队用SQL语句部署运行Hugging Face或Vertex AI Model Garden的模型,消除对独立ML基础设施的需求,解决数据团队痛点。
Gemini 3 Pro的位置,Kimi K2.5也想坐坐?
Kimi 发布 K2.5,在视觉编程上表现亮眼。它通过多模态训练涌现审美,能生成美观网页。与 Gemini 3.0 对比各有优势,Kimi Code 开源终端 Agent 功能强大,Kimi 还探索 Agent Swarm 协作新路径。
0.005%参数量超越SOTA!提升模型能力无需庞大奖励模型
上海交通大学等校联合团队提出轻量级奖励模型SWIFT,利用大模型隐藏状态线性特征,仅训练极小线性层,在推理任务中超越主流奖励模型,实现计算效率与准确率双提升,且在多领域表现出色。
解锁任意步数文生图,港大&Adobe全新Self-E框架学会自我评估
香港大学与Adobe Research联合发布Self - E框架,可从零训练实现任意步数文生图。它改变训练范式,用两条互补训练信号,在GenEval基准表现出色,让文生图训练更灵活且具扩展性。
中国AGI深度时刻!杨强、唐杰、林俊旸、姚顺雨大咖们2026开年重磅交锋
2025年中国开源模型表现出色,AI大模型探索新范式。AGI - Next前沿峰会嘉宾探讨AGI发展,指出大模型To C与To B市场逻辑分化,还谈及自主进化、智能体变革及中国AI发展路径等问题。
MiniMax今早上市,股价疯涨80%!一群95后跑通了中国AI的价值
1月9日9:30,MiniMax于港交所上市,截稿时股价疯涨近80%。该公司仅用约5亿美元便让全模态模型进入国际第一梯队,员工平均年龄29岁。其以低投入、高产出及全球化业务,展现了中国AI的实力与潜力。
中美算力,站在2000亿美元的分岔路口
高盛报告称2025年全球人工智能投资规模或接近2000亿美元。中美算力发展站在分岔路,中国追性能,美国被能源限制。全球算力市场有新变化,中国本土芯片崛起,各方也在热议AI是否有泡沫。