「长链推理」共找到 2755 篇相关文章
突破视频时长限制!Manus上架视频生成功能,网友:比Sora更好
Manus上架视频生成功能,可通过连续拼接突破时长限制。它按“拍电影”方式,根据提示词生成片段再合成故事。网友评价是新创作方式,但效果有提升空间,部分人认为比Sora好。
刚刚,Anthropic 又出新货:Claude Opus 4.1 发布,代码、推理能力再升级
Anthropic发布Claude Opus 4.1,是对Opus 4的小升级,提升智能体任务、代码处理和推理能力。付费Claude用户等已可用,价格不变。在编程评测表现佳,获多方好评,官方建议升级。
小模型也能精确计算:WorldModel-Qwen的推理时代码执行实验
开发者bigattichouse让Qwen - 0.6B小模型推理时生成并执行WASM代码获计算结果。最初尝试加标签生成Python代码效率低,后用WASM,创建三层架构。虽结果未完美,但接近,还通过Gemini审查验证。
10万token自然语言推理,让30B-A3B模型站上奥赛金牌线
上海人工智能实验室报告显示,30B - A3B规模的SU - 01模型不依赖外部工具,经训练在IMO、USAMO、IPhO等奥赛评测达金牌水平。研究还验证更高效科学推理系统路线,有望用于更多科学问题。
推理能力再突破!蚂蚁 | 提出Agentic Deep Research新范式,可信度同步增加
尽管LLM能力提升,但复杂任务表现受静态知识限制。业界提出Agentic Deep Research系统,现存系统训练有梯度冲突和奖励稀疏问题。蚂蚁团队提出Atom - Searcher,创新推理范式,构建细粒度奖励,结合奖励训练,实验效果佳。
开启端侧长文本时代!面壁全新架构,让小钢炮最快提升220倍
2025智源大会上,面壁智能发布MiniCPM 4.0模型,实现行业首个系统级上下文稀疏语言模型创新。它在端侧推理任务上表现出色,降低缓存需求,提高运行效能,还进行多维度架构创新,是AI领域探索高效率语言模型的里程碑。
反转!LeCun刚转发「全球最快开源推理模型」,ETH苏黎世就直接打假
上周,MBZUAI与G42等开源号称「全球最快的开源AI推理模型」K2 - Think,引发广泛关注,图灵奖得主Yann LeCun也转发相关推文。但三天后,ETH苏黎世研究员发文指出该模型存在数据污染、评估方式不合理等问题。
阶跃星辰发布新一代基模 Step 3,原生多模态推理模型,性能达到开源 SOTA
WAIC 2025期间,阶跃星辰上线新一代基础大模型Step 3,7月31日将面向全球开源。还成立“模芯生态创新联盟”,与上海国有资本投资有限公司合作。Step 3性能达开源SOTA,推理效率高,适配多种芯片。
OpenAI推理第一人离职,7年打造了o3/o1/GPT-4/Codex
刚开年,OpenAI推理模型第一人Jerry Tworek离职,他在OpenAI近七年,是构建o3、o1、GPT - 4等的关键人物。他称离职是去探索在OpenAI难以开展的研究,网友有感谢赞叹也有因人才流失而沮丧。
微软等提出「模型链」新范式,与Transformer性能相当,扩展性灵活性更好
随着大语言模型发展,扩展 Transformer 架构成趋势,但参数规模增长带来训练负担。微软等研究者提出 CoR 概念,构建模型链学习范式,应用于语言模型得 CoLM 系列,实验显示其性能相当且扩展性、灵活性更好。