「新功能实现」共找到 6364 篇相关文章
实证:现在的LLM根本不会Reasoning!
论文指出当前大推理模型(LRM)如DeepSeek - R1等可能只是在表演“思考秀”,遇到复杂问题就崩溃。研究者用4个可控谜题测试,有三大颠覆发现,还揭示思考过程的荒诞现象,直指行业痛点并给出发展方向。
给大模型装上「思维分段引擎」:浙大InftyThink解锁无限深度推理
如今大模型长上下文推理面临计算成本高、推理易中断问题。浙大联合北大团队提出InftyThink新范式,将传统推理拆成短片段并总结,突破推理长度限制,在多基座模型实验中表现优异。
港科联合港中文提出AdaCtrl,自适应可控Reasoning,可降10~90%
港科联合港中文提出AdaCtrl,解决LLM推理的过度思考、算力浪费和响应延迟问题。它有自适应和用户控制两种模式,通过两阶段训练法实现目标,实验效果好,未来或拓展到多领域。
Dify、n8n、Coze、Fastgpt、Ragflow到底该怎么选?超详细指南~
文章对比了Dify、Coze、n8n、FastGPT和RAGFlow五个主流平台,从功能、使用体验、应用场景等方面详细分析其特点,给出选择建议,还提醒考虑预算、技术能力等要素,帮读者选合适平台。
DeepSeek-V3-0526 闪现后秒删!
Unsloth文档页面惊现DeepSeek新模型DeepSeek-V3-0526后秒删。该模型性能佳,团队还准备了技术描述。Daniel Han预测其可能端午节前发布,社区对此反应热烈,大家期待DeepSeek下一步动作。
DeepSeek用的GRPO有那么特别吗?万字长文分析四篇精品论文
文章解读 Kimi k1.5、OpenReasonerZero、DAPO 和 Dr. GRPO 四篇论文,分析 DeepSeek R1 里 GRPO 及改进算法。指出 GRPO 非特殊 RL 算法,当前 RL 算法实现相似,变革聚焦价值函数取舍等核心维度。
以加代乘?华为数学家出手,昇腾算子的高能设计与优化,性能提升30%!
大模型落地面临推理难题,华为团队基于昇腾算力发布三项硬件亲和算子技术研究,包括以加代乘的AMLA算子、融合算子技术、SMTurbo加速技术,实现能效、协同和速度突破,未来将拓展应用场景。
谷歌重磅发布Flow,人人都能制作好莱坞级电影
谷歌在‘I/O 2025’大会发布影视级AI制作工具Flow,它是Video FX迭代版,由Veo 3、Imagen和Gemini支持。具备专业影视制作功能,已有知名制作人用其产出高质量作品,已开放使用。
谷歌AI核爆:升级全系模型,Gemini 2.5双榜登顶!所有产品用AI重做,OpenAI如何接招?
北京时间5月21日凌晨,谷歌在2025 I/O大会发布众多更新。模型层面,为Gemini 2.5 Pro引入新推理模型和2.5 Flash;谷歌搜索推出AI模式;还亮相视频模型Veo 3,编码助手Jules公测等。
国行苹果与阿里的AI 合作,正遭遇美政府狙击!
据《纽约时报》5月17日报道,白宫和国会官员严格审查苹果与阿里巴巴的AI合作计划。苹果因在中国市场销量下滑、缺乏AI功能,急需本土伙伴;而美国政府担心交易助中企提升能力等。