善意的混乱」共找到 10499 篇相关文章

算法论文8

隐形束缚:RLVR为何无法突破LLM推理边界?

大型推理模型进展依赖带可验证奖励强化学习(RLVR),但它能否扩展模型推理能力存疑。本文通过理论证明与实验,揭示RLVR存在“隐形束缚”,只能在基座模型初始能力内优化,难以发现新解。

深度学习自然语言处理
算法论文8

思维锚点:破解LLM Reasoning黑箱关键句

文章提出思维锚点概念,指推理轨迹中影响后续步骤和答案关键句。开发三种归因方法,系统论证高级组织句影响力更大,锚点主导错误修正。研究为理解LLM推理机制开辟新途径,开源工具支持可视化分析。

深度学习自然语言处理
产品应用8

日志采集效能跃迁:iLogtail 到 LoongCollector 全面升级

2025年,iLogtail正式升级为LoongCollector,实现日志采集和处理领域新跨越。它架构升级,有多样Pipeline形态,性能提升,稳定性和隔离性增强,还具备网络探测、无缝迁移等优势,将带来可观测数据全栈采集新体验。

阿里云开发者
新闻资讯8

从豆包手机谈起:端侧智能愿景与路线图

近日,字节跳动发布豆包手机助手,标志大模型应用从‘Chat’迈向‘Action’。文章解析其关键技术,指出虽具实用价值,但端侧智能体面临安全、自主任务、个性化服务等挑战,还展望了手机助手与端侧智能体未来发展。

AI前线
产品应用8

一粒「扣子」,开启了Agent全生命周期进化

2025年被视为Agent爆发元年,自年初通用Agent产品Manus出现后,其受关注程度空前。火山引擎Force 2025大会上,升级后扣子成焦点,它从开发平台进化为全生命周期平台,覆盖开发、框架、调优、协作四大部分。

机器之心
产品应用7

通过逆向工程探秘 Claude Code 背后运作机制

作者通过逆向工程研究Claude Code内部运作,了解其比Cursor等工具慢且贵原因。Claude Code注重通用性和安全性,执行任务时多有安全检查,虽增加成本延迟,但更可靠,且在命令行工具中用户体验出色。

宝玉AI
新闻资讯7

Morgan Stanley:中国 GPU产能、良率、价格及收入

这是Morgan Stanley对中国GPU自给自足程度研报部分内容,列出华为昇腾系列GPU 2024 - 2027年产能等情况。估算2024年中国AI GPU自给率34%,2027年将提至82%,还分析了半导体自给率提升原因及各领域国产化进程。

芯师爷
推荐文章7

AI 原生软件工程可观测性与可控制性

文章指出 AI 成研发主力军,改变软件生产方式,传统研发管理办法需升级。当前人和 AI 协作有诸多问题,介绍了研发三阶段,阐述可观测性与可控制性概念、关键指标,以及实现可控制性要素,强调二者结合构建高效研发体系。

InfoQ
新闻资讯8

让智能“落地”芯片,今年都去了MWC

2026年世界移动通信大会(MWC)以‘The IQ Era(智能时代)’为主题,全球2400多家企业参展,其中350家来自中国。中国企业展现了从芯片到终端体系化竞争力,在网络、终端、基础设施、模组等方面均有进展。

芯师爷
开源动态8

ROLL:面向大规模语言模型高效强化学习框架

本文介绍阿里推出ROLL强化学习框架,专为LLM训练优化。它设计灵活,不同用户可用其满足业务、探索或线上指标需求。在多任务训练中性能出色,还采用创新机制提升效率,支持自定义操作,适合学术和业务场景。

阿里云开发者