「技术能力」共找到 5494 篇相关文章
企业微信给AI写了94份说明书,Claude Code现在能直接干活
北京时间8月17日,企业微信更新,将能力域从7个扩到12个,参考文档扩到94份。介绍了其能操作的业务品类,分析文档权重体现的产品意图,阐述三个设计细节,指出想象空间、机会及坑,强调此次更新比首次更重要。
破解AI对不同上下⽂位置的敏感度不⼀致,新框架使出“解铃还须系铃人”
语言模型存在位置偏见,影响复杂推理等任务。论文提出Pos2Distill框架,将模型优势位置能力迁移到劣势位置缓解偏差,设计了Pos2Distill - R1和Pos2Distill - R2,在检索和推理任务表现好且有跨任务泛化能力。
才知道百度和阿里为什么能联手瓜分市场了
AI热度未减但问题转变,企业更关注全栈能力。沙利文报告显示2025年上半年阿里云和百度智能云占一站式AI云市场超一半。阿里和百度长期投入,全栈能力让其在竞争中更笃定,苹果也选它们为中国AI伙伴。
RL在Agentic Reasoning中的作用:拨开迷雾,看清本质
近年大语言模型在推理任务能力惊人,但使用外部工具存挑战。传统SFT无法让模型自主调用工具,强化学习虽被引入,但在智能体推理中面临训练效率、稳定性和泛化能力难题。论文从多维度解构智能体强化学习,提出有效方法。
你的扫描全能王,作价217亿冲刺港股IPO
扫描全能王母公司合合信息拟作价217亿赴港IPO,冲刺“A+H”双重上市。其C端有扫描全能王等产品,B端有TextIn等产品。合合以文本智能技术为核心,打造三大技术平台,C端靠付费订阅、B端卖产品模块盈利。
从预测到干预,Aether AI为什么押注因果世界模型?
Aether AI 定义技术路线为「因果世界模型」,关注模型识别影响结果的变量、理解因果结构、模拟干预后果。它从预测未来的局限切入,介绍了因果能力的三类核心问题及研究成果,还用四层架构实现能力落地。创始人黄碧薇看好当下时机,从 Physical AI 切入创业。
SGLang Hierarchical Sparse Attention 技术深度解析
阿里云等团队推出面向 Sparse Attention 的分层稀疏化框架,介绍其架构、机制与实践。此框架破解了长上下文推理时的计算与容量瓶颈,以 DeepSeek DSA 集成测试,使推理性能大幅提升,目前项目处于开发阶段。
SGLang 确定性推理实现技术细节笔记
文章围绕SGLang确定性推理展开,介绍其启用方式,详述批次不变性原理与Batch Invariant Ops实现,如Matmul Persistent Kernel设计;还阐述确定性采样、Attention Backend配置、AllReduce改动等,给出环境变量及测试脚本,有完整解决方案。
一篇持续强化学习技术最新综述
文章对持续强化学习(CRL)进行全面考察,关注其核心概念、挑战和方法,提出新的分类体系,从知识存储和/或转移角度将CRL方法分为四类,并分别介绍各类方法特点。
Claude 这个更新,让模型能力提升10%+!
Claude开放100万上下文长度更新,实际可用空间接近8倍提升。数据显示,上下文越长Claude与其他模型差距越大。API取消溢价,还更新图片/PDF上限、将Adaptive Thinking转正式版。