全栈优化」共找到 3017 篇相关文章

算法论文8

信息熵之后,清华提出状态熵!量化分析「系统智能性」的新视角

清华大学科研团队从自治系统的演化动力学出发,提出状态熵概念,分析其与系统聚合度关系,为系统智能性度量提供新视角。论文给出状态熵统一定义及演化解析表达式,还在典型系统上分析其演化规律。

新智元
开源动态8

阿里王牌Agent横扫SOTA,开源力压OpenAI!博士级难题一键搞定

阿里昨晚开源通义DeepResearch,在多项权威基准上表现出色,超越OpenAI、DeepSeek。模型、框架、方案开源,开发者可在相关平台下载。它告别一问一答模式,像研究员一样工作,还构建了独特数据体系。

新智元
推荐文章8

「All in AI」的 Shopify,分享了他们的员 AI 落地实践,是干货

Shopify 三个月前决定「All in AI」,副总裁 Thawar 分享公司引入 AI 的策略、提升效果与三个「反直觉」见解。如员无差别用 AI、让 AI 展示思考过程、重视新手等,还给出多个工作流案例。

Founder Park
开源动态8

伯克利最强代码Agent屠榜SWE-Bench!用Scaling RL打造,配方公开

开源软件工程模型DeepSWE横空出世,基于Qwen3 - 32B,仅用强化学习训练,以59%准确率刷新SOTA。它采用rLLM框架、R2E - Gym环境,用改良GRPO++算法,还介绍了评估策略及训练挑战的解决办法。

新智元
算法论文7

原来Scaling Law还能被优化?Meta这招省token又提效

2017年《Attention Is All You Need》提出的Transformer是主流语言模型基础范式。Meta新论文提出旋转不变型三线性注意力机制,证明其表现能改变Scaling Law系数,还证实2 - simplicial Transformer在有限token预算下更优。

机器之心
推荐文章8

MCP 核心宝典 | 2025 最新最!经典MCP案例实操讲解!必读!

文章介绍2025最新版MCP说明手册,阐述MCP是让AI模型无缝交互的标准化接口和框架,解决AI与外部连接难题。还给出实操案例,如本地构建MCP项目、实现MCP驱动的代理式RAG搜索向量数据库。

MCP Lab
开源动态7

国产 AI 昇腾推理不再高门槛?开源技术推理性能对比解析

文章聚焦昇腾 NPU 大模型推理,对比 MindIE 和 vLLM Ascend 推理性能。因 MindIE 使用门槛高,昇腾联合 vLLM 社区推出插件。实验用 GPUStack 平台,结果显示二者在不同场景各有优势,呼吁构建国产 AI 基础设施体系。

PaperAgent
算法论文8

直播预约 | SwS: 强化学习训练能否不依赖外部知识优化模型的弱点?

该论文提出强化学习场景下的启发式数据合成流程(SwS),利用模型自我感知弱点驱动自动化问题生成,弥补推理缺陷。对其扩展后适应性更广,在多基准测试集和模型上验证有效,性能提升显著。

深度学习自然语言处理
产品应用7

DeepSeek接入智慧小浪,「评论罗伯特」爆梗进化!背后大模型揭秘

新浪新闻推出AI辅助工具「智慧小浪」,接入DeepSeek深度思考能力,依托知微大模型,能总结资讯要点、提供延伸阅读。微博「评论罗伯特」升级,更懂用户情绪、回复有深度。此外,微博还有博主AI助手等爆款应用。

新智元
开源动态8

Anthropic祭出大模型“读脑”杀手锏:LLM决策过程给你扒开看

Anthropic宣布开源电路追踪工具,可追踪LLM神经元,通过生成“归因图谱”揭示模型输出原因。开源了生成图谱的库和交互式前端,并提供demo notebook。可追踪电路、可视化图谱、检验假设。

AI寒武纪