构建方法」共找到 3231 篇相关文章

开源动态8

推理快30%,性能超过千亿参数模型,15B模型Apriel-1.6重新定义端侧推理

ServiceNow人工智能团队发布的Apriel-1.6-15b-Thinker,以150亿参数体量,多模态推理能力强,推理Token消耗降超30%。它在AI分析指数成绩佳,优化计算成本,还介绍了训练策略与多维度性能实测情况。

AIGC开放社区
算法论文8

后生可畏!何恺明团队新成果发布,共一清华姚班大二在读

何恺明团队继5月提出MeanFlow (MF) 后,近日推出改进版Improved MeanFlow (iMF),解决了原始MF三大核心问题。它重构预测函数,还实现灵活的无分类器指导和高效的上下文内条件作用架构,提升了实用性和效率。

量子位
新闻资讯7

Agent 正在终结云计算“流水线”,Infra 必须学会“思考” | 专访无问芯穹夏立雪

InfoQ 专访无问芯穹联合创始人夏立雪,他分享了面向 Agent 的基础设施建设进展与经验,探讨从“处理”到“思考”的范式转变对基础设施的冲击,指出 Agent 规模化落地阻碍及解决办法,还谈及 Agentic Infra 等内容。

AI前线
新闻资讯8

清华姚班大神陈立杰,联手00后逆向破局!颠覆50年计算机难题

50年来,顶尖科学家死磕「旅行商问题」等计算机复杂性难题无果。清华姚班陈立杰等人在《Reverse Mathematics Below the Turing Jump》论文中,采用「逆向数学」方法,发现许多理论底层逻辑等价,颠覆千年思维范式。

新智元
开源动态7

新玩法!Karpathy周末手搓“大模型智囊团”应用:各大LLM同台互评,代码已开源

Andrej Karpathy周末手搓Web应用llm - council,让多个大模型像顾问般提供建议。查询通过OpenRouter分发给多个大模型,它们互评后由‘大模型主席’生成最终回复,代码已开源。

AI寒武纪
算法论文8

GRPO训练不再「自嗨」!快手可灵 x 中山大学推出「GRPO卫兵」,显著缓解视觉生成过优化

GRPO在视觉生成流模型后训练阶段有显著提升,但clip机制存在系统性偏差,易使模型陷入过度优化。中山大学、快手可灵等团队提出GRPO - Guard,能降低过度优化风险,在多种任务中表现良好。

机器之心
推荐文章7

评估工程正成为下一轮 Agent 演进的重点

文章指出传统软件工程测试方法难用于 AI 系统,促使评估工程成 Agent 演进重点。它贯穿 AI 生命周期,正走向体系化。介绍评估工程发展阶段,还提及阿里云 RM - Gallery 和云监控 2.0 实践。

阿里云开发者
算法论文8

清华AI数学家系统攻克均匀化理论难题!人机协同完成17页严谨证明

清华大学科研团队用自主研发的AI数学家系统(AIM),以人机交互模式解决均匀化理论研究问题,形成约17页证明。研究系统性总结五大高效人机交互模式,在三方面取得突破,还提出未来研究方向。

量子位
产品应用8

重磅发布!国家队出手解决企业跨省通信「老大难」,语音识别错误率暴降20%

企业全国语音通信业务曾面临交付周期长、AI应用门槛高的问题。联通云犀平台以「全云化架构+语音AI基座」破局,实现架构重构与AI进化,降低方言识别错误率,在多行业落地降本增效。

新智元
新闻资讯8

深度 | OpenAI携手博通自研芯片:算力终局或是垂直整合?

OpenAI与博通战略合作,2026年下半年推进研发,将部署100亿瓦定制AI芯片系统。这标志其从算力采购转向定义,是摆脱英伟达依赖的标志事件,推动AI芯片市场进入新格局。

芯师爷