传统软件」共找到 1593 篇相关文章

算法论文8

Meta超级智能实验室又发论文,模型混一混,性能直接SOTA

大语言模型训练依赖算力和时间,传统模型 Souping 多采用均匀平均。Meta 等研究者提出类专家 Soup(SoCE),利用基准测试类别构成选最优模型,非均匀加权平均,实验显示其提升了模型效果与稳健性,在排行榜获 SOTA 成绩。

机器之心
推荐文章7

超越 GoF:现代 AI 系统实用设计模式

文章指出AI系统需要设计模式,如GoF塑造软件设计,云计算引入新模式,机器学习社区也有相关模式。文中介绍现代AI系统的5类实用设计模式,含提示和上下文、负责任的AI、用户体验、AI - Ops和优化模式等,并举例说明。

InfoQ
算法论文8

Reasoning的最终答案可能不是模型想要的答案!

大型语言模型解决复杂问题有推理过程和答案,传统评估只看最终答案。论文提出最终答案可能不佳,中间步骤更值得研究。还介绍通过切割推理过程发现中间步骤藏玄机,提出‘分步检查法’提升模型表现,实验表明准确率最高提升13%等。

深度学习自然语言处理
产品应用7

AI 应用开发的破局之路:字节跳动 Eino 框架实践

在 InfoQ 举办的 QCon 全球软件开发大会上,字节跳动沈桐介绍 Eino 框架在组件抽象和业务编排的创新实践。该框架以大模型为基础,解决应用开发中节点、信息流转和沉淀框架的问题,还给出开发实例,展望了未来重点方向。

InfoQ
开源动态8

超级麦吉:职场人 Vibe Working 的开源 LLM OS

文章介绍了开源项目超级麦吉,它是为职场人打造的 LLM OS,采用三层结构设计,有专业功能和完整产品矩阵。与闭源软件对比,其开源诚意足,虽有颜色和邀请码机制等小问题,但助力职场人向 Vibe Worker 转型。

AGI Hunt
开源动态8

「世界理解」维度看AI视频生成:Veo3和Sora2水平如何?新基准来了

近年来,T2V模型进展显著,Sora2爆火引发对其是否为‘世界模型’的探讨。传统基准无法系统衡量模型对事件因果等的理解,中山大学等团队提出新评测框架VideoVerse,评测主流模型并发现开源与闭源模型差距及各模型缺陷。

量子位
新闻资讯8

AI 工程化进行时:当上百个专家探讨“落地”这件事

10月23 - 25日,QCon全球软件开发大会·上海站(2025)举办,超1300人参与。极客邦科技创始人霍太稳称AI进入‘深水区’,工程化落地是关键。多位专家演讲,探讨AI基础设施、智能体等话题,27个分论坛覆盖AI工程化全链路。

InfoQ
算法论文8

RL在Agentic Reasoning中的作用:拨开迷雾,看清本质

近年大语言模型在推理任务能力惊人,但使用外部工具存挑战。传统SFT无法让模型自主调用工具,强化学习虽被引入,但在智能体推理中面临训练效率、稳定性和泛化能力难题。论文从多维度解构智能体强化学习,提出有效方法。

深度学习自然语言处理
推荐文章8

小红书 FinOps 实践:云成本优化与资源效率提升之道

在 InfoQ 举办的 QCon 全球软件开发大会上,小红书梁啟成分享云成本优化实践。介绍了小红书用云情况,分析成本优化面临的问题,阐述成本洞察和优化的探索,如内外账分离、CPU 和 GPU 资源提效等,还展望了 AI for FinOps 实践。

InfoQ
推荐文章9

GPT-6数学封神,遭顶尖数学家公开质疑“算力截胡”?OpenAI内部研究员撕开Astra真相:人脑更容易被污染,而AI只看概率

OpenAI推出GPT-6 Astra,接连在埃尔德什单位距离猜想、纳维-斯托克斯方程等多个顶级数学难题上取得突破性进展,引发顶尖数学家对学术伦理与传统研究模式的争议,本文为OpenAI内部研究员的深度对谈编译,拆解AI数学推理的核心逻辑。

AI科技大本营