养虾本」共找到 309 篇相关文章

算法论文8

大模型也需要自我反思,上海AI Lab合成“错题”让大模型数学成绩提升13.3%

上海AI Lab提出LEMMA方法,构建“错误 - 反思 - 修正”数据,让大模型从错误中学习。通过教师模型定向制造“学生会犯的错”构造数据,实验显示在Llama3 - 8B上数学解题准确率提升13.3%。

量子位
推荐文章7

智能体工程的隐形技术债:10分钟造出一个 Agent,公司却要为它一个平台团队

如今构建智能体容易,但投入生产后会面临诸多问题。文章围绕智能体绘制出集成、上下文湖等七个基础设施模块,分析各模块隐性技术债务,并指出不同阶段债务表现,还提及应对措施及相关会议推荐。

AI前线
开源动态8

谷歌T5Gemma重燃架构之战!「套壳」反杀Gemma尊,9B推理快得离谱

2023年以来大模型战场由decoder - only架构主导,Google双线出击。T5Gemma重燃encoder - decoder架构战火,性能提升显著;MedGemma坚守decoder - only路线,强攻医疗多模态,击穿闭源壁垒,打响开源反击战。

新智元
算法论文8

全新GPU高速互联设计,为大模型训练降增效!北大/阶跃/曦智提出新一代高带宽域架构

随着大模型参数规模扩大,分布式训练成关键路径,高带宽域设计对提升训练效率至关重要。现有HBD架构在可扩展性、成和容错能力等方面有局限,北大、阶跃、曦智团队提出InfiniteHBD架构解决问题。

量子位
产品应用8

国产算力Day 0适配,一人剧组时代到来,商汤Seko 2.0降增效让AI短剧真正落地

商汤Seko 2.0率先实现创编一体与多剧集智能生成,通过一致性控制技术与国产算力适配,缩短漫剧制作周期。它解决了AI视频生成痛点,降低成、提升效率,适配国产芯片,还拓展了内容生态。

AIGC开放社区
产品应用7

了只东北味熊猫当AI合伙人,一口一个老铁,还真帮我开了家「一人公司」

腾讯ima上线copilot模式,可“领”小熊猫并设定人设风格,成专属知识伙伴。它不分对话和任务模式,知识库功能实用,还能私人定制。作者用它模拟创业,体验良好,其记忆和全场景感知实用。

量子位
新闻资讯8

Meta、OpenAI 争抢收购 OpenClaw!创始人艰难抉择:月入不到2万刀赔钱项目,Offer拿到手软,对几十亿融资没兴趣

近日,OpenClaw 创始人 Peter Steinberger 分享项目经历。项目亏损,他收到 OpenAI、Meta 等大厂收购意向,要求保持开源。他还谈 AI 观点,如安全恐慌被放大,AI Agent 将取代 80% 独立 App 等。

InfoQ
新闻资讯7

Meta、OpenAI 争抢收购 OpenClaw!创始人艰难抉择:月入不到2万刀赔钱项目,Offer拿到手软,对几十亿融资没兴趣

OpenClaw创始人Peter Steinberger分享成名经历,项目亏损但收到OpenAI、Meta收购意向,他要求开源。他还谈AI观点,如安全恐慌被放大、AI不会取代程序员核心能力,且AI Agent将取代80%独立App。

AI前线
开源动态8

大模型开发者必读!拆解世界级AI模型的诞生,Hugging Face把4年模型训练经验写成了一开源指南

Hugging Face发布《The Smol Training Playbook》,分享约4年构建SOTA模型和数据集的经验。手册涵盖是否训练、训练何种模型、如何训练等内容,强调数据质量重要性,还介绍了模型设计、训练中的实践与教训。

AIGC开放社区
开源动态7

团队造语言”时代终结?Rust传奇人物用Claude造出新开源编程语言,AI写下万行代码:大模型上限很高,我学会了高效用它!

Rust核心贡献者Steve Klabnik借助Claude写了新语言Rue并开源。他曾是AI怀疑论者,现认为大模型在编程中‘真的有用’。Rue目标是不依赖垃圾回收提供内存安全,使用体验更顺手,开发深度依赖Claude。

InfoQ