后训练技术」共找到 5933 篇相关文章

新闻资讯7

DeepSeek一句话让国产芯片集体暴涨!背的UE8M0 FP8到底是个啥

DeepSeek V3.1发布,官方留言提及新架构和下一代国产芯片,引发AI圈轰动,国产芯片企业股价上涨。文章介绍了UE8M0 FP8概念,分析其适配国产芯片原因,还猜测适配的芯片厂商,指出代表国产AI走向软硬协同。

量子位
产品应用8

豆包 1.6发布,我用火山引擎Trae + MCP,仅半天做了一个“秒懂科研”的PaperAgent!

文章介绍用火山引擎Trae + MCP和豆包1.6构建“秒懂科研”的PaperAgent。对比其与传统开发范式,突出前者高效、低成本优势,还展示了PaperAgent技术栈及开发过程,体现AI云原生开发魅力。

PaperAgent
产品应用7

王兴兴亲测点赞!这家AI公司提前半年把“龙虾”能力带上车,还管住了Token黑洞

宇树科技王兴兴体验宝马新世代 i3 智能座舱称赞,其核心技术来自斑马智能“元神 AI”。斑马智能发布“元神 AI 汽车机器人大脑”等,对“元神 AI”升级,明确交流和办事方向,还管控 Token 等挑战。

AI前线
新闻资讯7

Meta被骂跑偏摊牌!Alex Wang回应新团队目标:个人Agent全球化部署,Manus已在应用上开路

Meta超级人工智能实验室(MSL)负责人Alexandr Wang发声,称其任务是推动超级智能技术突破并做成产品推向数十亿用户,要把个人Agent全球化部署,还谈到与研究和产品平衡、Meta的AI思路等问题。

AI前线
新闻资讯8

写代码写出26亿身家、“淘宝第一个程序员”多隆离职重出江湖,加入老同事创企,“杀入”AI赛道!

技术大牛多隆离开效力25年的阿里,于8月6日加入贝联珠贯,投身AI赛道。他曾是“淘宝第一个程序员”,一路走到阿里P11、成为合伙人,身家达26亿。此次他将和老同事毕玄用AI Agent改写运维服务格局。

AI科技大本营
推荐文章8

LLM-based Agent的代码生成综述

这篇2025年的综述指出,传统代码生成技术难完成复杂开发任务,而基于大语言模型(LLM)的代码生成代理应运而生。它把LLM作为“大脑”,具备自主规划等能力。文章梳理了该领域的核心特征、技术体系、应用实践等,也剖析了挑战与未来方向。

深度学习自然语言处理
算法论文8

挑战 1 比特!ETH Zürich 秦浩桐:如何把大模型「塞进」小设备?| IJCAI 2026

IJCAI 2026大会上,秦浩桐给出创新解法,挑战无需重训的“训练量化”极限,将庞大的LLM强行压缩至极端的1比特与2比特。其团队的BiLLM与SqueezeLLM打破了训练量化魔咒,还指出极低比特量化的三大挑战。

AI科技评论
新闻资讯7

独家|浙大00世界模型创业,完成新一轮亿元融资,已在多个产业领域实现交付

2021年浙大陈天润成立魔芯科技,早期围绕AI驱动3D内容生成。2024年底转向3D场景建模和世界模型,走纯隐式方法。团队年轻有优势,已产生收入,完成融资,将推新模型,目标是实现‘3D的ChatGPT时刻’。

DeepTech深科技
新闻资讯7

美团反思“养虾”日耗上千万元、干扰真实经营,龙虾之父自曝:爆火差点删掉整个项目

今年2 - 3月美团开展“养虾运动”,引入OpenClaw,日耗上千万元还干扰经营。美团CEO王莆中复盘称这是AI转型第一阶段。OpenClaw之父Peter也复盘爆火8个月经历,分享经验与感悟。

InfoQ
算法论文8

清华孙茂松团队 × 深言科技:以解释作为训练信号,让 8B 模型在幻觉检测上反超闭源大模型

大语言模型幻觉问题待解,成本与算力需求攀升。清华孙茂松团队联合深言科技提出FaithLens模型,把幻觉检测提升为整体评估,以解释作为训练信号,8B模型在多任务上超闭源大模型。

AI科技评论