「全双工机制」共找到 2634 篇相关文章
Qwen3家族训练秘籍公开:思考/非思考融进一个模型,大模型蒸馏带动小模型
Qwen3技术报告揭晓8款模型关键技术,采用双模式架构,训练和微调分段进行,还“大带小”蒸馏数据。其融合思考与非思考模式,训练分多阶段,Qwen Chat还全量上线深度研究功能。
爆火!几天狂揽5万星,这个神器让AI一次砍掉54%屎山代码
最近开源项目Ponytail爆火,几天揽5万星。它将老程序员‘偷懒智慧’系统化喂给AI,让AI编码代理思考,使代码量直降54%,最高砍到94%,成本和时间同步下降,还保持100%安全。
数据限制具身?觅蜂杀进场破局:高质量数据水电一样即取即用
2026年4月16日,觅蜂科技发布一站式物理AI数据服务平台等,董事长姚卯青称当前具身智能面临数据荒漠问题。觅蜂打造“又全又好又快”数据供给,还启动蜂巢数据共创行动,与多家企业合作。
如何改变AI研究范式?谷歌DeepResearch新方法TTD-DR原理与实现 | 原理篇
谷歌提出新的DeepResearch方法TTD - DR,它模拟人类研究范式,将Agent起草的初稿视为‘含噪声输出’,经多轮检索 - 改进使初稿成高质量终稿,还引入自进化机制,测试显示其在复杂任务上领先。
Meta打开AI元认知,让AI不止会解题,还会总结套路了
Meta等机构提出‘元认知重用’机制,让大模型学会反思总结。大模型打造‘行为手册’,与主流RAG系统有本质区别。研究人员设计三种实战用法,虽有局限,但为大模型推理难题提供了解决方案。
机器狗翻了个身,国产GPU往前走了坚实一步|甲子光年
5月18日摩尔线程发布会上,机器狗“小飞”侧空翻,是业内首次基于国产硬件仿真平台训练、国产端侧芯片部署并真机验证。该司以全功能GPU打造国产具身智能基础设施,MT Lambda平台解决多方面问题。
蛰伏一年,周衔团队带来首个具身基础模型,烹饪做实验弹琴,效果炸场
Genesis AI公布首个机器人基础模型GENE - 26.5,能完成烹饪、解魔方等复杂任务。该模型是全栈系统,以仿真加速迭代,用自研手套采集数据,还重写控制栈。公司后续计划发布全身机器人。
抨击 AI 炒作、曝企业需求为先,Anthropic 联创:模型提 0.01 性能就血赚,算力烧钱但值!
Anthropic 由 7 位前 OpenAI 核心成员创立,联合创始人兼总裁 Daniela Amodei 在接受采访时表示,“AI 安全”是核心优势,企业客户对安全性的高要求与之匹配。Anthropic 以“不要相信炒作”为价值观,谨慎对待支出和算法效率。
谷歌Agent杀入电商赛道:AI直接帮忙比价下单,马斯克:有意思
谷歌CEO官宣发布谷歌版Agentic电商解决方案,从UCP协议到Gemini CX,AI Agent贯穿购物全流程,可自动比价下单、领券等。国内阿里、京东、抖音等电商平台也在积极布局智能体电商。
这次,LLM黑盒被LLM打开了~
随着大语言模型(LLM)能力提升,其内部机制更不透明。概念描述新范式用另一个 LLM 自动生成自然语言解释。介绍了描述对象、生成方法、评估指标,还提及社区关注方向,指出结合多种手段才能把解释变知识。