「执行模式」共找到 1389 篇相关文章
刚刚,全场景L4全球第一股诞生!市值百亿
驭势科技今日登陆港股,成全场景L4自动驾驶全球第一股。它致力于为全球交付‘AI司机’,公开发售获6777.29倍超额认购。其U - Drive®系统能力强,还将推动AI司机订购模式成熟。
HyperEyes:从「搜得更深」到「搜得更宽」,并行多模态搜索智能体的效率革命
小红书研究团队提出 HyperEyes 模型,打破现有多模态搜索智能体串行处理模式困局。通过全栈设计实现并行多模态搜索范式跃迁,在多基准测试中表现优异,证明准确率与效率可协同进化。
Auto Research时代,AI Scientist的第一场药企实习考验|甲子光年
AI Scientist从大模型做题家进化为自动化科研助手,但从demo到应用面临买单难题。Phylo等团队构建BiomniBench评估框架,让AI做药企真实数据分析,结果显示AI表现超人类实习生,且有速度和成本优势,但也存在偏科问题。
小模型代替顶级闭源:微软用4B小助理,砍掉30% Token消耗
微软研究团队提出实用方案,用4B参数的微型模型Terminus - 4B替换昂贵顶配大模型接管终端执行任务,采用SFT和RL策略打造子智能体,经测试效果良好,节省Token消耗。
Skill Factory:三天手搓面向Harness设计的技能工厂(附AI coding实践)
作者分享从产品设计到算法落地全流程实践,指出当前做skill两种方式的问题,介绍面向Harness设计的技能工厂,包括生产模式、生态适配、迭代方向,还提及AI coding实践及各工具作用。
名师一定出高徒?清华团队最新揭秘:别再迷信大模型蒸馏的「免费午餐」
当下大模型后训练中,On-Policy Distillation(OPD)成明星技术,业界采用后报告性能提升。但清华团队研究发现,换更强Teacher,Student性能可能无提升甚至倒退。研究揭示蒸馏成败条件,深挖对齐机制,还给出拯救失败蒸馏的方法。
Kimi K2.6背后的Agent Database:Agent-native 时代的数据 Infra 竞争,跟过去 30 年有何不同
TiDB Cloud 成 Kimi K2.6 供应商,为其 Agent 建站服务提供支持。Kimi K2.6 由 Agent 完成在线应用构建,与其他 AI 建站应用不同,它全托管且用户无需技术背景。该合作解决了成本和基础设施难题,展现了 Agent-native 时代数据 Infra 竞争的新特点。
老黄秘密武器曝光:AI一夜设计芯片,顶人类顶级工程师10个月!
英伟达在GTC大会揭露用AI设计GPU,原本8名工程师10个月的任务,AI一夜完成。其开发NB - Cell、Prefix RL等工具,还推出内部大模型Chip Nemo和Bug Nemo,不过完全端到端自动化设计仍有距离。
迈向无缝共生:大模型GUI Agent的「屏幕图灵测试」与拟人化之路
多模态大模型使GUI Agent能模拟用户执行任务,但也引发与平台的利益冲突。论文提出“屏幕图灵测试”和AHB基准评估拟人化能力,探讨拟人化策略及权衡,为Agent在数字世界共生提供指南。
Pinterest 部署生产级模型上下文协议生态系统,赋能 AI 智能体工作流
Pinterest 工程团队搭建内部模型上下文协议(MCP)生态系统,驱动 AI 智能体,实现工程任务自动化。架构上线生产级服务器等,替换零散对接方式,让语言模型调用工具、访问数据,还能执行多种任务。