「可迁移模型」共找到 10165 篇相关文章
当AI接管70%代码审查工作,剩下的30%才是 “地狱模式”
2024年初“Vibe Coding”成热词,其虽能快速验证想法,但在大型企业项目中“不可控性”凸显。亚马逊云科技研发的Kiro,尝试解决“从提示词到生产”的断裂问题。目前代码审查多采用混合模式,AI仅处初级阶段。
强化学习之父Richard Sutton最新演讲揭示OaK架构:通向超级智能的八步愿景
强化学习之父Richard Sutton在演讲中介绍OaK架构,认为它是通向超级智能的路径。他回顾对简单通用AI智能体架构的追求,强调从经验学习、拟合世界的重要性,还指出实现该架构需八个步骤,虽只是愿景但提供了发展路线图。
Data Agent 落地挑战:忽略技术框架、语义能力和运营体系,投入可能打水漂
Data Agent 看似易上手,落地却充满挑战。腾讯数据工程专家虎兴龙指出,90% 难点源于软件工程,统一语义层建设是关键。企业若忽略相关要点,投入或打水漂,掌握关键要素可提升数据智能化效率。
偷数据的AI公司被抓到了
Reddit发现AI公司利用Wayback Machine开放性,绕过限制扒取大量历史数据用于模型训练。此前Reddit已对AI公司数据抓取设限,还起诉过违规公司。Reddit抵制该行为,宣布限制Wayback Machine索引其内容。
刚刚!Sam Altman官宣:Plus用户GPT-5推理提至每周3000次,AI版电车难题已来
Sam Altman官宣ChatGPT Plus用户GPT - 5级推理额度提至每周3000次,还将更新UI、公布算力权衡策略。同时指出GPT - 5推出带来AI情感依恋及伦理困境,如AI成情感寄托时公司如何应对等问题。
DeepSeek V4 借实习生获奖论文“起飞”?梁文峰剑指上下文:处理速度提 10 倍、要“完美”准确率
ACL公布2025年获奖论文,中国作者比例超51%。DeepSeek梁文锋通讯、实习生袁境阳一作的论文获Best Paper奖。其提出NSA机制,实验显示性能优、准确率高、速度提升显著,成果或用于DeepSeek V4。
这家国内公司,在给具身智能技术栈做「通解」
具身智能是AI热门赛道,世界人工智能大会WAIC 2025让其概念渐明。国内梅卡曼德公司展位集合机器人技术多种落地形式,展示自研通用机器人「眼脑手」全栈技术产品,推动机器人各行业落地。
科学能力太强,这个多模态推理「六边形战士」被严重低估!Intern-S1开源登顶
7月26日,上海AI实验室发布并开源「书生」科学多模态大模型Intern-S1,其多模态能力全球开源第一,文本能力比肩一流,科学能力国际领先。它开创「通专融合」新范式,重构科研生产力,引发国际关注。
GuardAgent:首个专门为LLM agent提供安全Guardrail 的守卫型agent
近年LLM从对话工具变为可自主执行任务的agent,但带来安全隐私挑战。传统安全监护对其力不从心,为此学者发布GuardAgent,它守卫agent,具通用性、精确判断和免训练部署优势,实验表现佳。
数百个虚拟人在线逃生!天大等发布:首个实时在线多智能体模拟方法
天津大学联合清华和卡迪夫大学推出RESCUE系统,把「大脑感知 - 决策 - 行动」循环搬进电脑,让数百虚拟人在线逃生。该系统能实时呈现地形等信息,还能标记身体碰撞力,可用于公共安全场景演练。