「预训练模型」共找到 8295 篇相关文章
金融AI武道大会开赛!四道业务真题,出题人:猜不到最优解
AFAC2026金融智能创新大赛开赛,赛题源于真实金融场景,如识别交易行为、还原金融文档等。它强调回归基础研究,探索模型产业价值,是今年金融AI领域值得关注的比赛。
一篇Loop+Harness的自进化Agent最新综述
本文分享清华关于经验时代,已部署的 Agent 如何将交互轨迹转化为持久能力,从自我进化到元进化的论文。介绍了 Harness、技能、记忆、环境等方面,还提及 RL 与持续学习、元进化智能体等内容。
前后端一起消失:AI Coding正在改写大厂工程师分工
大厂研发组织出现调整,美团前后端团队合并,蚂蚁网商让测试岗转研发岗。AI Coding普及使技术岗位划分重塑,前后端边界成“全栈能力”。AI编程工具虽有后端执行能力,但仍需资深工程师兜底。
2w star,网页秒变 AI 助手,厉害了!
阿里项目`PageAgent`登上Github热榜,是纯前端JavaScript GUI智能体框架。它让网页拥有AI Agent,通过自然语言控制界面,无需截图、OCR和多模态大模型,有多种功能特性,使用简单。
独家 | 前华为、字节高管联手创业,专注于消费级具身智能,两轮累计融资数亿元
具身智能初创公司贝塔无限宣布完成种子+轮融资,累计融资数亿。联合创始人刘武龙、陶帅曾分别任职华为、字节。公司聚焦消费级具身智能,研发产品先锋体验版计划年内亮相,还与产业头部企业达成合作。
给 Agent Skills 装上眼睛:MMSkills 用多模态技能包教会智能体看状态、做决策
上海交通大学和小红书团队推出面向通用视觉 Agent 的多模态技能框架 MMSkills,将可复用技能扩展为多模态程序性知识,通过 branch loading 调用视觉证据,在 GUI 与游戏任务评测中表现出色。
玩转智能体协议:谷歌开发指南教你拼出工业级AI应用
谷歌两篇开发指南拆解六大前沿开放协议核心代码,从开发者挑战赛提炼五条架构法则。介绍各协议用途,如MCP消除重复劳动,A2A规范智能体通信等,阐述协议协同运作及架构法则助力工业级智能体应用开发。
Transformer与RNN合体,谷歌打下显存门槛,解锁超长上下文
谷歌论文提出 Memory Caching 技术,通过架构机制创新赋予 RNN「可生长的记忆容量」,兼顾 Transformer 与 RNN 优势,能处理更长文本、降低推理资源门槛,实验显示有良好效果。
OCR 赛道变天了:Datalab 要亲手杀死自己
Datalab推出Chandra模型,指出老一代pipeline OCR已到天花板。它从“切块识别”转向“整页理解”,在布局感知、数学支持、表格表单处理上表现出色,标志OCR从“识别字符”进入“理解文档”阶段。
硬核拆解 Hermes-Agent:自学习 Skill 机制的架构设计与实现原理。
文章围绕Hermes - Agent展开,指出多数Agent缺乏自学习能力,而它试图跨越这一鸿沟,能自动“写手册”(Skill)。介绍其架构、安装配置,通过代码审计任务演示自学习过程,并解析Skill机制,为生产级Agent提供新思路。