「自定义子智能体」共找到 4283 篇相关文章
光场显微飞跃AI时代!清华等首提SeReNet:毫秒级高分辨光场三维重建
SeReNet是物理驱动的自监督三维重建网络,能毫秒级实现高保真、高分辨光场三维重建,摆脱对标签数据依赖。它全链路建模应对复杂干扰,在多实验展现价值,推动生物成像技术发展。
市场还没爆发,但AI眼镜已经卷死了
今年5月多款AI眼镜新品上线,市场竞争激烈。硬件上芯片向高端手机靠拢,软件借AI大模型落地功能,还出现代工产业链。不过,国内AI眼镜在AI和软件功能上有不足,与市场需再磨合。
高考第一天,用豆包修图3.0花式「整活」送祝福,已原地笑翻!
豆包的一句话P图功能进化,其图像编辑模型SeedEdit 3.0全量上线,AI修图进入3.0时代。用自然语言就能精准编辑图片,在文字编辑、局部修改等方面表现出色,还突破以往模型瓶颈,成设计师利器。
LSTM之父22年前构想将成真?一周内AI「自我进化」论文集中发布,新趋势涌现?
本文介绍AI模型自我进化方向的进展,涉及多机构的相关论文。如受“哥德尔机”启发的“达尔文哥德尔机”可自我改进;还有“自我奖励训练”“MM - UPT”“UI - Genie”等方法,展现AI自我进化潜力。
微软发布NLWeb:把任何网站变成AI应用的秘密武器!
微软在Build 2025大会发布开源项目NLWeb,基于MCP构建,能让任何网站秒变AI应用。它是开放协议和工具集,可添加自然语言对话界面。与其他协议对比有优势,已有组织试用,不过企业采用态度不一。
ICML 2025 Spotlight | 多模态大模型暴露短板?EMMA基准深度揭秘多模态推理能力
最新研究推出 EMMA 基准测试,揭示顶尖多模态大语言模型在深度视觉与文本融合的复杂多模态推理上显著不足。该研究已被 ICML 2025 接收,代码数据开源。实验表明,现有模型与人类专家差距大,视觉推理是核心瓶颈。
深度解析大模型技术演进脉络:RAG、Agent与多模态的实战经验与未来图景
大模型作为产业变革核心引擎,RAG、Agent与多模态技术重塑AI与现实交互边界。本文解析技术演进脉络、实战经验与未来图景,介绍三者在各领域应用及面临挑战,为产业升级提供指引。
ICML 2025 | 注意力机制中的极大值:破解大语言模型上下文理解的关键
ICML 2025新研究揭示,在使用RoPE的现代Transformer模型里,注意力机制Q和K表示有集中极大值,V表示无此模式。研究通过实验明确极大值与上下文知识理解的联系,对模型设计、优化和量化有重要启示。
刚刚,SpaceXAI最强Grok 4.7发布!价格杀疯,跑分令人失望
本文报道SpaceXAI发布新款大模型Grok 4.7,该模型定位面向编程与知识工作,主打速度翻倍、价格仅为同类一半,强化长任务处理能力,跑分表现引发网友争议。
我给阶跃星辰 Step 5 Preview 出了一道工程题
本文作者池建强参与阶跃星辰新一代旗舰大模型Step 5 Preview小范围内测,设置带两层bug和隐藏需求的编码工程题,与Qwen 3.8 Max、Kimi K3对比测试,分享实际项目使用体验,给出客观评测。