「人类在环」共找到 8668 篇相关文章
Visual Studio 正式支持 MCP
2025年8月微软宣布模型上下文协议(MCP)在Visual Studio正式可用,为AI智能体与外部工具连接提供一致协议。开发人员可配置文件连接,管理员能管理使用。但存在限制和安全风险。
一篇120页AI4Research(科学研究AI)最新系统性综述
为填补AI在科学研究应用缺乏全面综述的空白,提出AI4Research调查。其主流流程和分类分五个关键领域,各领域细分任务,凸显AI在研究中多样角色,还介绍多学科应用。
ACL 2025 | 大语言模型正在偷改你的代码?
本文聚焦大语言模型在代码推荐中的「供应商偏见」,通过分析7个主流大模型在30个场景的59万次响应,发现模型会偏好特定供应商,甚至擅自修改代码,还探讨了风险、局限并给出展望。
Agent 元年,小厂碎步快跑反超
2025 年被视为 Agent 元年,AI 从“助手”走向“员工”。飞猪“问一问”出圈,虽小厂在模型、技术上不占优,但 AI Agent 落地门槛降低,小厂抓住场景和体验,或在 AI 时代弯道超车。
重复一下提示词,Gemini准确率竟从21%飙升至97%!
Google Research团队研究发现,重复提示词可让Gemini准确率从21.33%升至97.33%。该策略能提升主流大模型非推理任务表现,在多模型多基准测试中优势明显,且不增加延迟。
谷歌AlphaEvolve太香了,陶哲轩甚至发了篇论文,启发数学新构造
著名数学家陶哲轩与 Google DeepMind 研究人员发表论文,展示谷歌 AlphaEvolve 作为工具可自主发现新数学构造,该系统结合 LLM 与进化计算,在多领域问题上表现出色,还能与其他 AI 工具结合。
斯坦福新论文:微调已死,自主上下文当立
斯坦福大学等机构研究人员新论文指出,依靠上下文工程,无需调整权重,模型也能变聪明。他们提出智能体上下文工程ACE,不依赖模型重训,让上下文自主进化,在多场景测试中表现优于多种方法。
Claude Chrome 插件使用体验:强大,但有点慢
作者分享Claude for Chrome插件使用体验,介绍使用流程,测试让其查看马斯克推文,结果准确。该插件能力强且通用,但存在慢、焦点抢占问题,还提到与deepresearch及云厂商设备的差异。
首个地球科学智能体Earth-Agent来了,解锁地球观测数据分析新范式
上海人工智能实验室与中山大学联合研发的 Earth - Agent 解决了多模态大语言模型用于地球科学研究的痛点。它将领域知识工具封装化,利用 LLM 智能规划调度。经 Earth - Bench 评估,其在多方面表现出色,未来发展前景广阔。
数据库厂商入局AI又有新思路,OceanBase选择“卖铲子”
国产数据库厂商 OceanBase 入局 AI 有新思路,近期动作频频。其云数据库业务 OB Cloud 实现 AI 能力开发部署并与多平台集成,已在多行业落地。副总裁尹博学谈其 AI 战略逻辑、面临挑战及未来趋势等。