「多模型兼容」共找到 9884 篇相关文章
Google | 发布革命性编码智能体:AlphaEvolve,突破数学极限!
DeepMind 发布由 LLMs 驱动的进化编码智能体 AlphaEvolve,能演化代码库用于算法发现和优化。它结合 LLM 创造力与自动化评估,减少幻觉,在谷歌计算生态、数学算法等多领域有巨大应用潜力。
刚刚,DeepMind通用科学智能体AlphaEvolve突破数学极限,陶哲轩合作参与
DeepMind发布革命性进化编码智能体AlphaEvolve,由LLMs驱动,可演化代码库、发现和优化算法。它结合LLM创造力与自动化评估,减少幻觉,在多领域应用前景大,还与陶哲轩合作探索数学应用。
100万美元图灵奖奖金,强化学习师徒想献给科研自由
3月5日,Andrew Barto和Richard Sutton因强化学习获图灵奖。Communications of the ACM对其采访,谈及研究经历与AI未来。100万美元奖金用途未明,Sutton或捐Openmind,Barto计划设奖学金。
面对MCP"工具投毒",我们该如何应对
近期MCP爆火但安全风险显现,安全机构指其有严重漏洞,会致‘工具投毒攻击’。本文介绍通过客户端/服务器代码复刻攻击过程,剖析MCP客户端和服务端安全风险,还给出阿里云的两种安全监控方案。
LLM学习笔记:最好的学习方法是带着问题去寻找答案
文章总结拓展Andrej Karpathy教学视频,分析大模型聊天流程与原理,介绍LLM训练步骤,包括预训练、后训练和强化学习,还提及主流特性应用,如文件上传、网络搜索,强调带问题学习的重要性。
Claude网页版接入MCP!10款应用一键调用,开发者30分钟可创建新集成
Claude网页版接入MCP,集成10款应用,开发者30分钟可创建新集成。同时Research功能更新,增加更多数据来源,网页搜索功能面向付费用户开放。MCP逐渐成为行业标准,引发对大模型SaaS时代的讨论。
Harness已过时,OpenAI、腾讯在搞下一个AI爆点RSI
本文解读Theseus Labs发布的RSI行业分析报告,该报告汇总全球72家头部AI团队公开资料,提出RSI五级自主权框架与HCI评估指标,梳理大厂进展与产业落地实践。
对比 Codex,免费的 AgnesCode 也能在底层算子优化任务中打的有来有回
本文实测免费AI Coding Agent AgnesCode搭配Agnes 3.0 Flash,对比付费Codex组合在DeepSeek-V3底层算子多芯片优化任务中的表现,验证免费Agent胜任底层AI工程的能力,分享实测数据与行业洞察。
美国拟封堵中国AI海外算力通道,东南亚数据中心或受审查
据报道,特朗普政府起草新出口管制规则,拟限制中国企业远程调用第三国先进AI服务器。规则或与Kimi K3模型有关,美国试图将硬件控制延伸到算力使用权,但面临法律界定、执行等难题。
苹果新作:内化视觉思考,推理提速 5 倍
Apple研究团队提出Internalized Visual Thinking(IVT),一种将预测性世界建模能力内化到模型表征中的后训练框架。它在训练时预测未来,推理时直接回答,相比Visual CoT推理提速超5倍。