统一表示学习」共找到 2047 篇相关文章

算法论文8

纯靠“脑补”图像,大模型推理准确率狂飙80%丨剑桥谷歌新研究

剑桥、伦敦大学学院和谷歌团队推出基于强化学习的视觉规划(VPRL)新范式,纯靠图像推理。新框架利用GRPO后训练,准确率达80%,超文本推理至少40%,代码已开源。

量子位
开源动态7

微软重磅开源 Copilot!64 岁 VS Code 创始人亲口承认:眼红 Cursor,但真正价值在后端,它“抄”不过去!

在 Build 2025 开发者大会上,微软正式开源 GitHub Copilot Extension for VS Code 项目。VS Code 创始人 Eric 表示眼红 Cursor,认为真正价值在后端。微软认为现在开源时机成熟,希望复制 VS Code 开源成功路径。

InfoQ
推荐文章7

如果你的大学不提供 Token,应该立即退学

本文站在学生角度探讨 AI 时代大学生学习问题。认为高校在 AI 教育上滞后,不提供 Token 不合理。强调学生应善用 AI,具备问题意识、判断力和品味,还给出了使用 AI 的具体建议。

特工宇宙
新闻资讯7

Cloudflare 推出 Agent Tracing:支持截断限制,不同框架的 Payload 默认记录策略存在差异

Cloudflare推出Agent Tracing,可提供统一Dashboard查看已部署Agent会话。该功能在现有Workers Tracing基础上增加Agent级别的Span,有收费时间表。不同框架Payload默认记录策略有差异,Trace有截断限制。

InfoQ
新闻资讯8

70亿美元!全球最大「Token中转站」OpenRouter被收购

据Bloomberg爆料,16日Stripe敲定收购OpenRouter,超70亿美元。其创始人有成功经验,平台凭借统一API聚合AI模型受开发者青睐,业务增长快,已成AI行业“温度计”,Stripe借此掌控AI调用收支口。

新智元
算法论文8

清华唐杰团队揭示大模型记忆全景

清华唐杰教授团队等发布大模型记忆架构综述,提出三维记忆分类学,将前沿工作统一到理论框架,为LLM设计指明方向,分析了隐式、显式记忆架构,还探讨混合架构挑战与未来方向。

量子位
开源动态8

一个开源平台,编织起了Agent「互联网」

如今 Agent 单体能力强但系统分散,开源平台 Octo 应运而生。它由明略科技打造,可聚合 Bot,让其成为企业级资产。Octo 重写协作,有 Matter 沉淀任务,塑造 Taste 让 Agent 更懂用户,还有六种协作模式。

机器之心
产品应用7

Cursor Composer 2.5 拆解:最强大的 RL 环境,就是你自己的产品

今年5月,Cursor推出Agentic编程模型Composer 2.5,相比前代能力更强、成本效率更高。Cursor研究负责人认为最强大的RL环境就是自己的产品,文中还介绍了Composer 2.5训练方式、面临的挑战及解决办法等。

Founder Park
算法论文8

10万token自然语言推理,让30B-A3B模型站上奥赛金牌线

上海人工智能实验室报告显示,30B - A3B规模的SU - 01模型不依赖外部工具,经训练在IMO、USAMO、IPhO等奥赛评测达金牌水平。研究还验证更高效科学推理系统路线,有望用于更多科学问题。

机器之心
算法论文8

多模态大模型别盲目刷题!诊断-生成-强化闭环,找准盲点 | ICML'26

多模态大模型训练常采用‘题海战术’,存在能力诊断不精准、视觉内容缺乏扩展等问题。北大和山大团队提出DPE框架,通过‘诊断-生成-强化’闭环提升模型能力,实验效果显著,还强调训练应具备诊断能力。

新智元