批不变性」共找到 1344 篇相关文章

开源动态8

Nature点赞!哈佛MIT最新作:AI科学家时代来了

哈佛MIT推出ToolUniverse,这一开源框架让AI用自然语言操作600+科学工具,解决了科学研究中AI智能体面临的工具格式统一等问题,推动科研自动化升级,助力打造AI科学家。

新智元
推荐文章7

AI时代,MrBeast和影视飓风教我的事:最好的内容都是无用的

文章借罗永浩与影视飓风Tim对谈引出话题,以MrBeast、迪士尼为例,阐述最好的内容无用,其价值在于创造体验、建立信任、打造IP。还指出AI时代,无用内容因可替代更具商业价值。

花叔
新闻资讯7

以后手机用插卡了?eSIM手机来了!

近期eSIM手机成热点,它用电子化数据文件替代物理卡片,无需插卡就能开通网络服务,让设备更轻薄。三大运营商获eSIM手机商用试验复,暂支持线上办理,苹果、华为等厂商机型将上市。

街头巷尾
算法论文8

NeurIPS 25 | GRPO进阶版来了,GVPO重构大模型后训练范式

大模型后训练越发关键,GRPO 有缺陷。作业帮与香港科技大学(广州)团队在 NeurIPS 2025 提出 GVPO 方法,解决 GRPO 稳定性难题,理论有最优解保证,实验表现超现有方法。

机器之心
推荐文章7

从组件到系统,Agent 的 Evaluation 怎么做?

Agentic AI 兴起使 Agent Evaluation 成热点。评估 Agent 与 LLM 有本质区别,Agent Evaluation 要考察系统在动态环境实现目标的综合表现,传统 LLM 评估方法无法沿用。业界涌现 GAIA 等相关工作,评估范式也在断演进。

机器之心
算法论文7

这次,LLM黑盒被LLM打开了~

随着大语言模型(LLM)能力提升,其内部机制更透明。概念描述新范式用另一个 LLM 自动生成自然语言解释。介绍了描述对象、生成方法、评估指标,还提及社区关注方向,指出结合多种手段才能把解释变知识。

PaperAgent
新闻资讯8

DeepSeek-R1登顶Nature,8位专家严审通过, 大模型「交卷时刻」来了

近日,DeepSeek - R1登上Nature封面,打破主流大模型未经过独立同行评审惯例。同行评审可理清模型机制,提升透明度与可信度,还能避免‘刷榜’‘自评’,虽有公司担心泄密,但它是验证成果的必要程序。

新智元
产品应用8

大模型虽好,但恕我直言:在OCR面前,开源小模型更香

作者所在公司项目需处理大量纸质文档,起初考虑云端大模型API调用和开源大模型本地化部署,却因成本高、硬件要求高受阻。后经推荐调研PaddleOCR,其功能全、成本低、易用性强,最终被选为项目核心方案。

PaperAgent
新闻资讯7

突发!Anthropic “封杀”中国控股公司,禁止其使用Claude等AI服务

9月5日,Anthropic公司宣布禁止多数股权由中国资本持有的集团或其子公司使用Claude,政策调整涉及“直接或间接由中国实体控制(占股比例超过50%)”的企业,也适用于俄、伊、朝等国。

AI前线
推荐文章7

LLM遇上表格:4类表示、5大任务、3大机会

文章指出LLM处理表格有任务单一、输入复杂易崩、表示统一痛点,介绍4种表格输入表示法、5大任务,还发现任务复杂度、输入复杂度及表示统一方面存在新研究机会。

PaperAgent