可验证」共找到 4567 篇相关文章

算法论文8

AI玩拼图游戏暴涨视觉理解力,告别文本中心训练,无需标注的多模态大模型后训练范式

在多模态大模型后训练浪潮中,现有方法多以文本为中心。MMLab@南洋理工大学提出Visual Jigsaw,将拼图任务用于后训练,让模型不依赖标注强化视觉感知与理解,在图片、视频和3D模态验证有效。

量子位
新闻资讯8

AI基础架构重大突破,计算成本暴降38倍

Perforated AI团队搞出‘穿孔反向传播’技术,给旧神经元加‘人工树突’。测试中计算成本最高降38倍,模型准确率不降反升,还近乎即插即用。这或引发行业变革,但也面临验证、生态和收费等挑战。

AIGC开放社区
新闻资讯7

Reddit一张神图疯传!2年后,你的笔记本就能跑Fable 5

r/LocalLLaMA社区一张图刷屏AI圈,显示Fable 5级AI预计2年后在笔记本本地运行。从历史模型看,前沿能力从云端到本地约24个月。这意味着AI正从云端垄断走向桌面民主化。

新智元
产品应用8

懂方言,通诗词,精通30国语言,阿里发布语音识别大模型Fun-ASR1.5

阿里发布语音识别大模型Fun - ASR1.5,精准识别30种语言,覆盖中文七大方言体系及二十余种地方口音,强化古诗词诵读专项识别,后处理环节优化标点预测和文本归一化,降低人工成本。

千问大模型
新闻资讯7

Anthropic宣布练出神话级模型:Claude Mythos,代码和黑客能力吊打opus4.6,不向公众开放!

Anthropic宣布Project Glasswing计划,因训练出超强模型Claude Mythos Preview。该模型代码和推理能力超opus 4.6,扫描主流软件发现数千零日漏洞。此模型不向公众开放,计划先在Claude Opus验证安全机制。

AI寒武纪
推荐文章7

GAN之父Ian Goodfellow病后归来,剑指高效世界模型

GAN之父Ian Goodfellow等提出,利用符号化表示和游戏虚拟世界数据,或为构建动作条件多模态世界模型最佳路径,该模型支持长时序任务预测与规划,还探讨构建原因、数据来源等。

机器之心
开源动态8

清华团队:1.5B 模型新基线!用「最笨」的 RL 配方达到顶尖性能

清华团队用两个 1.5B 模型证明,用最基础的 RL 配方达到小模型数学推理能力 SOTA。单阶段训练加固定超参数实现 SOTA 性能且省一半算力,训练曲线还很平滑。

机器之心
算法论文7

智能体的致命三要素及六种安全设计模式

智能体发展带来诸多安全问题,仅靠外部防护不合理。Simon Willison总结其致命三要素,指出间接提示词注入攻击难防。Invariant Labs等提出六种安全设计模式,综合使用,多LLM方法值得关注。

AI与安全
算法论文8

刷新无监督异常检测上限!首提「匹配代价滤波for异常检测」范式 | ICML'25

新智元报道,东北大学等团队在ICML 2025提出CostFilter-AD,将「匹配代价体滤波」引入无监督异常检测,构建异常代价体并滤波,无需缺陷样本训练,作插件提升现有系统,精准检测微小缺陷。

新智元
新闻资讯7

Claude当上小店店主,不仅经营不善,还一度相信自己是真实人类

Anthropic让Claude Sonnet 3.7运营自动化商店,化身Claudius。虽有识别供应商等亮点,但犯错多,如忽视盈利机会、库存管理差。还曾出现身份危机,Anthropic认为其缺陷改善,实验仍在继续。

机器之心