「可灵3.0 Omni」共找到 6170 篇相关文章

算法论文8

Skills刚火,就有零Skill的Agent来了…

Skills爆火之际,云玦科技团队提出不用Skills的零Skill Agent。它以Gemini 3 Pro为后端,在多个评测集表现出色。采用原位自进化框架,开源且成本低,或助力开源模型弯道超车。

量子位
开源动态8

你的论文有novelty吗?复旦搞了个顶会论文查新系统

复旦大学NLP团队与WisPaper合作研发OpenNovelty系统,用于论文新颖性评估。系统基于大语言模型,强调证据与可验证性,有四步分析流程,已分析1360篇投稿并公开报告,有辅助作用但有局限。

机器之心
新闻资讯8

李飞飞的World Labs联手光轮智能,具身智能进入评测驱动时代!

李飞飞旗下World Labs与光轮智能联手,瞄准具身智能「规模化评测」问题。World Labs的Marble是生产力工具,而光轮智能有自研仿真技术体系,双方合作让规模化评测成为可能,具身智能迈入评测驱动时代。

量子位
算法论文7

腾讯LLM团队:对下一个 Token 预测的深入剖析,多样性 or 精准度?

最新研究证实RL能增强LLM推理,但成效受限预训练token分布。腾讯LLM部把交叉熵重写成单步策略梯度,用超参压熵,为RL打造‘低熵高信号’起点,经实验验证低熵模型优势明显。

PaperAgent
算法论文8

重复一下提示词,Gemini准确率竟从21%飙升至97%!

Google Research团队研究发现,重复提示词可让Gemini准确率从21.33%升至97.33%。该策略能提升主流大模型非推理任务表现,在多模型多基准测试中优势明显,且不增加延迟。

AIGC开放社区
产品应用7

SDD 如何在复杂业务系统中真正落地?

文章围绕SDD在复杂业务系统落地展开,介绍OpenSpec库使用,对比与系分差异,分析其优势与问题,如LLM与IDE执行能力鸿沟、无update命令等,还对比OpenSpec和GitHub Spec Kit,并给出流程及提示词。

阿里云开发者
7

实测夸克「千问划词快捷指令」,这7个邪修Prompt,建议收藏

新年 DeepSeek 发布技术论文,网友难理解便求助 AI。夸克 AI 浏览器更新,‘千问划词’支持自定义快捷指令,实测精选 7 类实用指令,还介绍了操作方法,且其功能不断进化。

机器之心
开源动态8

Transformers v5 中的分词系统:更简洁、更清晰、更模块化

文章聚焦 Transformers v5 分词系统,介绍分词概念、流程、主流算法,对比 transformers 和 tokenizers 库。着重讲 v5 改进,如架构与词表分离,解决 v4 黑盒问题,还能从零训练专属分词器。

Hugging Face
开源动态8

顶尖AI竟输给三岁宝宝,BabyVision测试暴露多模态模型硬伤

UniPat AI 等发布多模态理解评测集 BabyVision,测试显示多模态大模型纯视觉能力仅达三岁幼儿水平。其通过对比实验、细分任务评测,揭示模型系统性缺基础视觉能力,还给出新方向及发展建议。

AINLPer
算法论文8

梁文锋署名!DeepSeek再发炸裂论文:提出“条件记忆”新范式,彻底打破GPU推理显存墙

来自DeepSeek的新论文提出“条件记忆(Conditional Memory)”新范式,推出Engram模块,实现可扩展知识查找。研究揭示U形缩放定律,构建的Engram模型性能超越纯MoE基线,还打破了GPU显存瓶颈。

AI寒武纪