「无预训练模型」共找到 8581 篇相关文章
VLA别再「走神」:即插即用提升视觉泛化,相对Pi0.5提升18%
至简动力、北大、港中文团队发现VLA模型深层动作预测对关键视觉区域依赖下降,提出DeepVision - VLA框架,在仿真和真实任务中效果显著,能有效提升视觉泛化能力。
半夜被AI「吓醒」!57岁导师投奔24岁华人女学霸,打造「AI数学家」
57岁杰出数学家Ken Ono辞去终身教职,加入24岁学生Carina Hong创办的Axiom Math。Carina履历逆天,想打造「AI数学家」。Ken受研讨会冲击,看好AI数学潜力,将助力模型发展。
提示词分享:帮助在 Hacker News 或者 Reddit 这样的讨论贴中提取精华内容
分享了在 Hacker News 或 Reddit 讨论贴提取精华内容的提示词,介绍最佳模型为 Gemini 2.5 Pro,还给出角色定位、工作流程、写作风格技巧及禁止出现的表达方式。
普林斯顿发现RLHF显著加剧了LLM胡扯!
普林斯顿研究提出‘机器胡扯’概念,构建分析框架,含胡扯指数、行为分类法和评测集。实验揭示RLHF加剧胡扯,政治语境模型爱‘打太极’,为构建诚实AI提供工具和理论。
HarnessEval 来了!开启 RSI 时代的新评测范式!
过去一年AI进入RSI时代,但评测方式仍停留在过去。MirroS联合多方发布HarnessEval,将Harness引入评测领域,使评测成为具备自我进化能力的智能系统,还率先应用于交互式世界模型评测。
“Claude Skills很棒,可能比 MCP 更重要”
10月17日,Anthropic发布Claude Skills,是助其模型获新功能的模式。Claude用Skills可改进执行特定任务方式,且只在相关时调用。它易共享,可能比MCP更重要,实现依赖编码环境。
超越Runway!Adobe发布新神器:P视频比P图还简单
Adobe联合多高校推出AI模型EditVerse,它将图片和视频编辑整合,解决传统视频编辑复杂、数据稀缺问题。通过通用视觉语言、上下文学习能力和知识迁移,其效果超Runway,还展现涌现能力。
蚂蚁集团发布KAG-Thinker,多跳问答慢思考,医疗领域拿下87分
在LLM问答领域,多跳问题存在局限性,现有方法缺乏严谨性等。KAG - Thinker是基于KAG框架的模型,将复杂问题分解,通过多模块优化知识获取,在医疗领域实用,稳定性也出色。
生数科技按下B端商业化快进键:30天签约智谱、飞书等多家行业龙头|甲子光年
AI视频生成行业商业化加速,生数科技不到一周官宣与智谱、飞书等合作。其Vidu基座模型能力强,多领域开花,2025年Q1商业化增速快,还凭交付与服务能力获头部青睐。
6.2k 谷歌开源LangExtract,主打精确溯源的长文档抽取
谷歌开源 Python 库 LangExtract,能让 LLM 依用户指令从非结构化文档提取结构化信息。它可处理临床记录等,具备精确源接地、可靠输出等特性,支持多模型,无需微调,适用于各领域。