十杯马天尼问题」共找到 383 篇相关文章

算法论文7

VL-LN Bench:模拟「边走边找具体目标」的真实导航场景

上海人工智能实验室等研究者完成VL - LN Bench,模拟真实导航场景。它构建自动化数据收集管线,依托InternVLA - N1训练评测。结果显示主动对话可提升表现,但当前方法在实例感知对齐等环节有短板。

机器之心
产品应用7

你们了一万遍的票据风图片提示词,它终于来了!

文章分享票据风图片提示词,还将此风格打包成 Skills。该 Skills 能批量为文档生成配图和封面,有多种格式、分辨率等选项,内置三套风格,还介绍了安装和使用方法。

歸藏的AI工具箱
新闻资讯7

快答|AI都会写代码了,还要不要报考计算机专业?!

在AI大模型能写代码的背景下,InfoQ采访王昊奋、谭晓生、邹欣,探讨高考是否报考计算机专业。他们就专业前景、核心价值转变、核心能力等发表看法,还提及课程调整和其他专业选择。6月30日直播将深入探讨。

InfoQ
算法论文8

竞赛编程Agent进入全球前!南大、清华新模型CF rating超3500

大语言模型在竞赛编程场景易失败。南大、清华等研究者提出Solvita框架,由四个角色形成闭环,构建可训练图结构知识网络积累经验。实验显示其在多评测中表现强,提升不靠增加token。

新智元
产品应用8

智谱开启狂飙模式!7倍提速,全球最快,旗舰模型即即答

5月22日,智谱上线GLM - 5.1高速版API,输出速度达400 tokens/s,刷新全球大模型API速度纪录,比原版提速约7倍。该速度由GLM团队和TileRT团队联合打造,核心优化分三层推进,且是稳定可用的生产级能力。

AIGC开放社区
算法论文8

CVPR 2026|AI开始会拍电影了:一分钟镜头,全程不崩剧情

多镜头视频生成要求模型处理不同镜头间稳定信息和变化信息,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,建立跨镜头记忆机制,设计关键模块,实验表现好,为视频生成打开新可能。

机器之心
推荐文章7

Karpathy:别再AI「你怎么看了」,这是错误的提示词策略!

Andrej Karpathy提出不要把大语言模型看作实体,应视作模拟器。他建议探索话题时避免用‘你怎么看’提,给出‘什么样的一群人适合探索,他们会怎么说’的更优策略,还指出不同领域影响有别。

AI寒武纪
推荐文章7

中学生就能看懂:从零开始理解LLM内部原理【】| “过拟合” 与 Dropout

文章围绕神经网络过拟合题展开,介绍了过拟合的概念、危害及产生原因,阐述了缓解过拟合的正则化方法,重点介绍了Dropout随机失活,还指出其局限性及在大模型中的应用策略。

AI大模型应用实践
产品应用8

刚刚,Anthropic公布Fable 5.1保姆级使用技巧,看完少走天弯路

Claude Fable 5.1虽可兼容旧版提示词,但行为习惯有变化。官方整理提示词与工程落地指南,涵盖思考程度、工具调用进度汇报、独立工具批量调用等多方面使用技巧和避坑细节。

AI寒武纪
新闻资讯7

Claude Sonnet 5 上线一日差评刷屏:打不过千和 Minimax,性价比全面翻车

Claude Sonnet 5发布一天差评多。虽官方定位高,有能力亮点,但在中文测评中性价比低,测试成本高,且Max推理模式易过度思考。还因过度保守失去实用价值,其表现取决于使用场景和预算。

AI科技评论