「饿了么」共找到 5860 篇相关文章
什么时候不该微调:比“怎么微调”更重要的一件事
文章指出微调失败常因一开始就不该调。强调微调解决行为问题而非能力问题,还列举了不该微调的五种场景,如知识接入问题、Prompt没写好等,建议先验证思路,明确目标再行动。
GPT-5.3爆更前夜,全网都被一张图吓到!ChatGPT人格大赏
OpenAI华人研究员Joanne Jang一条推文引发ChatGPT生图玩法热潮,它能根据聊天记录生成反映‘待遇’的自画像。近期ChatGPT记忆功能优化,已向全球Pro和Plus用户推出。还有爆料称GPT - 5.3要来了。
LLM规划能力飙升79%!Google:内在自我批评技术拿下多项SOTA
Google DeepMind研究《通过内在自我批评提升大语言模型的规划能力》,不借助外部验证器,让LLM反复“自评+重写”,使Blocksworld准确率从49.8%升至89.3%,还介绍了方法及跨模型验证情况。
哈工大最新研究AI Meets Brain
传统大模型有“健忘”问题,哈工大《AI Meets Brain》研究借鉴人类记忆机制,为AI智能体打造强大记忆系统。研究涵盖核心洞察、记忆形态、分类框架等内容,还探讨了记忆赋能方式及未来发展方向。
医疗领域DeepSeek时刻:蚂蚁 · 安诊儿医疗大模型正式开源,登顶权威榜单
2026 年初,OpenAI 报告显示不少人用 ChatGPT 咨询医疗问题,还发布了 ChatGPT 健康。近日,蚂蚁集团等开源的蚂蚁・安诊儿医疗大模型或成最优解,它参数量大,在多评测中登顶,技术优势明显。
缩放定律Scaling正慢性死亡,算力收益递减,AI的下一个增长极是模型如何交互
前Google Brain科学家Sara Hooker论文指出,统治AI十年的缩放定律Scaling走向慢性死亡,算力收益递减,研究重点将转向推理时算力和模型如何交互,还分析了算力崇拜兴起、缩放法则裂痕及未来方向。
Qwen3-VL-Embedding系列上新:探索统一多模态表征与排序
2025年6月曾开源Qwen3-Embedding和Qwen3-ReRanker,现推出Qwen3-VL-Embedding和Qwen3-VL-Reranker。它们基于Qwen3-VL构建,能处理多模态输入,在多任务达业界领先,还介绍了特性、评测及使用方法。
阿里通义新年礼物:开源最强Qwen-Image-2512版本告别AI塑料感与文字乱码
通义万相新年前发布Qwen - Image - 2512版本。它是开源界最强文生图模型,在AI Arena盲测中表现出色。能消除AI塑料感,攻克文字渲染难题,在还原真实世界和重构视觉元素逻辑排版上有显著提升。
82岁退休的他,带出一系千亿级科技巨头
本文讲述了李国杰带领团队研发超算,创立中科曙光的历程。从“曙光一号”打破国外禁运,到中科曙光在芯片、智算等领域全面发展,虽遭美国制裁仍越打越强,李国杰82岁功成身退。
具身智能是泡沫还是前夜?两位学霸选择“上天”与“要脸” |5Y View
本期是五源合伙人孟醒与微分智飞高飞、首形科技胡宇航的对话。二人没选主流赛道,高飞要为飞行终端造‘具身大脑’,胡宇航给机器人‘脸面’,这是让机器人进化的尝试。