「超大上下文AI」共找到 10086 篇相关文章
曾拒15亿美金,超级天才Andrew Tulloch重返Meta,Thinking Machines Lab痛失联创
扎克伯格今年挖角动作不断,此前向Thinking Machines Lab开高价被拒,主角Andrew Tulloch曾拒绝超10亿美元报价。如今他离职将重返Meta,其加入能否为Meta超级智能注入新动力,值得期待。
刚刚,全球首个GB300巨兽救场!一年烧光70亿,OpenAI内斗GPU惨烈
为争夺有限GPU,OpenAI内部争斗激烈,2024年算力投入70亿美元仍不够。微软发布全球首台GB300超算专供OpenAI,可让万亿LLM数天训完。OpenAI建立资源分配机制应对挑战。
OmniHuman-1.5:让数字人拥有“思考”的视频生成新范式
现有视频数字人模型难捕捉角色本质,字节提出 OmniHuman - 1.5 框架。其核心创新是用 MLLM 提供语义引导、提出多模态 DiT 架构和伪末帧设计,使模型融合多模态信号,生成高质量角色动画。
ChatGPT又突发俩CEO了?纯属扯淡,根本啥大洗牌
The Verge报道,前Meta高管Fidji Simo将以应用线CEO身份接手ChatGPT等业务。这并非大洗牌,而是OpenAI强化产品端能力的举措。此次调整像架构重构,还可能带来商业化变化,也被视为IPO预备动作。
AMD苏姿丰公开怼扎克伯格!反对1亿年薪挖人,“使命感比钞票更重要“
AI人才争夺战激烈,Meta扎克伯格开1亿美元年薪挖人,AMD苏姿丰明确反对,称钱非最重要,使命感才是,还指出天价挖人会摧毁公司文化,AMD不靠此也吸引到人才。
GPT-5认为这个模型是开源界的Claude 3.5——陈天桥朋友圈里的 MiroMind ODR 让我眼前一亮
陈天桥用GPT - 5评测自家开源模型MiroMind ODR,让其应对复杂问题。GPT - 5评价该模型是“开源界的Claude 3.5”,其能力让GPT - 5“点赞”,有闭源模型稳定性和可用性,还具全开放架构。
【万字长文】Anthropic发布Prompt Engineering全新指南
Anthropic发布全新Prompt Engineering指南,涵盖元提示、模板等关键技术。介绍了prompt类型、必备要素,还给出优化技巧,如添加示例、思维链精炼等,涉及XML标签、链式提示等方法,也提及减少幻觉、提高一致性等内容。
JinaVDR: 一个图文混排文档搜索任务的基准集
现有文档检索基准大多只考虑纯文本,难以处理含图表等视觉信息的文档。JinaVDR 应运而生,它是图文混排文档搜索基准集,含多语言、多领域数据,可评估模型在复杂视觉文档的检索性能。
北大、蚂蚁三个维度解构高效隐私保护机器学习:前沿进展+发展方向
北大李萌课题组与蚂蚁集团研究者共同完成综述,从协议、模型和系统三个维度梳理隐私保护机器学习(PPML)领域,指出当前痛点,给出优化策略,还提出跨层级协同优化方向。
GAIR Live 预告|世界模型——通向通用智能的关键拼图
随着AGI议题升温,‘世界模型’成前沿焦点。GAIR Live将邀顶尖学者与专家,探讨其定义、趋势等问题,还有直播议题如Lecun观点看法、不同领域世界模型差异等。