「多语言数据集」共找到 6580 篇相关文章
马斯克诉OpenAI案终落幕:1500亿索赔因“告晚了”被驳回
2026年5月18日,“马斯克起诉OpenAI”案裁决,OpenAI无需担责,马斯克诉求被驳回,原因是诉讼时效已过。这场官司拉扯两年多,索赔从数十亿增至1340亿美元。庭审暴露双方问题,后续资本战将开启。
大厂代码库几百万行,Claude Code怎么跑起来的?Anthropic首次公开全套打法
Anthropic发布文章总结Claude Code在企业规模部署的最佳实践。Claude Code导航类似软件工程师,与RAG驱动工具不同。其harness由多扩展点组成,在部署中有三种常见配置模式,还给出应用建议。
别再错过啦,AI Agent记忆革命:95.2%检索率的持久记忆系统深度解析
agentmemory是为AI编码Agent打造的持久记忆系统,能自动捕获操作上下文,有三层搜索与四层记忆架构。支持12+种主流AI Agent,有全平台覆盖、零外部依赖等优势,虽有局限但值得开发者一试。
多模态大模型别盲目刷题!诊断-生成-强化闭环,找准盲点 | ICML'26
多模态大模型训练常采用‘题海战术’,存在能力诊断不精准、视觉内容缺乏扩展等问题。北大和山大团队提出DPE框架,通过‘诊断-生成-强化’闭环提升模型能力,实验效果显著,还强调训练应具备诊断能力。
20美元,扒掉AI安全底裤!智能体2小时,攻破160亿美元巨头
红队安全创业公司CodeWall的AI智能体,花20美元Token费、运行2小时,自主选麦肯锡为目标,攻破其「数字大脑」Lilli,获4650万条聊天记录等读写权限,暴露AI安全隐患。
LeCun炮轰Hinton:他认可LLM就是想摆烂退休了!
Yann LeCun在播客专访中火力全开,炮轰Hinton认可LLM是想摆烂退休,直言LLM不是通往智能的路,还吐槽Meta卷入LLM竞赛后无法专注研究。他介绍了新公司AMI和世界模型、JEPA等技术,认为JEPA类世界模型五年内将统治AI圈。
2篇最新Anthropic论文,揭开LLM对齐新范式
Anthropic在5月连发两篇研究,揭示LLM对齐训练新范式。指出单纯模仿正确行为不足以保证安全,需在预训练与对齐微调间插入教原理阶段。研究围绕Claude模型展开,有多项关键发现,MSM方法效果显著。
拒掉字节、谷歌橄榄枝,Meta 离职大佬田渊栋官宣自立门户!苏妈老黄追着投
Meta离职大佬田渊栋官宣创业,新公司Recursive Superintelligence首轮融资6.5亿美元,估值46.5亿美元。其团队堪称“硅谷AI梦之队”,想让AI具备“自我进化能力”,目标是扩展到多领域。
同一天两件大事!小模型直接掀翻千亿参数,走向效率为王
5月13日AI圈有两件大事,何恺明团队发布语言模型ELF,面壁智能开源MiniCPM-V 4.6。二者显示AI正从‘堆算力’转向‘省算力’,拉开AI轻量化浪潮序幕,未来小模型或成关注方向。
林俊旸果然创业了!一个“Qwen负责人”头衔值135亿
前阿里千问大模型负责人林俊旸离职后创业,种子轮目标估值20亿美元。他曾深度参与阿里多个大模型项目,离职首篇长文提出“Agentic Thinking”,或为创业方向。