「子模型构建」共找到 8883 篇相关文章
yann lecun(杨立昆)新公司AMI融资10亿美元,要做LLM的替代品
Yann LeCun离开Meta后与Alexandre LeBrun创立AMI Labs,获10.3亿美元融资。他们认为LLM有幻觉问题,AMI Labs用JEPA架构构建‘世界模型’,代码和论文将开源,不过短期内无产品和收入。
字节清华智能体自动写CUDA内核,比torch.compile加速2.11倍
字节Seed与清华AIR团队开源CUDA Agent,在GPU内核优化基准KernelBench上成绩优异。它是大规模智能体强化学习系统,训练数据经多阶段构建,分阶段训练,全面超越商业模型,还开源了训练数据集。
刚刚,DeepSeek全新多模态技术开源!
DeepSeek联合北大、清华开源多模态技术及论文,提出“视觉基元推理”框架,解决MLLM指代鸿沟问题。基于DeepSeek - V4 - Flash构建的模型,性能比肩GPT - 5.4等。论文还介绍架构、训练流程等。
性能飙升42%!人大&字节开源10万级 SWE数据集 Scale-SWE
近期,人大和字节开源10万级软件工程数据集Scale - SWE,用首创工作流从GitHub构建真实数据。基于此微调的Qwen3 - 30A3B - Instruct模型测试表现佳,其数据相比合成数据优势明显。
两周干成一天!毕马威用100页Prompt落地企业Agent
毕马威打造税务AI助手TaxBot,将两周的专业咨询工作缩至一天,效率提升超10倍。其构建KPMG Workbench平台,集成多模型,用100页Prompt指导学习,未来或采用Agent Runtime服务。
JinaVDR: 一个图文混排文档搜索任务的基准集
现有文档检索基准大多只考虑纯文本,难以处理含图表等视觉信息的文档。JinaVDR 应运而生,它是图文混排文档搜索基准集,含多语言、多领域数据,可评估模型在复杂视觉文档的检索性能。
昨晚,云计算一哥打造了一套Agent落地的「金铲子」
亚马逊云科技在纽约峰会推出全新 AgentAI 方案,涵盖开发架构、多模型支持及多种工具升级。如 AgentCore 改变开发规则,Strands Agents V1.0 降低多 Agent 协作门槛,还推出 Kiro 等应用,推动 Agentic AI 落地。
北航LiveRepoReflection: 扭转乾坤-仓库级代码反射
本文提出LiveRepoReflection基准,评估多文件仓库代码理解和生成能力,含1888个测试案例。创建RepoReflection - Instruct数据集训练RepoReflectionCoder,评估40多个LLMs,结果显示其能有效测模型反思修复能力。
Karpathy投了一家AI记忆公司,撞名DeepSeek Engram记忆架构
新公司Engram完成9800万美元融资,投资人有Andrej Karpathy等。它想为AI构建能持续学习的“记忆层”,解决模型吸收组织内部知识问题,首个产品是面向Agent的API,已与多家合作。
震撼发布!最大人体动作数据集 MotionMillion 正式登场
上海交通大学研究团队构建高效标注流程,发布最大人体动作数据集MotionMillion,含超2000小时、200万条文本 - 动作配对数据。还推出评测体系MotionMillion - Eval,训练70亿参数动作生成大模型,刷新SOTA。