「预训练策略」共找到 2851 篇相关文章
阿里王牌Agent横扫SOTA,全栈开源力压OpenAI!博士级难题一键搞定
阿里昨晚开源通义DeepResearch,在多项权威基准上表现出色,超越OpenAI、DeepSeek。模型、框架、方案全开源,开发者可在相关平台下载。它告别一问一答模式,像研究员一样工作,还构建了独特数据体系。
Transformer作者:DeepSeek才有搞头,OpenAI指望不上了
Transformer发明者Ashish Vaswani认为OpenAI等闭源厂商被商业化冲昏头脑,没心思做基础研究。他All in基础研究,坚持开源路线,想打造西方世界的DeepSeek。其团队论文提出颠覆性观点,或降低训练成本。
开放全栈!超越π0,具身智能基础大模型迎来真·开源,开发者狂喜
继π0后,具身智能基座模型WALL - OSS正式开源,多项指标超越π0。它是通用多模态具身模型,具良好推理和泛化能力。背后自变量机器人刚完成近10亿A + 轮融资,开源将降低具身智能门槛。
港科广×腾讯联手打造《我的世界》神操作,400张截图就能让AI挖矿通关,成本降至5%|EMNLP 2025
港科广与腾讯联合团队提出VistaWise框架,将“跨模态知识图谱+轻量化视觉微调”引入开放世界智能体。实验显示其在“获取钻石”任务表现出色,成果被EMNLP 2025主会录用。该框架以低成本、跨模态为突破口。
《“人工智能+”行动意见》深度解读:从人口红利到智能红利,中国经济社会变革新引擎
《“人工智能+”行动意见》是全面重塑中国经济、社会与治理体系的国家战略。它以应用促创新,定位AI为新质生产力关键引擎,涉及多领域变革,还采取不对称竞争策略,应对国际博弈。
字节突然开源Seed-OSS,512K上下文碾压主流4倍长度!推理能力刷新纪录
字节跳动突发开源360亿参数的Seed-OSS-36B,呼应OpenAI开源策略。它有512K超长上下文,引入“思考预算”机制。多项基准测试达开源SOTA,字节Seed团队此前也开源多个项目。
小扎又开源了:7B实现自监督学习SOTA
Meta发布全新开源视觉模型DINOv3,首次证明自监督学习模型能在广泛任务中超越弱监督学习模型。它用无标注方法,扩展数据和模型规模,支持标注稀缺场景,在多任务实现SOTA。
首个开源多模态Deep Research智能体,超越多个闭源方案
首个开源多模态Deep Research Agent登场,整合多种工具并优化决策。其WebWatcher技术方案覆盖全链路,实验中在四大核心领域领先主流模型,展现复杂推理和信息检索实力。
OpenAI夺金IOI,但输给3位中国高中生
OpenAI官宣其推理模型在今年IOI线上竞赛中成绩刷新纪录,总分533.29,全球330名人类选手中排第六,AI参赛者中居首。不过其没比过三位中国高中生。此前OpenAI称模型获IMO金牌引争议,此次网友更谨慎。
AI公务员上线!OpenAI为全美国联邦政府提供ChatGPT,每年只收1美元
今天凌晨,OpenAI联合创始人宣布与美国联邦政府达成合作,为各机构提供ChatGPT服务,每年仅收1美元。此为《美国AI计划》一部分,能实现政务流程自动化,还保障数据安全。