「从零训练」共找到 4880 篇相关文章
ICML 2025 Oral | 从「浅对齐」到「深思熟虑」,清华牵头搭起大模型安全的下一级阶梯
在大语言模型加速进入高风险应用场景当下,“安全对齐”是挑战。如今广泛采用的“浅对齐”脆弱不堪。清华团队提出STAIR框架,能提升开源模型鲁棒性,还推出RealSafe - R1模型进行安全对齐。
MCP实战|从0到1构建异步 DeepResearch 工具,支持进度推送与超时控制
本文借助开源项目,构建可在MCP Server中异步运行的DeepResearch,支持任务进度推送与超时控制。介绍项目架构、构建步骤、任务管理器实现要点及效果测试,还提及优化方向并给出源码。
从「记忆解题」到「深度推理」:港科大推出首个本科数学动态评测基准 UGMathBench
港科大团队发表在 ICLR 2025 的研究 UGMathBench,是首个本科数学动态评测体系。它涵盖 16 个学科领域,通过变量扰动创建多版本试题,引入创新指标评估模型推理能力,测试结果揭示了当前模型短板。
从亚太到欧美,阿里云瑶池数据库凭何成为中企出海的技术底气?
在中企出海迈向‘深水区’时,阿里云瑶池数据库成关注焦点。它涵盖多版块,能提供全链路生命周期服务。对话负责人薛菲可知,其满足出海数据库需求,在多场景表现出色,融入AI能力,获国际认证,为中企出海提供底气。
从实验室到工厂:具身智能如何跨越商业化的“死亡谷”?|甲子引力X
4月28日「AI共潮生——2025甲子引力X科技产业新风向」大会上,五位嘉宾围绕具身智能分享见解。当前行业处概念到商用过渡期,梅卡曼德邵天兰等四位机器人领军人物探讨商业化路径,指出需聚焦场景、降成本、强技术可靠性。
浙大联合北大开源 Easel:一个 Agent 包办社媒全链路,从热点发现到多平台发布!
浙江大学和北京大学联合开源Easel,这是面向社媒创作者的内容工作台,用一个Agent打通全链路,有画像驱动等六大亮点,还给出清晰的快速上手流程。
半价干翻Fable 5?Opus 5实测炸场,网友:差点从椅子上摔下来
Anthropic新模型Opus 5登场,多项评测中追平或反超Fable 5,价格仅为一半。网友实测表现出色,还具备硬核自检流程,性价比高。另外,Claude Code提示词删减八成,成绩未降。
从数学思维到AI睡眠,于大川在千亿赛道的第二次“白魔法”创业|甲子光年
于大川曾创办豌豆思维,“双减”后他“半退休”。如今他重启创业,创立豌豆智能,想用AI改善人类睡眠。该公司已获君联资本天使轮融资,于大川分享了创业思路、产品模式、团队组建等内容。
HyperEyes:从「搜得更深」到「搜得更宽」,并行多模态搜索智能体的效率革命
小红书研究团队提出 HyperEyes 模型,打破现有多模态搜索智能体串行处理模式困局。通过全栈设计实现并行多模态搜索范式跃迁,在多基准测试中表现优异,证明准确率与效率可协同进化。
揭秘大模型Steering:从底层机理到系统评估,全面破解大模型行为控制之谜
近期《Science》研究表明可解析AI内部表征实现通用引导与监控。浙大联合阿里两篇ACL 2026主会论文,揭示Steering工作原理与能力边界,还开源一站式框架EasyEdit2,全面展示了Steering价值。