多领域推理」共找到 6435 篇相关文章

开源动态7

一夜之间,Claude Code删掉了80%系统提示词

本周五,Anthropic 技术团队成员 Thariq Shihipar 介绍新一代大语言模型工程趋势变化。Anthropic 发现旧提示词工程范式在新一代强推理模型发布后或过时,新的 Claude.md 应精简,大砍系统提示词后可把特定任务上下文交给 Skill。

机器之心
算法论文8

YOLOv8-SST:水面小目标检测极致改进,降低漏检

浙江水利水电学院董慧贞团队提出YOLOv8 - SST算法,针对水面小目标检测的噪声干扰、定位不准、泛化能力弱三大痛点分别改进。经实验,该算法提升了检测精度,推理速度也能满足实时需求,还给出了实战代码。

机器学习AI算法工程
开源动态7

骨灰级克隆网站设计的开源项目

现在克隆网站设计常停留在截图和吸色,难以完全还原。designlang 项目用无头浏览器打开 URL,从实时 DOM 读取设计系统,输出个文件,还能做到布局模式等其他提取器做不到的事。

GitHubStore
新闻资讯7

说一个反常识的真相,Agent如今在真实工作场景的成功率依然很低。

作者有感于AI在真实工作场景评测的稀缺性,以阿里国际站RealReplicaBench评测集为例,介绍电商场景任务,发现数模型成功率低,其他领域类似,呼吁厂商努力,作者也计划自跑评测更新排名。

数字生命卡兹克
开源动态8

能让DeepSeek自进化的Harness!LlamaFactory作者开源新工具:0.2元自动造Agent

LlamaFactory作者郑耀威团队开源的PenguinHarness,是全球首个支持Agent自进化的Harness,能自动构建、评测和改进Agent。它成本低、速度快,适配众模型,还有严格契约保障安全。已在生产场景应用,效果显著。

机器之心
算法论文8

ICML 2026 | Agentic强化学习训练的信息自锁问题

随着大语言模型走向真实交互,强化学习训练LLM agents时出现信息自锁问题。香港中文大学等研究者分析其原因并提出AREW方法,在场景实验中表现稳定且具鲁棒性。

机器之心
产品应用7

千元手机也能离线爽跑谷歌Gemma 4,太酷了!

谷歌推出开源APP `Google AI Edge Gallery`,可在手机离线运行开源大模型,如Gemma 4。它数据不出本地,玩法,支持中文交互。虽有局限,但已超模型演示范畴,展示AI本地智能趋势。

开源先锋
开源动态8

开源模型首超Opus4.6!智谱GLM-5.1登场,14小时后CUDA专家被冲了

智谱开源模型GLM - 5.1带来重大突破,14小时完成CUDA Kernel优化,加速比大幅提升。它解锁与顶尖闭源模型Claude Opus 4.6全面对齐,在测试中表现优异,展现长程任务能力,改写行业叙事逻辑。

量子位
算法论文8

王兴兴署名,宇树机器人春晚之后又进化了:单个策略就能学习各种极限动作

春晚上,宇树机器人展现高动态、高协同的全自主集群控制技术。现在,机构提出 OmniXtreme 通用策略,可执行各种极限动作。该框架分两阶段,经测试在仿真和现实中表现出色,打破了泛化壁垒。

机器之心
产品应用8

谷歌新模型登顶Nature,人类基因密码被解码

谷歌推出全新AI工具AlphaGenome,能精准预测人类DNA序列变异对调控基因生物过程的影响。它满足项条件,在26个变异效应benchmark中25个达SOTA,还通过个案例和实验验证了其性能。

PaperAgent