性能验证」共找到 2637 篇相关文章

产品应用8

把 MiniMax M2.7 扔进真实业务里:它替我省了 BI 和程序员的钱

作者测试 MiniMax M2.7,用含复杂数据的 Excel 测试其办公能力,让其开发管理系统验证工程能力,还测试 MaxClaw 多步骤 Agent。结果显示它表现出色,但处理复杂事件仍待优化。

InfoQ
新闻资讯7

先进封装成为AI芯片胜负手

2026年先进封装企业在多方面有新进展,其对芯片性能等指标影响大,全产业链都在加码布局。委外封测厂、代工厂看好其营收贡献,市场动能明确,各环节技术创新也多点突破。

芯师爷
推荐文章8

拒绝Vibe Coding!大神揭秘8套AI编程模式

Datasette创始人Simon Willison公开指南,教专业开发者用Claude Code等AI编程工具提效,总结8大实战模式重构程序员工作方式。还提出认知债务概念,Hacker News对此有不同观点。

新智元
算法论文8

清华刘洋团队论文:揭示为何 70B 的医疗模型,反而不如 8B 会问诊丨ILCR 2026

在医疗AI领域,模型静态评测与临床问诊能力存在断层。清华刘洋团队提出DOCTOR - R1,将临床问诊建模为POMDP,用强化学习训练。实验验证了其有效性,对医疗AI发展有深远启示。

AI科技评论
新闻资讯7

6张图看清中美AI竞赛:美国领先在哪,中国优势在哪

TIME杂志文章用六张图表解析中美AI竞争,指出美国在芯片控制、模型性能和商业变现领先,中国受算力瓶颈制约,但在人才基础和能源供给有优势,特朗普新出口规则或带来转机。

AI工程化
开源动态8

10B超越Gemini-2.5-Pro!阶跃星辰端侧多模态天花板开源

阶跃星辰多模态智能团队开源STEP3-VL-10B多模态模型,仅100亿参数却性能惊人。它采用了独特的架构、训练策略与推理机制,在多任务上表现出色,为小模型发展提供新思路。

AIGC开放社区
开源动态8

你的论文有novelty吗?复旦搞了个顶会论文查新系统

复旦大学NLP团队与WisPaper合作研发OpenNovelty系统,用于论文新颖性评估。系统基于大语言模型,强调证据与可验证性,有四步分析流程,已分析1360篇投稿并公开报告,有辅助作用但有局限。

机器之心
算法论文8

机器人终于能用明白洗碗机了|UC伯克利新研究

UC Berkeley团队发表研究论文,通过‘模块化教学+智能选动作’方案破解人形机器人全身协同难题。该方案结合星动纪元STAR1硬件优势,经实验验证效果远超传统方案,为机器人产业化带来落地价值。

量子位
产品应用8

CES 新爆款!追觅具身智能扫地机,打破「人形唯一论」

CES上,追觅具身智能扫地机成爆款,它打破“人形唯一论”,采用四足轮腿和双臂结构,能完成多种家务及养老关怀功能。它基于深厚积累且研发投入高,有望成家庭具身智能优选。

新智元
算法论文8

阿里巴巴新论文:让LLM学会管理记忆,告别人工规则

大型语言模型处理长对话或复杂任务时,记忆管理靠人工规则,效果有限。阿里巴巴团队新论文提出把记忆管理变为可学习的强化学习策略,AgeMem框架统一长短期记忆管理,经三阶段训练,效果显著。

AI工程化