「传统软件测试」共找到 3164 篇相关文章
视频模型也能推理,Sora2推理能力超过GPT-5
DeepWisdom团队研究发现视频生成模型能推理,在空间类任务上比图文模型更擅长。团队推出VR - Bench基准测试,构建客观评分体系。实验显示视频模型在空间推理有优势,相关代码和数据集已开源。
机器人手画圆圈,怎么就成为了一大难题了?
华人研究者 Tom Zhang 所在的 DaxoRobotics 团队推文称其机械手花两天画出圆圈,这或为机器人手首次画圈。该机械手用柔性手指夹笔画圆,靠肌腱控制,传统求解器难应对,还具超人类灵活性。
从Manus热潮看中国科技出海:新加坡能否成最佳首站?
AI Agent 公司 Manus 将总部迁至新加坡,凸显其优势。白鲸开源创始人郭炜分享中国科技企业出海经验,对比 A、B 路径,分析中美市场差异,探讨中国软件市场优劣势,还阐述开源商业化及新加坡作为出海首站的价值。
Cursor终结者?Grok 4正式登顶!马斯克扬言编程碾压,20万N卡年赚47亿美金!
时隔5个月,xAI发布通用模型Grok 4,后续还将推编码、多模态代理和视频生成模型。Grok 4已上线,有三个订阅版本。马斯克称其智能超博士生,在多基准测试中领先,编码或超Cursor。
R2没来,却等来综合性能更优的DeepSeek R1T2
抱抱脸热门排行榜出现R1变体模型DeepSeek-TNG-R1T2,构建于多个父模型之上,在智能与输出token长度间达新平衡点,速度快且测试表现佳,还给出与不同模型对比的选择建议。
最新12种GraphRAG技术全面评测
6月两篇论文对12种GraphRAG技术评测。GraphRAG通过构建图结构组织知识,在复杂推理等任务中优于传统RAG。不同GraphRAG技术在图构建、知识检索上表现各异,如RAPTOR图构建慢但令牌消耗少。
深度解析LLM Wiki / Obsidian-Wiki / GBrain:Agent时代知识的“自组织”与“自进化”
文章深度解析LLM Wiki、Obsidian - Wiki和GBrain项目,探讨Agent时代知识的“自组织”与“自进化”。指出传统知识管理有短板,而这些项目通过不同方式解决知识结构化、沉淀和更新问题,各有优劣。
Chiplet(芯粒) —— 后摩尔时代的芯片“乐高”玩法
当单芯片逼近物理极限,Chiplet技术应运而生,它将大芯片拆分成小芯片,通过先进封装技术整合。该技术成本低、良率高,应用场景多元,但面临热管理、测试和标准统一等挑战,未来发展前景广阔。
AR眼镜尚存核心瓶颈,碳化硅能否破题?
AR眼镜成AI落地端侧佳选,但传统光波导方案难满足其需求。碳化硅以高折射率、高导热率特性,被视为破解AR全彩显示瓶颈的“钥匙”。国内产业正协同创新,不过成本问题待产业链协作解决。
Eino ADK:一文搞定 AI Agent 核心设计模式,从 0 到 1 搭建智能体系统
大语言模型发展下,Agent成AI落地主流,但传统开发有痛点。Eino ADK为Go开发者提供智能体开发框架,解决核心难题,还介绍了Agent功能、ADK模式、构建方法及多Agent协作场景等。