「软件评测」共找到 1195 篇相关文章
中国AI高速路,华为给出开源开放方案
上周华为全联接大会展示系列创新。超节点架构带动的开源开放意义深远,开放硬件、开源软件和灵衢组件。华为发布系列超节点新品,实现全场景覆盖,同时全面开放开源,推动产业协同与生态繁荣。
10万token自然语言推理,让30B-A3B模型站上奥赛金牌线
上海人工智能实验室报告显示,30B - A3B规模的SU - 01模型不依赖外部工具,经训练在IMO、USAMO、IPhO等奥赛评测达金牌水平。研究还验证更高效科学推理系统路线,有望用于更多科学问题。
Qwen3-VL-Embedding系列上新:探索统一多模态表征与排序
2025年6月曾开源Qwen3-Embedding和Qwen3-ReRanker,现推出Qwen3-VL-Embedding和Qwen3-VL-Reranker。它们基于Qwen3-VL构建,能处理多模态输入,在多任务达业界领先,还介绍了特性、评测及使用方法。
Vibe Coding 产品最大的错觉,是以为自己真的有护城河
Base44创始人Maor Shlomo认为Vibe Coding工具易被复制,技术护城河难寻。他指出真正的护城河是“垂直整合”,构建全栈平台很关键。还谈到市场竞争、软件发展趋势、公司策略等多方面内容。
首个故事可视化综合评估框架来了!80个故事单元53种类别,20种技术方案全面对比
随着AIGC技术进步,故事可视化引发关注。阶跃星辰携手上科大、西湖大学提出ViStoryBench可视化评估框架,通过构建多元化数据集、建立多维度评估指标,对超20种技术方案评测,为行业发展提供评估工具。
Anthropic CPO:AI写9成代码后,我们迎来了新噩梦!
本文是对Anthropic CPO Mike Krieger的播客访谈。他谈到AI重塑软件开发,约90%代码由AI编写;还分享产品经理价值、Anthropic战略、Artifact关闭原因等,对AI认知从工具变为战略伙伴。
终于,无需邀请码,这款刷新GAIA榜单的Agent你立刻就能用!
今年AI圈新品爱用邀请码等三件套,作者对此不满。天工超级智能体(Skywork)不玩套路,在GAIA评测达SOTA级别。它优化办公三件套场景,使用方便,虽有不足但瑕不掩瑜。
全球第一! 中国模型登顶榜首,首个可编辑AI语音来了
中国AI语音ViiTorVoice登顶全球语音权威评测榜单Seed - TTS,首创「局部编辑」能力,解决语音无法局部编辑痛点。实测效果惊艳,还具备精准情绪控制、无参考文本克隆等能力,部分模型已开源。
AI Agent 十问十答,降低认知摩擦
文章以问答形式梳理技术术语与价值信息,介绍AI Agent定义、与传统软件区别、演进原因等,还阐述组件、原理、提升输出效果方法,探讨Workflow与LLM关系及单/多智能体系统相关内容。
当 Kanban 不再管理人:Routa Kanban 如何管理 Agent Team
本文探讨了 Routa Kanban 如何管理 Agent Team,指出在 AI4SE 时代,多 Agent 协作进入日常软件交付需建设管理界面与工程护栏。Routa Kanban 把多 Agent 协作推进到‘管理驱动’,其价值在于将隐性约束显性化。