「产品评测」共找到 2221 篇相关文章
张涛首次回应争议,Manus 为什么没有被替代?
11月30日,真格举办AI创业分享活动,Manus联合创始人张涛首次回应质疑。他表示Manus秘密公开,Less structure, more intelligence,且在Benchmark中长期居首。他还谈产品决策、发展方向,建议学生学会与Agent共处。
一个邪修方法,帮你把用Agent的钱省掉80%。
作者曾分享Minimax的Agent,因使用成本高遭读者反馈。现该工具推出Publish to Gallery & Remix功能,用户可复用项目,降低成本,还能形成集体智慧。不过产品和交互设计较粗糙。
协同办公进入Agent时代,飞书+豆包工作跑在了最前面
本文报道2026飞书未来无限大会,字节跳动发布完成系统性适Agent化改造的飞书8.0,以及国内首个团队智能体产品豆包工作伙伴,原生深度融合打造Agent时代协同办公新方案,披露企业AI选型新趋势,强调企业级AI安全。
如何正确Vibe Coding?这是来自Anthropic编程智能体负责人的大师课
Anthropic研究员Erik Schluntz分享Vibe Coding经验。他认为AI能力指数级增长,开发者应接纳大模型生成系统,还提出聚焦‘叶子节点’、做好产品经理等策略,并介绍22000行代码合并案例及实战问答。
DeepSeek-OCR是「长文本理解」未来方向吗?中科院新基准给出答案
DeepSeek-OCR的视觉文本压缩技术降低长文本处理成本,中科院自动化所等团队推出VTCBench基准测试评估模型视觉认知,含三大任务及衍生版本,测试结果有‘U型曲线’,还评测多种尖端模型。
吴恩达深夜发文:GenAI 时代应用工程师的必备能力清单
吴恩达发文剖析GenAI应用工程师这一新兴职业。指出其技能要求与传统软件工程师不同,强调掌握多种AI积木块、利用AI辅助编程工具的重要性,还提及产品技能是加分项,并给出面试关键问题。
腾讯混元TurboS技术报告首次全公开:560B参数混合Mamba架构,自适应长短链融合
腾讯公开混元TurboS技术报告,该模型是超大型Hybrid Transformer - Mamba架构MoE模型,融合Mamba与Transformer架构优势,有自适应长短思维链机制,激活参数56B。在多评测中表现佳,推理成本低。
人类造工具200万年,工具开始研究工具!97年天才少年带队,把“AI寻找研究方向”做成了现实
2026年AI开始研究AI(AI4AI),深圳EvoMap团队用蜂群协作做出产品EvoX。他们创新Agent组织方式,有实验数据支撑其效果,还开源成果AutoResearch解决AI痛点,在生活场景优化旧算法可行。
这个春节P图不求人!小红书开源图像编辑新SOTA
今日小红书基础模型FireRed - Image - Edit亮相,在复杂编辑指令、风格化转换等核心指标表现强,在多项权威测试达SOTA。该项目代码等已开源,模型权重将开源。团队还推出RedEdit Bench评测方案。
从「知题」到「知人」:UserRL让智能体学会「以人为本」
大语言模型距成真正用户伙伴缺‘知人’能力。来自UIUC与Salesforce团队提出UserBench和UserRL方案。前者将‘用户特性’制度化,构建评测环境;后者搭建统一强化学习框架,探索奖励建模,二者让‘以用户为中心’落地。