无问芯穹」共找到 861 篇相关文章

产品应用8

这个国产Deep Research 有些「另类」:它不想只授你以鱼,还想授你以渔

文章介绍秘塔AI的Deep Research产品,它有“题链”展示,研究过程可视化,免费开放。实测中它表现出色,能深度分析题、给出有价值结论。虽有小瑕疵,但在深度研究赛道领先,让AI思考透明、研究普惠。

AGI Hunt
新闻资讯7

什么都不做就能得分?智能体基准测试出现大

随着AI智能体走向实际应用,其基准测试变得至关重要。但现有基准测试题多,如WebArena判错答案、τ - bench给操作智能体高正确率。文章提出有效性判据和ABC清单,还揭示主流基准测试诸多题。

机器之心
算法论文8

AI一眼认出95万物种,还能分辨雄雌老幼,2亿生物图像炼成“生命视觉”大模型

俄亥俄州立大学团队用2亿生物图像训练BioCLIP 2模型,取得最优物种识别性能。它在相应监督信号的非物种任务中,准确率远超DINOv2,还涌现出物种间生态对齐、物种内差异分离等生物学理解。

量子位
新闻资讯7

斯坦福辍学生奥特曼:AI时代,大学上两年就够了

在面向科技实习生的活动上,有人AI时代读大学是否必要,奥特曼认为要读,但四年太长,两年刚好,还列举盖茨等辍学生成功案例,强调辍学非成功公式,大学应给学生更多保障。

量子位
新闻资讯7

林俊旸Agent创业首次亮相,腾讯已投

前Qwen一号位林俊旸官宣创业公司Pragmatik Labs,方向为做横跨数字与物理世界的下一代Agent。公司获高榕、红杉、腾讯等投资,投后估值达20亿美元。虽产品模型,但凭借林俊旸过往成绩受关注。

量子位
产品应用7

胜率直逼人类大师!这套Agent揭开中国AI「玄学真相」

信息泄漏的术数题库中,Claude、GPT等主流模型准确率低,而Tianfu Agent系统将准确率提至50%,逼近人类Top20选手。它采用多Sub - Agent协作等策略,还在工具管理、规则使用等方面有创新。

新智元
算法论文8

需训练,如何提升黑箱VLM?CARPRT用「类别感知」给出答案

近年来,视觉 - 语言模型(VLMs)改变图像理解范式,但零样本分类性能对 Prompt 敏感。墨尔本大学 TMLR 小组提出 CARPRT 方案,以“训练、黑箱适配、类别专属权重”解决提示词语义适配不足题,已被 ICLR 2026 接收。

机器之心
7

DeepSeek V4永久降价!缓存命中再打1折,实测编程成本骤降83%

DeepSeek两天连续两次降价,输入输出2.5折,命中缓存输入折上再1折且时限。实测编程成本骤降83%,此前31.73元,打折后只需5.34元。其曾引发价格战,此次对海外用户冲击更大。

量子位
推荐文章7

一种可以减少 CI 回归测试套件规模的更佳方案

作者作为测试架构师,认为减少CI回归测试套件规模理论诱人但实践常失望。介绍有效处理大型测试套件的方案,如随机趋势分析、多上下文模式匹配等,还谈及门控测试等优势,能助力管理测试集。

InfoQ
新闻资讯7

Moltbook底裤被扒了!150万用户99%是水军,创始团队自导自演

Moltbook是为AI智能体打造的社交平台,爆火后却被指有题。它靠递归提示词增强策略运行,有独特机制。但研究人员揭露其用户多为水军,存在安全漏洞、人为操纵和AI“幻觉”等题。

AI前线