「外貌评估」共找到 715 篇相关文章
估值 20 亿美元的语音输入法,开源平替已经 3 万 star
文章指出语音输入随着 AI 发展价值重估,介绍了开源工具 OpenLess,分析了商业订阅、开源桌面工具、大厂输入法三类玩家,给出四层评估框架,也提及开源风险,并对不同需求给出选择建议。
Notion Custom Agents复盘:三年重写5次,Notion 历史上最成功的新功能之一
Notion 的 AI 工程负责人 Sarah Sachs 和技术负责人 Simon Last 在采访中分享 Agent 探索思考。Custom Agents 是 Notion 历史上转化率高的新功能,开发三年重写 5 次。他们还谈及产品路线、模型评估、技术方向等内容。
重估GEO:一场关于“谁能被AI相信”的战争打响了|甲子光年
2026年央视“3·15”晚会曝光AI大模型“AI投毒”黑灰产,却让GEO服务进入更多企业视野。360智见推出GEO产品,重构其为企业面向AI时代的基础设施,解决企业营销难题。
盛大AI研究院新作:流式生成超越非流式,一句话让虚拟人动作丝滑如真,推理延迟仅1帧
盛大AI研究院与东京大学联合提出FloodDiffusion,首个基于定制化扩散强制的流式人体动作生成框架。它能零延迟生成无限长动作序列,解决了现有方法的问题,在多数据集评估中表现优异。
Claude Code 生成 13 种编程语言代码基准测试:动态语言更快更省成本
Ruby 代码提交者远藤裕介评估 Claude Code 用 13 种编程语言生成代码的效率。经 600 多次测试,动态语言更快、更省成本且更稳定,静态类型语言慢且成本高。实验有局限,也引发质疑与回应。
陶哲轩:我差点江郎才尽,只因在普林斯顿待了一年
菲尔兹奖得主陶哲轩在与播客主理人访谈中称,在普林斯顿埋头搞学术让他灵感枯竭,数学家需生活琐事激发想法。还探讨科学研究,如开普勒定律、AI在数学研究的应用、科学评估等问题。
DeepMind新论文炸锅:AI全自动进化算法,写出专家都想不到的解,网友:这可能就是“王牌”
谷歌DeepMind让LLM驱动的智能体AlphaEvolve改写、进化算法代码。选定CFR、PSRO框架,只开放关键决策逻辑给LLM,通过生成、运行、评估、筛选循环,进化出VAD - CFR和SHOR - PSRO算法,表现超人类手工版本。
特朗普刚下禁令,美军动用Claude空袭!军用版或已达Opus 5.5水平
WSJ报道,特朗普刚封杀Claude,美军就用其空袭伊朗。美军多司令部用Claude做情报评估等。Anthropic为军方定制版或达Opus 5.5水平。Anthropic曾因隐私等问题与五角大楼谈判破裂。
ICLR 2026 oral | AI代码真能进生产环境?SwingArena:从「写对代码Commit」到「通过CI审查」
过去一年大模型写代码能力提升,人们思考其能否参与软件工程核心流程。现有评测基准有缺失,SwingArena填补空白,将博弈引入评测,设计检索增强流水线,其开源后或成评估AI编程能力新工具。
登顶Hugging Face论文热榜,LLM重写数据准备的游戏规则
企业数据团队面临数据准备难题,传统方法依赖人工规则,有诸多局限。上海交通大学等机构研究团队综述指出,LLM正推动数据准备从“规则驱动”向“语义驱动”转变,还给出技术选型、评估基准及工程指南。