「等本位和轨迹」共找到 8071 篇相关文章
一封邮件拿下Shopify CEO:Firecrawl的1450万美元和v2十倍速度提升
Firecrawl发布v2版本,有10倍速度提升、语义爬取等核心升级,开发者体验也全面升级。同时完成1450万美元A轮融资,是靠直球式沟通拉到Shopify CEO投资。后续打算扩招团队,专注产品体验突围。
理解、生成、编辑一次搞定:Skywork UniPic 2.0的统一多模态解法|甲子光年
电商团队常面临创作流程繁琐问题,当前行业需统一架构。昆仑万维发布Skywork UniPic 2.0,整合理解、生成、编辑功能。它参数小性能优,还构建奖励模型,配合其他模型构建体系,具成本等优势。
兔子蹦迪疯传,5亿观看!全球恐慌:一段AI视频把全人类拉入虚拟现场
一段兔子深夜「蹦迪」的AI假视频骗了全球上亿人,在TikTok引发大量转发。因监控画面模糊、背景静态等,它难以识破。随着AI发展,真假视频难辨,引发人们对区分虚拟与现实的思考。
不靠海量数据,如何精准喂养大模型?上交Data Whisperer:免训练数据选择法,10%数据逼近全量效果
上海交通大学等团队提出 Data Whisperer,首个免训练的注意力驱动数据选择框架。它利用模型自身能力打分挑数据,无需训练与人工标注,用 10% 数据让微调效果逼近全量数据,在多方面领先传统方法。
Resume Builder报告:多数经理使用AI来决定,晋升或解雇员工
Resume Builder调查显示,65%美国管理者工作用AI,94%用其对下属决策,涵盖晋升、加薪等多方面。71%管理者对AI公平决策有信心,但不少人让AI无人类干预决策,且多数管理者缺相关培训。
数学题干带猫AI就不会了!错误率翻300%,DeepSeek、o1都不能幸免
研究发现,在数学题后加如“猫一生绝大多数时间都在睡觉”这类话术,会让大模型答错概率翻3倍,DeepSeek - R1、OpenAI o1等推理模型中招。研究探索攻击方式,总结出三种攻击模式。
准确率92.7%逼近Claude 3.5、成本降低86%,开源代码定位新神器LocAgent来了
OpenHands 等团队发布 LocAgent,这是用于代码定位的图索引 LLM Agent 框架,准确率达 92.7%。它把代码库解析成图,提供工具接口,经实验效果出色,开源微调模型降本增效,还能提升问题解决率。
当 AI 开始重写负载,数据库该如何重新设计?
AI正改写数据库命题,新数据对象进入生产链路,AI Agent带来更复杂任务链路。在腾讯云数据库DBTalk上,三位研究员从不同方向探讨当负载被AI改写,数据库该如何重新设计,包括内核优化、资源管理和测试测评等方面。
Stripe 发布基准测试:AI 智能体可开发集成方案,但校验环节存在短板
Stripe推出基准测试套件,评估AI智能体构建完整Stripe集成方案的能力,测试聚焦金融系统贴近生产环境的集成场景。测试显示,不同任务类型评测结果差异显著,核心瓶颈在于验证环节,当前智能体短板在校验逻辑等方面。
突发|Andrej Karpathy官宣加入Anthropic!
周二晚间,Andrej Karpathy在X上自宣加入Anthropic,将在核心预训练团队工作。他是AI领域极具影响力人物,曾任职OpenAI、特斯拉等。此次加入或助推Anthropic上市,也让OpenAI面临压力,或引发新一轮AI军备竞赛。