「95后团队」共找到 5039 篇相关文章
专访AI.Talk赵汗青 - 我不是一个创作者。
文章专访AI.Talk赵汗青,探讨AI虚拟IP YURI爆火背后的故事。赵汗青以构建虚拟人格为目标,借AI.Talk探索,让YURI多领域发展。他还谈到IP构建、商业模式及运营思路等,强调做有溢价之事。
无损减少80%激活值内存,提升5倍训练序列长度,仅需两行代码
港中文(深圳)和上海交通大学团队提出 StreamBP 算法,通过线性分解和分步计算,将大语言模型训练激活值内存降至梯度检查点的 20%,在相同内存下最大序列长度为其 2.8 - 5.5 倍,代码已开源。
ICLR 2026 | ProSafePrune:一剪见效,告别大模型过度防御
合肥工业大学与科大讯飞联合团队提出全新低秩参数修剪框架 ProSafePrune,被 ICLR 2026 录用。它能精准定位模型认知偏差并修剪,降低过度拒绝率,不损安全防御能力,还提升通用任务性能,为 LLM 安全部署提供新思路。
GPT-5核心推手闪电跳槽,Anthropic CEO高调炫耀员工留存碾压OpenAI,“AI第一公司”光环崩塌?
OpenAI后训练负责人、GPT - 5核心推手Max Schwarzer跳槽至Anthropic,此前也有多位技术领袖离开。OpenAI在商业版图扩张与伦理争议并存下,正从参数军备赛转向体验护城河,同时加速商业与政治布局,但面临人才流失等问题。
大模型如何泛化出多智能体推理能力?清华提出策略游戏自博弈方案MARSHAL
近日,清华大学等机构研究团队提出 MARSHAL 框架,利用强化学习让大模型在策略游戏自博弈。实验表明,多轮、多智能体训练提升了模型博弈决策水平,将推理能力泛化到通用多智能体系统,在一般推理任务表现显著提升。
美团开源全模态,比肩顶级闭源模型,开源新SOTA
美团LongCat团队发布5600亿参数开源全模态模型LongCat - Flash - Omni,它有端到端全模态架构,能实现毫秒级实时音频 - 视觉交互。该模型训练采用渐进式策略,工程上有高效技术支撑,在多基准测试表现出色。
专访丨华人大三学生创业教育 Agent,获赵长鹏 1100 万美元种子轮
硅谷华人大三学生创立的教育类 AI 产品 VideoTutor 完成 1100 万美元种子轮融资,由赵长鹏家办 VC 领投。这是面向 K12 学生的 AI 教育 Agent,能一键生成专属教学视频。文中还探讨了其功能、优势及团队发展规划。
跨芯片统一优化,DLCompiler与DLBlas驱动算子极致表现
9月10日,上海AI实验室DeepLink团队开源DLCompiler和DLBlas。前者是扩展Triton的深度学习编译器,后者是面向大模型的高性能算子库。它们有跨架构DSL扩展等亮点,在多芯片上实现性能优化,还解决了DSA芯片优化难题。
刚刚,微软CEO 宣布:AI 医生诊断准确率已达85.5%,是人类医生的4倍
微软CEO宣布其AI诊断系统MAI - DxO在304个病例测试中诊断准确率达85.5%,是人类医生的4倍。该系统模拟虚拟医生团队,既准又省,但也引发诸多质疑,微软认为AI是医生补充,未来是人机协作时代。
V0做不到、Bolt搞不定,Youware用MCP一键解决网页生成最大难题
Youware可快速将AI生成网页部署到线上。其更新后支持调用MCP生成网页,深度适配主流MCP服务,使用门槛低且免费。还上线积分系统,首页分类筛选更详细,作品页增随机按钮。用案例展示了其强大的网页生成能力。