Workflow
腾讯研究院AI速递 20250508
腾讯研究院·2025-05-07 23:55

生成式AI - Gemini 2 5 Pro在LMeana基准测试中全面领先,首次在文本、视觉、WebDev Arena三大领域超越Claude 3 7 [1] - 新版本强化编程能力,可将图片视频转化为交互式应用,VideoMME测试得分84 8% [1] - 开发者可通过Google AI Studio和Vertex AI使用更新版本,已上线Gemini App并支持Canvas功能 [1] ComfyUI功能升级 - 新增原生API节点功能,支持10+模型系列和62个新节点,可直接调用Veo2、Flux Ultra等付费模型 [2] - 完成品牌视觉更新,新Logo采用连接方块元素设计,融入90年代动漫与Y2K风格 [2] - 即将推出用户自定义API Key、工作流并行执行功能,并增强视频处理能力 [2] Kevin模型开源 - Cognition AI开源32B参数量的Kevin模型,基于QwQ-32B通过GRPO强化学习训练,生成CUDA内核性能超越o3和o4-mini [3] - 在KernelBench数据集上平均正确率达65%,解决89%的任务,测试中实现1 41倍加速比 [3] - 在二级任务上表现尤为突出,达到1 74倍加速,显著优于其他模型 [3] 学生免费计划 - Cursor Pro和Gemini Pro向学生免费开放一年完整专业版使用权限,可节省约2000元人民币 [4][5] - 此举旨在争夺未来用户市场,通过培养学生使用习惯提前布局市场份额 [4] - 申请渠道已开放,Gemini Pro将在2025年8月重新验证学生身份 [5] 腾讯元宝功能升级 - 推出对话分组功能,支持按主题创建文件夹和历史对话归类整理 [6] - 每个分组可设置独立提示词指令,定制专属语气风格和任务目标 [6] - 全平台上线文生图功能,支持混元和DeepSeek模型生成图片,增强图文一致性和画质 [7] AI科研应用 - Anthropic启动AI for Science计划,提供最高2万美元API积分支持生物系统、遗传数据、药物研发等领域研究 [8] - 开放所有Claude系列模型,重点推动AI在科学研究的突破性应用 [8] 机器人大模型 - 清华ISRLab与星动纪元联合开发AIGC机器人大模型VPP,获ICML2025 Spotlight并全部开源 [9][10] - 在Calvin ABC-D基准测试中实现4 33平均任务完成长度,超越先前技术41 5% [10] - 支持跨本体学习,可完成100+种灵巧操作任务,具有较强可解释性和调试能力 [10] AI社会影响 - 专家警告AI正在经济、文化和社交领域取代人类,可能导致人类失去对文明的控制 [11] - 建议采取跟踪AI影响、监管AI实验室、加强人类组织能力等措施应对 [11] 软件开发革新 - Bolt new从年收入70万美元快速增长至2000万美元ARR,主打基于浏览器的快速Web应用开发 [12] - 60-70%用户为非开发者,利用Web containers技术实现100毫秒内启动开发环境 [12] - 15人团队聚焦核心产品体验,通过免费试用实现病毒式增长 [12]