腾讯研究院AI速递 20241125
创始人
2024-11-25 06:19:43
0

生成式AI

一、 抱紧AWS大腿!Anthropic获40亿美金投资,计划合作AI芯片

1. AWS向Anthropic追加40亿美元投资,合作开发Trainium AI芯片,通过软硬件深度整合,提升模型训练性能和性价比;

2. Claude模型成为Amazon Bedrock服务核心,支持企业构建可扩展AI解决方案,覆盖药物研发、税务处理和文档分析等领域;

3. Claude模型在AWS上提供可定制AI解决方案,确保数据安全,并满足企业和政府的严格监管需求。

二、 步步紧逼谷歌!OpenAI正在研发与ChatGPT集成的AI浏览器

1. OpenAI计划开发与ChatGPT集成的AI浏览器,并推出“自然语言网络”(NLWeb)技术以优化行业搜索和交互体验;

2. OpenAI招聘前Google Chrome核心开发者并与三星合作,意图通过AI服务挑战Google在市场中的主导地位;

3. 浏览器项目目标是实现对话式网站互动,但因技术挑战和安全问题,短期内或难以与现有成熟浏览器竞争。

三、 FLUX“官方版ControlNet”景深轮廓更精准控制,四款官方工具

1. FLUX推出四款新工具,包括Fill、Canny、Depth和Redux,提升AI绘图的可操控性和精确性;

2. 工具支持图像扩展、轮廓和景深控制,以及角色动作和画面风格变换,全面优化生成效果;

3. 提供开发版代码和模型权重,Pro版通过API使用,整合到常用绘画工作流中,显著领先第三方插件和其他模型。

四、 AI编程爆火新品Windsurf,首创copilots和agents结合新范式

1. Windsurf结合Copilots协作能力和Agents独立能力,支持实时感知开发者操作,实现多文件编辑与迭代推理;

2. Cascade功能增强代码理解与工具集访问能力,支持深度集成现有代码库,优化开发效率;

3. Codeium估值12.5亿美元,定位AI编程市场,通过Windsurf挑战Cursor等竞争对手,吸引广泛用户和企业客户。

五、 真开源模型!公开「后训练」,Tülu 3或超越Llama 3.1 Instruct

1. 艾伦人工智能研究所发布Tülu 3开源模型,性能超越Llama 3.1 Instruct,并公开后训练方法、数据集和基础设施;

2. 后训练方案采用监督微调、偏好优化和强化学习,创新可验证奖励强化学习(RLVR),显著提升核心技能表现;

3. Tülu 3在多个基准上表现优异,尤其是70B版本接近Claude 3.5,推动开源模型性能与封闭模型的竞争。

六、 DeepSeek等新作JanusFlow: 1.3B大模型统一视觉理解和生成

1. JanusFlow结合视觉理解和生成框架,采用解耦编码器设计,通过SigLIP与SDXL-VAE实现高效训练和任务性能统一;

2. 引入表征对齐(REPA)策略,加速生成任务收敛速度,同时在视觉理解与生成任务上达到相当于专用模型的性能;

3. JanusFlow在多模态基准测试中表现优异,统一了LLM和Rectified Flow,展示出强大的视觉任务竞争力。

七、 陶哲轩宣布“等式理论计划”成功,57天2200万+数学关系证明

1. 陶哲轩发起的“等式理论计划”利用数学家、AI工具和Lean证明语言,57天完成2200万+magma等式蕴含关系的证明和反驳;

2. 项目快速进展得益于AI工具如GitHub Copilot和Vampire的辅助,但AI表现低于预期,主要用于代码加速和可视化工具开发;

3. 计划成果为AI数学工具提供基准测试,促进大规模人机协作在数学研究中的应用,部分衍生项目仍在进行。

八、 Meta重磅开源7B-Spirit LM,一个可以保留情感的音频大模型

1. Meta开源7B参数的Spirit LM,整合语音与文本模态,支持自由转换并保留情感和风格表达,覆盖ASR、TTS等多模态任务;

2. 模型采用交错训练策略和多元化标记,表达版额外加入音高与风格Token,显著增强语音生成的情感和自然表现力;

3. 实验显示Spirit LM在语音到文本、文本到语音任务中表现优异,尤其在情感表达建模和跨模态对齐能力上潜力巨大。

前沿科技

九、 机器人训练数据不缺了!英伟达推出DexMG:数据增强200倍

1. 英伟达团队推出DexMimicGen系统,通过仿真环境生成基于少量人类演示的大规模灵巧手运动轨迹数据,提升数据获取效率;

2. 系统采用并行、协调和顺序子任务分类法,确保多手臂操作的独立性和协作性,实现高质量轨迹生成并优化机器人策略;

3. 实验结果显示DexMimicGen大幅提高机器人任务成功率,适应多样初始状态,扩展至新任务基准,显著优于传统数据生成方法。

报告观点

十、 黄仁勋港科对话沈向洋:AI仅预训练不够,三种机器人有望量产

1. 黄仁勋强调仅靠预训练不足,未来AI需结合后训练与推理计算,助力机器人、数字孪生与生物学等领域;

2. 三种机器人(汽车、无人机、人形机器人)有望实现大规模生产,其中人形机器人因适应人类环境潜力最大;

3. 黄仁勋指出大湾区在机电与AI结合方面全球领先,建议利用该生态系统推动AI与物理智能的快速发展。

相关内容

聚焦AI+大模型、三维重建...
中新网北京5月31日电 (记者 孙自法)记者5月31日从中国图像图...
2026-06-01 00:57:14
国泰海通:维持海外AI算力...
国泰海通维持海外AI 算力及应用产业链“增持”评级。其研报指出,O...
2026-06-01 00:54:38
黄仁勋:AI时代无需过度纠...
正值高校毕业季,AI技术的快速迭代让不少毕业生对就业前景倍感焦虑,...
2026-06-01 00:43:12
小米开源可控视频音效生成模...
IT之家 5 月 29 日消息,小米大模型应用团队今日发布 Con...
2026-06-01 00:41:13
仁宝电脑与GMI Clou...
(全球TMT2026年5月28日讯)5月28日,仁宝电脑宣布,与美...
2026-05-28 21:09:59
科大讯飞进军AI眼镜,内置...
新京报贝壳财经讯(记者罗亦丹)5月28日,科大讯飞在澳门威尼斯人金...
2026-05-28 20:46:43

热门资讯

2024云栖大会|阿里云升级无... 北京商报讯(记者魏蔚)9月20日,阿里云无影AI云电脑在2024云栖大会上展出,该版本基于最新的终端...
MWC2025荣耀多款AI技术... 人民财讯3月6日电,2025世界移动通信大会(MWC 2025)上,荣耀MagicBook Pro ...
原创 2... #春日生活好物种草季#近年来,笔记本电脑市场迎来技术爆发期,尤其在手机厂商跨界入局后,轻薄本在性能、...
摩尔线程发布AI算力笔记本MT... 钛媒体App 12月20日消息,摩尔线程创始人、董事长兼CEO张建中在摩尔线程首届MUSA开发者大会...
摩尔线程AI生图摩笔马良全新升... 快科技8月7日消息,作为国产GPU的杰出代表,摩尔线程在当下火爆的AIGC浪潮中也推出了自己的软硬一...
谷歌打磨 Gemini AI ... IT之家 8 月 31 日消息,谷歌于 8 月 27 日发布博文,宣布旗下 Gemini AI 支持...
微软 Azure AI 语音服... IT之家 8 月 23 日消息,微软Azure AI 语音服务允许开发者构建多语言生成式 AI 语音...
青云QingCloud Kub... 日前,青云科技宣布开源 Thanos 的企业级发行版 Whizard,为企业带来真正高可用、可扩展、...
Macos系统上一款强大的卸载... App Cleaner mac中文版是Mac os系统上一款强大 的mac卸载工具,以帮助您完全卸载...
AMD锐龙AI 9 HX 37... 2024年6月3日,AMD正式发布全新的锐龙AI 300系列处理器。该系列处理器一经发布就引发大家的...