Navigate to WaytoAGI Wiki →
Home/Question List/Question Detail

最近的AI新闻

Answer

以下是近期的 AI 新闻汇总:

3 月 12 日:

  • 【AI 3D】
    • BlenderMCP:与 Claude AI 沟通,在 Blender 实现快速 3D 建模。
    • MIDI:单幅图像到 3D 场景生成。
    • Move AI:更新动作捕捉能力,提出 Gen 2 Spatial Motion。
  • 【AI 写作】
    • MM-StoryAgent:AI 多模态故事生成系统。
  • 【AI 视频】
    • VACE:阿里推出一体化视频创作和编辑技术。
    • VideoPainter:腾讯开源视频编辑技术。
    • Wonder Dynamics:推出摄像机轨道(Camera Track)和清洁板(Clean Plate)功能。
  • 【其他】
    • OpenAI:为开发者推出一套 AI Agent 开发套件。
    • R1-Omni:阿里情感识别模型,通过视频识别情感。
    • Luma AI:发布一种新的预训练范式 IMM,旨在突破算法瓶颈,提高生成预训练算法的性能。
    • Manus:宣布与阿里通义千问团队达成战略合作。

3 月 14 日:

  • 【AI 模型及其他】
    • 谷歌:Gemini 应用能力升级,包含升级推理模型 gemini 2.0 Flash Thinking Experimental 等多个功能提升。
    • OpenAI:4 项更新。
    • Bolt:一键将 Figma 设计转换为可运行的 Web 应用。
    • 阿里:推出 AI 旗舰应用“新夸克”。
    • 360 智脑团队:开源推理模型 Light-R1-14B-DS,复现 Deepseek 的强化学习效果。
  • 【AI 视频】
    • Pika:更新 Pikaffects,新增多款变身特效。
    • Freepik 与 Fal 平台:引入 Topaz AI 的提升“FPS 和视频分辨率”能力。
    • Krea:上线 Veo 2 模型,支持图生视频功能,但生成成本较高。
  • 【AI 绘图】
    • LBM:用于快速图像到图像转换的潜在桥匹配方法,支持可控图像重新照明、角色去除和图像修复。
  • 【AI 语音】
    • Sesame:开源 TTS 语音模型 CSM-1B。

3 月 26 日:

  • 【AI 模型及应用】
    • OpenAI:推出 GPT-4o 图像生成能力。
    • 谷歌:发布 Gemini 2.5 Pro Experimental 模型。
    • Trea:已内置 DeepSeek-V3-0324。
  • 【AI 音乐】
    • 昆仑万维:发布全球首款音乐推理大模型 Mureka O1。
  • 【AI 视频】
    • 混元 Portrait:音频视频驱动图片肖像形成动画。
    • PP-VCtrl:新可控制视频生成模型。
  • 【AI 3D】
    • Vibe Draw: 草图进行 3D 建模。
    • PhysTwin:通过视频创建交互式物理数字孪生。
    • GroomLight:用于重打光的人体头发外观建模的混合逆向渲染。
Content generated by AI large model, please carefully verify (powered by aily)

References

3月12日 AI资讯汇总

猫叔留言:AI资讯公众号:超时空视角猫叔个人公众号:AI替代人类小红书/抖音:EverAI B站:Ever AI酱(❤这里会有教程及AI工具界面操作)[heading2]3月12日AI资讯[content]【AI 3D】BlenderMCP:与Claude AI沟通,在blender实现快速3D建模MIDI:单幅图像到3D场景生成Move AI:更新动作捕捉能力,提出Gen 2 Spatial Motion【AI写作】MM-StoryAgent:AI多模态故事生成系统【AI视频】VACE:阿里推出一体化视频创作和编辑技术VideoPainter:腾讯开源视频编辑技术Wonder Dynamics:推出摄像机轨道(Camera Track)和清洁板(Clean Plate)功能【其他】OpenAI:为开发者推出一套AI Agent开发套件R1-Omni:阿里情感识别模型,通过视频识别情感Luma AI:发布一种新的预训练范式IMM,旨在突破算法瓶颈,提高生成预训练算法的性能Manus:宣布与阿里通义千问团队达成战略合作

3月26日 AI资讯汇总

猫叔留言:AI资讯公众号:超时空视角猫叔个人公众号:AI替代人类小红书/抖音:EverAI B站:Ever AI酱(❤这里会有教程及AI工具界面操作)3月26日AI资讯【AI模型及应用】OpenAI:推出GPT-4o图像生成能力谷歌:发布Gemini 2.5 Pro Experimental模型Trea:已内置DeepSeek-V3-0324【AI音乐】昆仑万维:发布全球首款音乐推理大模型Mureka O1【AI视频】混元Portrait:音频视频驱动图片肖像形成动画PP-VCtrl:新可控制视频生成模型【AI 3D】Vibe Draw:草图进行3D建模PhysTwin:通过视频创建交互式物理数字孪生GroomLight:用于重打光的人体头发外观建模的混合逆向渲染

3月14日 AI资讯汇总

猫叔留言:AI资讯公众号:超时空视角猫叔个人公众号:AI替代人类小红书/抖音:EverAI B站:Ever AI酱(❤这里会有教程及AI工具界面操作)3月14日AI资讯【AI模型及其他】谷歌:Gemini应用能力升级,包含升级推理模型gemini 2.0 Flash Thinking Experimental等多个功能提升OpenAI:4项更新Bolt:一键将Figma设计转换为可运行的Web应用阿里:推出AI旗舰应用“新夸克”360智脑团队:开源推理模型Light-R1-14B-DS,复现Deepseek的强化学习效果【AI视频】Pika:更新Pikaffects,新增多款变身特效Freepik与Fal平台:引入Topaz AI的提升“FPS和视频分辨率”能力Krea:上线Veo 2模型,支持图生视频功能,但生成成本较高【AI绘图】LBM:用于快速图像到图像转换的潜在桥匹配方法,支持可控图像重新照明、角色去除和图像修复【AI语音】Sesame:开源TTS语音模型CSM-1B,

Others are asking
AI 分为哪些层?如:语料,大模型
AI 可以分为以下几个层面: 1. 概念层面: AI 即人工智能。 生成式 AI 生成的内容称为 AIGC。 2. 学习方式层面: 机器学习,包括监督学习(有标签的训练数据,算法目标是学习输入和输出之间的映射关系,包括分类和回归)、无监督学习(学习的数据没有标签,算法自主发现规律,经典任务如聚类)、强化学习(从反馈里学习,最大化奖励或最小化损失,类似训小狗)。 3. 技术方法层面: 深度学习,参照人脑有神经网络和神经元(因有很多层所以叫深度),神经网络可用于监督学习、无监督学习、强化学习。 生成式 AI 可以生成文本、图片、音频、视频等内容形式。 LLM 即大语言模型,对于生成式 AI,生成图像的扩散模型不是大语言模型;对于大语言模型,生成只是其中一个处理任务,如谷歌的 BERT 模型可用于语义理解(不擅长文本生成),像上下文理解、情感分析、文本分类。 4. 技术里程碑层面:2017 年 6 月,谷歌团队发表论文《Attention is All You Need》,首次提出了 Transformer 模型,它完全基于自注意力机制(SelfAttention)来处理序列数据,无需依赖循环神经网络(RNN)或卷积神经网络(CNN)。
2025-03-30
零基础小包AI学习路径
以下是为零基础的您提供的 AI 学习路径: 1. 了解 AI 基本概念: 建议阅读「」部分,熟悉 AI 的术语和基础概念,包括人工智能的定义、主要分支(如机器学习、深度学习、自然语言处理等)以及它们之间的联系。 浏览入门文章,了解 AI 的历史、当前的应用和未来的发展趋势。 2. 开始 AI 学习之旅: 在「」中,您可以找到一系列为初学者设计的课程,特别推荐李宏毅老师的课程。 通过在线教育平台(如 Coursera、edX、Udacity)上的课程,按照自己的节奏学习,并有机会获得证书。 3. 选择感兴趣的模块深入学习: AI 领域广泛,比如图像、音乐、视频等,您可以根据自己的兴趣选择特定的模块进行深入学习。 一定要掌握提示词的技巧,它上手容易且很有用。 4. 实践和尝试: 理论学习之后,实践是巩固知识的关键,尝试使用各种产品做出您的作品。 在知识库提供了很多大家实践后的作品、文章分享,欢迎您实践后的分享。 5. 体验 AI 产品: 与现有的 AI 产品进行互动,如 ChatGPT、Kimi Chat、智谱、文心一言等 AI 聊天机器人,了解它们的工作原理和交互方式。 此外,像二师兄这样的案例也可供您参考。二师兄在二月因七彩虹售后群老哥的分享,要了 SD 秋叶安装包,下载了教学视频,迈出 AI 学习的第一步。三月啃完 SD 的所有教程并开始炼丹,四月尝试用 GPT 和 SD 制作图文故事绘本、小说推文的项目,五月加入 Prompt battle 社群,开始 Midjourney 的学习。 如果您是零基础小白,还可以: 找网上的基础课程进行学习。 观看科普类教程。 阅读 OpenAI 的文档,理解每个参数的作用和设计原理。 利用一些练手的 Prompt 工具。
2025-03-30
介绍下 ai切磋大会
AI 切磋大会是由 AI 社区“通往 AGI 之路”每月举办的切磋交流分享会。 11 月 9 日至 10 日在文三路数字生活街区举办的那次,更像是一场人人皆可参与的“市集”。此次大会由“大数据产业基地”发起,共有 106 个摊位,摊主都是 AI 爱好者,带来了非遗 AI 刮刮乐、AI 3D 打印、AI 视频转绘、AI 量化交易、AI 产品设计等贴近日常的“AI+”产品,让大家在互动中感受 AI 的魅力。现场还有基于通义千问开发的“航天小飞侠”AI 助理模型,以及根据 MBTI 和星座生成专属鸡尾酒配方并现场调制的 AI 调酒等新奇体验。 2 月 23 日举行的线下切磋大会以 Deepseek 为核心,进行交流分享、方法论提炼、脑暴等,活动形式多样,已开通 16 个城市报名。此外,还有写作活动、激梦 P 模型比赛成果展示、当代手势设计尝试、多工具组合创作等相关内容。 12 月 7 日举办的是校园版,由 WaytoAGI 和杭州云谷学校共同举办,杭州云谷学校准备举办第六届学术周,探讨 AI 在教育中的应用及未来发展方向。活动时间为 12 月 7 日下午 12:00 至晚宴结束,晚宴有烤全羊。被选中的摊主可免费参加,AI 摆摊仍在招募中。活动官网:https://ygaw.my.canvasite.cn/2024 ,报名链接:https://waytoagi.feishu.cn/share/base/form/shrcnoNPP9HMlIqiTMhbc64OMkJ?iframeFrom=docx&ccm_open=iframe
2025-03-30
AI学习路线
以下是为新手提供的 AI 学习路线: 1. 了解 AI 基本概念: 建议阅读「」部分,熟悉 AI 的术语和基础概念,包括其主要分支(如机器学习、深度学习、自然语言处理等)以及它们之间的联系。 浏览入门文章,了解 AI 的历史、当前的应用和未来的发展趋势。 2. 开始 AI 学习之旅: 在「」中,能找到为初学者设计的课程,特别推荐李宏毅老师的课程。 通过在线教育平台(如 Coursera、edX、Udacity)上的课程,按照自己的节奏学习,并有机会获得证书。 3. 选择感兴趣的模块深入学习: AI 领域广泛,比如图像、音乐、视频等,可根据自己的兴趣选择特定的模块进行深入学习。 掌握提示词的技巧,它上手容易且很有用。 4. 实践和尝试: 理论学习之后,实践是巩固知识的关键,尝试使用各种产品做出自己的作品。 在知识库提供了很多大家实践后的作品、文章分享,欢迎实践后的分享。 5. 体验 AI 产品: 与现有的 AI 产品进行互动,如 ChatGPT、Kimi Chat、智谱、文心一言等 AI 聊天机器人,了解它们的工作原理和交互方式,获得对 AI 在实际应用中表现的第一手体验,并激发对 AI 潜力的认识。 记住,学习 AI 是一个长期的过程,需要耐心和持续的努力。不要害怕犯错,每个挑战都是成长的机会。随着时间的推移,您将逐渐建立起自己的 AI 知识体系,并能够在这一领域取得自己的成就。完整的学习路径建议参考「通往 AGI 之路」的布鲁姆分类法,设计自己的学习路径。
2025-03-30
形成指令让AI根据我的论文框架写论文
以下是为您提供的让 AI 根据论文框架写论文的相关指导: 1. 提供详细的背景信息:如您的个人经历、研究主题等,类似于“我来自西班牙巴塞罗那。尽管我的童年经历了一些创伤性事件,比如我 6 岁时父亲去世,但我仍然认为我有一个相当快乐的童年……”这样具体且全面的描述。 2. 结构化组织内容:使用编号、子标题和列表来使论文条理清晰,例如规定概述内容解读结语的结构,或者分标题阐述不同部分。 3. 明确文章结构:包括开门见山且能引起目标群体悬念的标题,说清楚要解决的问题及背景、可能导致的损失的第一部分,以案例引入的第二部分,对案例进一步分析的第三部分,以及给出具体操作建议的第四部分。 4. 丰富细化内容:先让 AI 写故事概要和角色背景介绍并做修改,然后一段一段进行细节描写,可采用让 AI 以表格形式输出细节描述的技巧,确保内容具体且前后一致。 5. 注意语言风格:可以自己定义,也可以根据文章生成对应语言风格关键词让 AI 遵循。 6. 遵循相关要求:比如某些比赛对作品的字数、修改限制等。 需要注意的是,虽然可以利用 AI 辅助写作,但并非提倡这是道德的使用方式。同时,如果是接收方,最好为组织准备好迎接各种 AI 生成的内容。
2025-03-30
文本转化成ppt的AI工具,上传自己的模版
以下为一些可将文本转化成 PPT 且能上传自己模版的 AI 工具及使用指南: 1. 闪击 网址:https://ppt.isheji.com/?code=ysslhaqllp&as=invite 选择模版 输入大纲和要点:由于闪击的语法和准备的大纲内容可能有偏差,可参考官方使用指南:https://zhuanlan.zhihu.com/p/607583650,将大纲转换成适配闪击的语法。 生成 PPT:点击文本转 PPT,并在提示框中选择确定。 在线编辑 导出:导出有一些限制,PPT 需要会员才能导出。 2. Process ON 网址:https://www.processon.com/ 输入大纲和要点: 导入大纲和要点: 手动复制,相对比较耗时间。 导入方式: 复制最终大纲的内容,到本地的 txt 文件后,将后缀改为.md。如果看不见后缀,可以自行搜索开启后缀。 打开 Xmind 软件,将 md 文件导入 Xmind 文件中。 Process ON 导入 Xmind 文件。以导入方式新建思维导图。 输入主题自动生成大纲和要求:新增思维导图,输入主题,点击 AI 帮我创作。 选择模版并生成 PPT:点击下载,选择导入格式为 PPT 文件,选择模版,再点击下载。 3. 其他 AI PPT 工具: Gamma:在线 PPT 制作网站,允许用户通过输入文本和想法提示快速生成幻灯片,支持嵌入多媒体格式,如 GIF 和视频,以增强演示文稿的吸引力。网址:https://gamma.app/ 美图 AI PPT:由知名图像编辑软件“美图秀秀”的开发团队推出,允许用户通过输入简单的文本描述来生成专业的 PPT 设计,包含丰富的模板库和设计元素。网址:https://www.xdesign.com/ppt/ Mindshow:AI 驱动的 PPT 辅助工具,提供一系列的智能设计功能,如自动布局、图像选择和文本优化等。网址:https://www.mindshow.fun/ 讯飞智文:由科大讯飞推出的 AI 辅助文档编辑工具,利用科大讯飞在语音识别和自然语言处理领域的技术优势,提供智能文本生成、语音输入、文档格式化等功能。网址:https://zhiwen.xfyun.cn/
2025-03-30
2025年3月27日AI新闻
以下是 2025 年 3 月 27 日的部分 AI 新闻: 《详解 MCP:Agentic AI 中间层最优解,AI 应用的标准化革命》:Anthropic 推出的开放协议 MCP 迅速垄断了 Agentic AI 的中间层,类似于 AI 应用的 USBC 端口。它简化了开发者与数据源的整合,促进了生态形成,可能成为“Agentic AI 领域的 Stripe”,为未来 AI 应用的标准化革命奠定基础。 《对谈|如何用 AI 增强人类学习》:Howie.Serious 与 Indigo 探讨了费曼学习法与 AI 创作的结合,强调输出能迫使知识内化。两位终身学习者分享了如何通过高效利用 AI 提升写作与学习,推动思维深度,指出未来的 AI Agent 应具备更强的自动化整合能力,助力人类保持独特价值与创造力。 《硅谷知名风投 BVP 专栏:消费级 AI 的临界点将至!》:消费级 AI 正迎来临界点,推动一波又一波的变革。随着基础模型成本降低和多模态技术进步,新的消费类 AI 公司不断涌现。未来,AI 将重塑旅行、购物和社交体验,提升个性化服务的准确性与便利性。 此外,2 月 27 日的相关新闻有:小红书 AI 赛道从 0 到 1 做 IP 的相关活动预告、工具分享及日更群计划。3 月 5 日的新闻包括:2025 开年 3 个月 AI 已经狂飙,更新密集发布;Grok 语音模式全面开放,支持 11 种模式(包括 2 种 18 禁),自带语音字幕,目前仅支持英文。
2025-03-27
3月27日,AI圈有哪些新闻
以下是 3 月 27 日 AI 圈的部分新闻: 《详解 MCP:Agentic AI 中间层最优解,AI 应用的标准化革命》:Anthropic 推出的开放协议 MCP 迅速垄断了 Agentic AI 的中间层,类似于 AI 应用的 USBC 端口,简化了开发者与数据源的整合,促进了生态形成,可能成为“Agentic AI 领域的 Stripe”,为未来 AI 应用的标准化革命奠定基础。 《对谈|如何用 AI 增强人类学习》:Howie.Serious 与 Indigo 探讨了费曼学习法与 AI 创作的结合,强调输出能迫使知识内化,分享了如何通过高效利用 AI 提升写作与学习,推动思维深度,指出未来的 AI Agent 应具备更强的自动化整合能力,助力人类保持独特价值与创造力。 《硅谷知名风投 BVP 专栏:消费级 AI 的临界点将至!》:消费级 AI 正迎来临界点,推动变革。随着基础模型成本降低和多模态技术进步,新的消费类 AI 公司涌现,未来 AI 将重塑旅行、购物和社交体验,提升个性化服务的准确性与便利性。 此外,还有以下商业和技术方面的新闻: AI 商业爆发年:可灵 AI 营收破亿元,AIGC 营销素材日均消耗超 3000 万元。快手将 AI 作为生态重塑核心,引领视频生成模型全球竞速。可灵 AI 技术领先 Sora,获马斯克、MIT 科技评论等国际认可。 小白福音 Trickle:一键部署、无需 API,能直接克隆 Claude 聊天体验。面向非开发者,帮助快速从创意→上线,打通完整产品流程。模板丰富,涵盖问卷、小游戏、互动课程等多种场景。 拓竹 H2D 多才多艺:精度提升一个数量级,打印成品可直接使用。集成 3D 打印、激光雕刻、刀切、彩绘,支持双头多色打印。搭载视觉摄像头和神经算法,实现微米级精度。
2025-03-27
3月26日至今AI圈有哪些新闻
以下是 3 月 26 日至今 AI 圈的部分新闻: 3 月 26 日: 【AI 模型及应用】OpenAI 推出 GPT4o 图像生成能力;谷歌发布 Gemini 2.5 Pro Experimental 模型;Trea 已内置 DeepSeekV30324。 【AI 音乐】昆仑万维发布全球首款音乐推理大模型 Mureka O1。 【AI 视频】混元 Portrait 实现音频视频驱动图片肖像形成动画;PPVCtrl 推出新可控制视频生成模型。 【AI 3D】Vibe Draw 可通过草图进行 3D 建模;PhysTwin 通过视频创建交互式物理数字孪生;GroomLight 用于重打光的人体头发外观建模的混合逆向渲染。 3 月 27 日: 《》:MCP(Model Context Protocol)是由 Anthropic 推出的开放协议,迅速垄断了 Agentic AI 的中间层,类似于 AI 应用的 USBC 端口。它简化了开发者与数据源的整合,让 AI 应用无缝连接各种工具和服务。MCP 不仅促进了生态的形成,甚至可能成为“Agentic AI 领域的 Stripe”,为未来 AI 应用的标准化革命奠定基础。 《》:Howie.Serious 与 Indigo 探讨了费曼学习法与 AI 创作的结合,强调“输出能迫使知识内化”。两位终身学习者分享了如何通过高效利用 AI 提升写作与学习,推动思维深度,指出未来的 AI Agent 应具备更强的自动化整合能力,助力人类保持独特价值与创造力。“真正的深度与灵感,源于人类富有情境的问题。” 《》:消费级 AI 正迎来临界点,推动一波又一波的变革。随着基础模型成本降低和多模态技术进步,新的消费类 AI 公司如雨后春笋般涌现。未来,AI 将重塑旅行、购物和社交体验,提升个性化服务的准确性与便利性。正如报告所言:“AI 的进步既是开创新产品的源动力,也是消费巨头崛起的分销载体。” 3 月 26 日: AI 商业爆发年:可灵 AI 营收破亿元,AIGC 营销素材日均消耗超 3000 万元。快手将 AI 作为生态重塑核心,引领视频生成模型全球竞速。可灵 AI 技术领先 Sora,获马斯克、MIT 科技评论等国际认可。 小白福音 Trickle:一键部署、无需 API,能直接克隆 Claude 聊天体验。面向非开发者,帮助快速从创意→上线,打通完整产品流程。模板丰富,涵盖问卷、小游戏、互动课程等多种场景。 拓竹 H2D 多才多艺:精度提升一个数量级,打印成品可直接使用。集成 3D 打印、激光雕刻、刀切、彩绘,支持双头多色打印。搭载视觉摄像头和神经算法,实现微米级精度。 Figure 人形机器人新突破。
2025-03-27
如何订阅最新的ai新闻
以下是一些订阅最新 AI 新闻的途径: 公众号: “超时空视角”:提供 AI 资讯。 猫叔个人公众号“AI 替代人类”。 “歸藏的 AI 工具箱”:有 AI 课程撰写与信息收集整理,适合 AI 从业人员或想加入该领域工作的人,免费订阅可获得日常内容更新,付费会员可获得更多服务,如记录上周值得关注的 AI 领域主要发布、核心从业者需要关注的 AI 动态、涉及各个 AI 领域的优质内容、过去一周最重要的研究论文和简短解读介绍,还能加入核心粉丝群获得最及时的 AI 资讯通知和优先工作撮合机会。 小红书/抖音:“EverAI”。 B 站:“Ever AI 酱”,这里会有教程及 AI 工具界面操作。
2025-03-24
今天是2025-3-20日,给下最近一周的AI相关新闻
以下是最近一周(2025 年 3 月 14 日至 20 日)的 AI 相关新闻: 在 GTC 2025 大会上,黄仁勋展示了英伟达的最新芯片 Blackwell Ultra,强调其性能是 Hopper 的 40 倍,预计 2025 年将出货 360 万颗。黄仁勋反驳市场质疑,指出推理的算力需求远超预期,Dynamo 的推出将优化 GPU 利用率。尽管市场信心动摇,英伟达依然展现了其作为 AI 算力领导者的决心,“只要有 Token 就有英伟达的生意”。 本文介绍了如何通过 MCP(Model Context Protocol)将 Claude 3.7 与 Blender 连接,实现一句话生成 3D 场景的功能。Claude 作为“大脑”,MCP 为“桥梁”,Blender 则是“手脚”,三者紧密协作,使得 3D 建模变得简单而高效。随着 MCP 的崛起,AI 不再是数据孤岛,未来的 AI 智能体将能自主完成更复杂的任务,开启创作的新纪元。 AI 切磋大会第 11 期报名开启!3 月 30 日,主题是“2 小时,让 AI 将你的创意变为现实”。无论你是编程小白还是高手,欢迎来现场展示你们的案例。 Yourware 是一款强大的工具,让普通用户轻松创建和部署 AI 编程作品集。只需复制代码,即可一键部署网页,快速展示自己的创作。此外,平台提供了全球优秀作品的参考,极大激发灵感。更有一键美化功能,让网页焕然一新,分享权限也能自由控制。 谷歌以 320 亿美元收购网络安全公司 Wiz,创下其历史上最大收购案。Wiz 在 18 个月内实现 1 亿美元年收入,成为史上最快的软件公司之一。创始团队拥有近 20 年的友谊和合作,先后成立 Adallom 并被微软收购,再打造 Wiz。
2025-03-20
今天是2025年3月20日,给下最近一周的AI相关新闻
以下是最近一周(2025 年 3 月 19 日至 3 月 20 日)的 AI 相关新闻: 3 月 20 日: 在 GTC 2025 大会上,黄仁勋展示了英伟达的最新芯片 Blackwell Ultra,强调其性能是 Hopper 的 40 倍,预计 2025 年将出货 360 万颗。黄仁勋反驳市场质疑,指出推理的算力需求远超预期,Dynamo 的推出将优化 GPU 利用率。尽管市场信心动摇,英伟达依然展现了其作为 AI 算力领导者的决心,“只要有 Token 就有英伟达的生意”。 介绍了如何通过 MCP(Model Context Protocol)将 Claude 3.7 与 Blender 连接,实现一句话生成 3D 场景的功能。Claude 作为“大脑”,MCP 为“桥梁”,Blender 则是“手脚”,三者紧密协作,使得 3D 建模变得简单而高效。随着 MCP 的崛起,AI 不再是数据孤岛,未来的 AI 智能体将能自主完成更复杂的任务,开启创作的新纪元。 3 月 19 日: “回答我!Look in my eyes!Tell me why?baby why?”——最近全网都被这句魔性古风骂人视频刷屏了!古人+现代梗的爆笑碰撞,不只是娱乐玩梗,更成了宣传、带货、文旅推广的新利器。本文手把手教你 0 基础复刻这类 AI 视频,搭配爆款文案+AI 人物+鬼畜视频合成,让你也能轻松玩转流量密码,打造自己的“AI 古人爆款工厂”! 在 GTC2025 大会上,黄教主分享了十五个“饼”,涵盖数据中心的未来、强大的 CUDA、边缘计算与 6G 结合、汽车智能驾驶安全方案等多个领域。他强调,未来推理需求将暴增,并推出新款 NVL72 服务器,性价比显著提升。管推出了多项创新,黄教主仍未解答算力通缩的疑问,未来的硬件发展将面临更多挑战。延伸阅读:《[“AI 工厂时代降临”:黄仁勋 GTC2025 主旨演讲图文全文 3 万字》
2025-03-20
最近流行的ai技术
AI 技术的发展历程和前沿技术点如下: 发展历程: 1. 早期阶段(1950s 1960s):包括专家系统、博弈论、机器学习初步理论。 2. 知识驱动时期(1970s 1980s):有专家系统、知识表示、自动推理。 3. 统计学习时期(1990s 2000s):出现机器学习算法,如决策树、支持向量机、贝叶斯方法等。 4. 深度学习时期(2010s 至今):深度神经网络、卷积神经网络、循环神经网络等得到广泛应用。 当前前沿技术点: 1. 大模型(Large Language Models):如 GPT、PaLM 等。 2. 多模态 AI:包括视觉 语言模型(CLIP、Stable Diffusion)、多模态融合。 3. 自监督学习:例如自监督预训练、对比学习、掩码语言模型等。 4. 小样本学习:如元学习、一次学习、提示学习等。 5. 可解释 AI:涉及模型可解释性、因果推理、符号推理等。 6. 机器人学:涵盖强化学习、运动规划、人机交互等。 7. 量子 AI:包括量子机器学习、量子神经网络等。 8. AI 芯片和硬件加速。 学习路径: 偏向技术研究方向: 1. 数学基础:线性代数、概率论、优化理论等。 2. 机器学习基础:监督学习、无监督学习、强化学习等。 3. 深度学习:神经网络、卷积网络、递归网络、注意力机制等。 4. 自然语言处理:语言模型、文本分类、机器翻译等。 5. 计算机视觉:图像分类、目标检测、语义分割等。 6. 前沿领域:大模型、多模态 AI、自监督学习、小样本学习等。 7. 科研实践:论文阅读、模型实现、实验设计等。 偏向应用方向: 1. 编程基础:Python、C++等。 2. 机器学习基础:监督学习、无监督学习等。 3. 深度学习框架:TensorFlow、PyTorch 等。 4. 应用领域:自然语言处理、计算机视觉、推荐系统等。 5. 数据处理:数据采集、清洗、特征工程等。 6. 模型部署:模型优化、模型服务等。 7. 行业实践:项目实战、案例分析等。 无论是技术研究还是应用实践,数学和编程基础都是必不可少的。同时需要紧跟前沿技术发展动态,并结合实际问题进行实践锻炼。 近期热门融资的 AI 产品,如 Genspark、Rockset、ButterfliesAI、MeetRecord 等,不仅展示了技术的先进性,也为各行各业提供了高效、智能的信息处理和决策支持工具。
2025-03-29
最近有什么AI比赛
以下是为您整理的近期 AI 比赛: 1. 【灵璧 AI】安徽文创 截止日期:0115 0315 奖金奖项:一等奖 2k1、二等奖 1k2、三等奖 8005 主题+作品类型:赛道一为数字艺术创作,利用 AIGC 技术创作数字绘画、数字雕塑等艺术作品;赛道二为互动体验设计,设计互动体验项目,如 AR/VR 体验、互动游戏等;赛道三为数字故事讲述,创作以虞姬及灵璧特色历史文化为主题的数字故事,如动画短片等。 关键要求:只能提交一份作品。以压缩包上传,材料包含创作作品的源文件、prompt 指令、制作过程的关键过程截图、录屏与说明等。 提交方式:邮箱 链接: 2. 创无界智未来·文旅应用赛 截止日期:0101 0330 奖金奖项:一等奖 10w1、二等奖 6w2、三等奖 3w3 主题+作品类型:四个赛道 关键要求:模糊 提交方式:官网 链接: 3. 【凌家滩】AI 创作大赛 截止日期:0101 0415 奖金奖项:一等奖 2w1、二等奖 8k2、三等奖 2k3、优秀奖 010 主题+作品类型:“文化遗产的数字化重现与未来表达”AI 图像/AIMV/AI 视频 关键要求:无 提交方式:无 链接: 4. 【云山杯】AIGC 大赛 截止日期:0116 0225 奖金奖项:四赛道分别为一等奖 2k1、二等奖 1k1、三等奖 3003、优秀奖 10020 主题+作品类型:图片、视频、文本、音频 关键要求:【AI 图片】1.设计一个代表“杯云山”的全新品牌标志,融合传统与现代元素。2.创作一套完整的品牌视觉形象,包括颜色、字体和图案设计。【AI 视频】1.制作一个简短视频,介绍“杯云山”品牌的历史、价值观和产品特色。2.制作一段云南茶文化的纪录片,展示其历史、传统和现代发展的融合。【AI 文本】1.撰写关于“杯云山”品牌从创立到发展的故事,突出品牌的传承与创新。2.编写一个以茶园为背景的微型剧本,展示茶叶从种植到品鉴的全过程。【AI 音乐】1.创作能够代表“杯云山”的纯音乐,体现茶园的宁静与创新的活力。2.将传统云南音乐元素与现代电子音乐相结合,创作段具有地域特色和创新感的音乐作品。 提交方式:无 链接: 5. 智绘未来【台州】AI 大赛 截止日期:0122 0309 奖金奖项:①一等奖 5k1、二等奖 2k3、三等奖 1k5、台州奖 1k1;②一等奖 5.5k1、二等奖 2.5k2、三等奖 1.5k3、台州奖 1k1 主题+作品类型:AI 绘画赛道、AI 视频赛道(60S 以上) 关键要求:分辨率 2K 以上,【加分项】展现台州自然风光、人文历史、城市印象等元素,对台州未来景象的想象,或对台数字馆的未来想象相关的台州元素(额外在总分值增加 10%的分数) 提交方式:AITOP100 平台,投稿后必须转发至小红书分享并带上话题智绘未来+关注官方账号@台州数字馆。 链接:
2025-03-27
最近新出的大模型有哪些
最近新出的大模型有: 1. 通义千问推出的 Qwen2.5Max 大型专家模型,通过 SFT 和 RLHF 策略后训练,性能与顶尖模型竞争,在多个基准测试中超越了 DeepSeek V3,引发了 AI 社区对大规模专家模型的高度关注。相关链接: Blog: Qwen Chat: (选择 Qwen2.5Max 模型) API: HF Demo: 2. 阿里云发布的 Qwen2.5VL 新一代视觉语言模型。
2025-03-27
吴恩达最近推出了哪些课程?
吴恩达最近推出的课程包括: 1. 与 OpenAI 合作推出的免费的 Prompt Engineering(提示工程师)课程。 主要内容是教书写 AI 提示词,并利用 GPT 开发一个 AI 聊天机器人。 原版网址:https://www.deeplearning.ai/shortcourses/chatgptpromptengineeringfordevelopers/ B 站版本:【合集·AI Course哔哩哔哩】https://b23.tv/ATc4lX0 、https://b23.tv/lKSnMbB 翻译版本: 推荐直接使用 Jupyter 版本学习,效率更高:https://github.com/datawhalechina/promptengineeringfordevelopers/ 视频下载地址:https://pan.quark.cn/s/77669b9a89d7 OpenAI 开源了教程:https://islinxu.github.io/promptengineeringnote/Introduction/index.html 纯文字版本 2. 2023 年 8 月 24 日上线的最新短课程: 《》,课程内容包括了解何时对 LLM 应用微调、准备数据以进行微调、根据自己的数据训练和评估 LLM。 《》,深入浅出地介绍了基于大语言模型的 AI Agents,从记忆检索到决策推理,再到行动顺序的选择,真实展现了 Agent 的智能化进程。
2025-03-27
最近有什么新产品
以下是近期的一些 AI 新产品: Microsoft 在 Build 2023 发布了 50 多项与 AI 相关的新产品。 Google 将图像生成功能整合进商业营销工具与 Bard,并正式开始测试 AI 版搜索引擎。 Meta 开源了基于圣经训练的、能识别超过 4,000 种口语、对 1,100 多种语言进行语音文字互换的 MMS 模型。 NVIDIA 突破万亿美元市值,其 CEO 黄仁勋在 COMPUTEX 大会上推出一系列产品,包括搭载 256 颗 GH200 Grace Hopper 超级芯片的新型 DGX GH200 超算。 此外,还有以下新产品: 包括 4 个有用的和 3 个好玩的新产品,5 个初创公司的新产品以及 2 家大公司的新动态。 有用的新产品从通用场景及垂直场景进行了划分,还单列了模型训练、AI 安全、代码学习和 AI 代理等关注度较高的类别。 好玩的新产品各有特色,如 Andrej Karpathy 本人开发的电影搜索工具、梦境生成与存储器、虚拟音乐电台等。 15 个初创企业的新产品,从开源和闭源的角度进行了划分,开源产品有 8 个,闭源有 7 个。 14 个大公司的新产品,包括微软、谷歌、英伟达、苹果、Palantir 等公司,还有来自俄罗斯的 Sberbank。 在软件方面: :一家专注于人工智能技术的创新公司,最近推出了全新的开源图像生成模型 DeepFloyd IF,能生成高质量图像,具有良好的可控性和稳定性。 :一个社区组织,致力于为制作人和音乐家开发开源的音频生成工具。 ,用于微调 HuggingFace 语言模型。 :一个去中心化的研究社区,旨在将机器学习和生物学相结合,推动科学研究的民主化。 :一种新颖、开放和协作的医学 AI 研究方法。 :最新最先进的开源文本图像模型,语言理解能力强,生成的图像真实感高。 :一个应用程序套件,可帮助使用 AI 轻松修改图像。
2025-03-26
最近有什么新产品
以下是近期的一些 AI 新产品: Microsoft 在 Build 2023 发布了 50 多项与 AI 相关的新产品。 Google 将图像生成功能整合进商业营销工具与 Bard,并正式开始测试 AI 版搜索引擎。 Meta 开源了基于圣经训练的、能识别超过 4,000 种口语、对 1,100 多种语言进行语音文字互换的 MMS 模型。 NVIDIA 突破万亿美元市值,其华人 CEO 黄仁勋在 COMPUTEX 大会上推出一系列产品,包括搭载 256 颗 GH200 Grace Hopper 超级芯片的新型 DGX GH200 超算。 此外,还有以下具体的新产品: 有用的和好玩的新产品:包括 4 个有用的、3 个好玩的、5 个初创公司的新产品以及 2 家大公司的新动态。 初创公司的新产品如:StabilityAI 推出的全新开源图像生成模型 DeepFloyd IF;Harmonai 为制作人和音乐家开发的开源音频生成工具;CarperAI 开源的 Transformer Reinforcement Learning X等。 好玩的产品如 Andrej Karpathy 本人开发的电影搜索工具等。 4 月动态中的新产品: 15 个初创企业的新产品,分为开源和闭源。 39 个有用的和 10 个好玩的新产品,包括从通用场景、垂直场景划分的产品,以及模型训练、AI 安全、代码学习和 AI 代理等类别。 14 个大公司的新产品,如微软、谷歌、英伟达、苹果、Palantir 等公司的产品。
2025-03-26