AI日报:黑森林实验室放出Flux3;Claude Opus现已支持语音模式;快手入局AI互动内容赛道
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。1、黑森林实验室放出Flux3:首个原生生成音频的多模态基础模型,20秒音画同步一次成型黑森林实验室发布的Flux3多模态基础模型,首次实现了原生音频...
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。1、黑森林实验室放出Flux3:首个原生生成音频的多模态基础模型,20秒音画同步一次成型黑森林实验室发布的Flux3多模态基础模型,首次实现了原生音频...
一份来自英美两大 AI 安全机构的联合评测,把月之暗面最新模型 Kimi K3的"另一面"摊在了阳光下。英国人工智能安全研究所(UK AISI)与美国人工智能标准与创新中心(CAISI)合力给这款模型做了一次攻击性网络任务体检,结论是:它在漏洞利用开发和模拟网络攻击上大幅落后于美国领先的前沿模型,但...
Black Forest Labs宣布以Early Access方式上线推出FLUX3 多模态基础模型,采用统一架构联合学习图像、视频和音频。该模型基于Self-Flow(自监督流匹配)学习框架扩展,同步训练视频、图像和音频,在FLUX. 1 和FLUX. 2 系列基础上进一步扩展至多模态生成与理解...
7月24日,红果短剧发布《关于规范AI剧角色创作的公告》,从角色差异化与版权合规两个维度明确创作标准,旨在降低“高频AI脸”使用率,防范素材违规风险。规范要求,单部剧集主要角色需具备清晰区分度与高辨识度,严禁跨剧或跨角色复用高度相似形象,以缓解审美疲劳。版权方面划定三条红线:未经授权不得使用他人独创...
2026 年国际数学家大会在费城开幕,本年度菲尔兹奖四位得主揭晓——邓煜、约翰·帕登、雅各布·齐默尔曼与王虹。其中邓煜、王虹成为菲尔兹奖自设立以来首批获此殊荣的中国籍数学家,而另一位新科得主齐默尔曼则在赛后新闻发布会上宣布,将转向AI安全领域研究并即将加入OpenAI。核心猜想被攻克,数学天赋获Op...
Runway公司宣布推出Runway Media Router,在生成图像、视频、音频时可根据使用场景灵活切换所用AI模型。系统将模型选择标准归纳为质量、处理速度和成本三项,依据单次请求的优先级自动切换模型,大幅减少开发者逐一比较和手动切换模型的负担。三大场景智能匹配,省钱省时两不误Runway将模...
小鹏人形机器人近日在广州工厂正式开启小批量试生产,量产产线已进入最后联调阶段,标志着其量产冲刺进入倒计时。此前,小鹏集团董事长兼CEO何小鹏已亲自兼任机器人业务“CEO”,全面统筹并推进该业务的商业化落地进程。按照小鹏内部机器人量产动员大会规划,公司将于2026年正式实现人形机器人的量产,并计划自2...
德国人工智能初创公司黑森林实验室(Black Forest Labs)正式发布多模态基础模型 Flux3。它基于 Self-Flow 架构打造,配备专用的图像、视频、音频及动作编解码器,把对物理世界与数字环境的统一理解与生成揽到了一起。最扎眼的一点是音视频同步。Flux3是首个支持原生音频生成的多模...
当地时间7月23日上午,2026年国际数学家大会在费城开幕,本年度菲尔兹奖四位得主揭晓——邓煜、约翰·帕登、雅各布·齐默尔曼与王虹。其中邓煜、王虹成为菲尔兹奖自设立以来首批获此殊荣的中国籍数学家,写下历史一笔。而在这场数学界最高荣誉的发布会后,一位新科得主顺势宣布了自己人生的下一个方向:深耕 AI ...
继抖音内测“AI互动空间”后,快手正式宣布将推出“AI互动内容”创作功能,目前已开放首批合作创作者招募,标志着短视频平台竞争从传统内容时长延伸至交互式体验领域。据《读佳》获悉,快手此次招募面向对AI互动剧情、AI角色对话、互动轻应用有创作兴趣或经验的创作者,要求具备持续更新能力。入选者将抢先体验创作...
7 月 24 日,据媒体报道,腾讯已于 7 月 23 日宣布,将混元多模态模型部门与大语言模型部门合并,新设基础模型部,统一由腾讯首席 AI 科学家姚顺雨管理。这次重组的目的很明确——提升模型研发与协同效率,去探一探全模态模型的智能上限。这步棋早有伏笔。去年 12 月,姚顺雨便已兼任大语言模型部负责...
谷歌的算力账单,正在以惊人的斜率往上爬。Alphabet 第二季度财报显示,资本支出同比暴涨100%,冲到创纪录的449.2亿美元,按这个节奏年化,全年支出已逼近1800亿美元。而真正的故事,是这笔钱背后那台越转越快的赚钱机器。二季度谷歌营收同比增长24%,达到1198亿美元,高于分析师预估的约11...
据 MacRumors 报道,苹果公司近日更新了 Apple Store 应用的隐私政策,暗示该平台即将推出“虚拟购物助手”功能,旨在通过生成式 AI 对话界面解答产品疑问并辅助用户决策。此前,苹果已在 Apple Support 应用中引入类似虚拟助手,此次将 AI 交互能力拓展至 retail ...
OpenAI发布公告,宣布升级ChatGPT桌面应用(已与Codex合体),引入由GPT-Live模型驱动的ChatGPT Voice语音模式。用户可在聊天、办公和编程三个板块中,通过语音发起、检查或调整任务,实现多线程工作协同。全双工语音加持,边聊边干活在发展历程上,OpenAI于 2024 年首...
有些难题,光靠打字是解不开的。Anthropic 今天给 Claude 语音模式动了一次关键升级——它不再只跑轻量级的 Haiku,而是能运行在 Claude Opus、Claude Sonnet 和 Claude Haiku 三档模型上,同时接上了 Gmail、Slack 这类已连接的工具,并把支...
7月24日,阿里巴巴宣布开源发布仅0.8B参数规模的文档解析模型OvisOCR2。在权威文档解析基准OmniDocBench v1.6评估中,该模型以96.58的综合得分登顶,成为首个全面超越传统流水线方法的端到端文档解析模型,标志着文档智能技术领域迎来突破性范式转折。作为RAG检索、智能问答与企业...
德国AI初创公司黑森林实验室正式发布多模态基础模型Flux3。该模型基于Self-Flow架构打造,配备专用的图像、视频、音频及动作编解码器,实现了对物理与数字环境的统一理解与生成。性能碾压Luma与Runway,对标顶尖模型作为首款支持原生音频生成的模型,Flux3 可一次性输出长达 20 秒的音...
评测编码智能体,过去总在几块割裂的场子里打转——修 bug 的看 SWE-bench,做前端的看 Design2Code,生产环境的基准又多半关着门不让外人审计。腾讯这次把四块拼到一处,端出一个叫 WorkBuddy Bench 的多领域评测套件,论文已挂在 arXiv 上。它最较劲的地方不在于题多...
OpenAI 今天给 ChatGPT 桌面应用动了一刀大升级——这个已经和 Codex 合体的客户端,正式引入了由 GPT-Live 模型驱动的 ChatGPT Voice 语音模式。新版里,用户可以在聊天(Chat)、办公(Work)和编程(Codex)三个板块里,直接用语音发起、检查或调整任务,...
据路透社报道,美国白宫科技政策办公室主任迈克尔·克拉齐奥斯正关注OpenAI披露的AI系统测试失控事件。与此同时,美国国会议员提出《AI紧急停止法案》,拟授权联邦政府叫停可能造成严重危害的AI模型。事件起因是OpenAI日前披露,旗下一个AI智能体在安全测试中突破隔离措施并发起黑客攻击,导致AI开发...