Blog

  • AI专利分析平台Patlytics获450万美元种子轮融资

    Patlytics

    2024年4月11日,总部位于美国旧金山的AI驱动的专利分析平台 Patlytics 宣布筹集了 450 万美元的种子资金,本轮融资由谷歌旗下专注于人工智能的风险基金 Gradient Ventures 领投, 8VC、Alumni Ventures、Gaingels、Joe Montana’s Liquid 2 Ventures、Position Ventures、Tribe Capital、Vermilion Ventures 和多位天使投资人参投。

    该公司计划将筹集的资金用于产品和AI功能研发以及扩大市场和工程团队。

    Patlytics 由首席执行官 Paul Lee 和首席技术官 Arthur Jen 联合创立于 2024 年,该公司提供一个人工智能驱动的专利分析平台,以帮助企业、知识产权专业人士和律师事务所加快从发现、分析、比较、起诉到诉讼的专利工作流程。

    (消息来源:BusinessWire

  • AI网络安全初创公司Simbian获1000万美元种子轮融资

    Simbian

    2024年4月11日,总部位于美国加州山景城的AI网络安全初创公司 Simbian 宣布筹集了1000万美元的种子资金,本轮融资的投资方包括 Cota Capital、Icon Ventures、Firebolt 和 Rain Capital 等专注于安全和人工智能的投资者以及多位知名天使投资人。

    该公司计划将筹集的资金用于扩大运营和业务范围。

    Simbian 由首席执行官 Ambuj Kumar 和首席技术官 Alankrit Chona 于 2023 年联合创立,推出了一款由生成式 AI 驱动的网络安全Copilot,将安全智能的 AI 解决方案集成到不同的 IT 环境中,以最大限度地扩大覆盖范围并加快解决方案,满足安全团队不断变化的需求。其AI安全助手会持续观察用户的行为和环境,并随着时间的推移学会自主执行日益复杂的任务。

    (消息来源:SiliconANGLE

  • Parler-TTS – Hugging Face开源的文本转语音模型

    Parler-TTS是什么

    Parler-TTS是由Hugging Face推出的一款开源的文本到语音(TTS)模型,能够通过输入提示描述模仿特定说话者的风格(性别、音调、说话风格等),生成高质量、听起来自然的语音。该轻量级的TTS模型是完全开源的,包括所有数据集、预处理、训练代码和权重都公开,旨在促进高质量、可控制的TTS模型的创新发展。Parler-TTS的架构基于MusicGen,包含文本编码器、解码器和音频编解码器,通过集成文本描述和添加嵌入层优化了声音生成。

    Parler-TTS

    Parler-TTS的官网入口

    Parler-TTS的功能特性

    • 高质量语音生成:Parler-TTS能够根据文本输入生成高质量、自然听起来的语音,模仿不同的说话风格,如性别、音高和表达方式等。
    • 风格多样的语音输出:通过详细的文本描述,用户可以控制生成的语音风格,包括说话者的年龄、情感、速度和环境等特征。
    • 开源架构:Parler-TTS基于MusicGen架构,包含文本编码器、解码器和音频编解码器,允许研究者和开发者自由访问和修改代码,以适应不同的需求和应用。
    • 易于安装和使用:Parler-TTS提供了简单的安装指令,用户可以通过一行命令安装,并提供了易于理解的代码示例,使得即使是初学者也能快速上手使用。
    • 自定义训练和微调:用户可以根据自己的数据集对Parler-TTS进行训练和微调,以生成特定风格或口音的语音。
    • 伦理和隐私保护:Parler-TTS避免了使用可能侵犯隐私的声音克隆技术,而是通过文本提示来控制语音生成,确保了技术的伦理性和合规性。

    如何体验Parler-TTS

    1. 访问Parler-TTS的Hugging Face Demo,然后在Input Text处输入你想要转录的文字
    2. 在Description处输入对声音的提示描述
    3. 最后点击Generate Audio即可生成声音

    Parler-TTS Demo

    Parler-TTS的技术架构

    Parler-TTS的架构是一个高度灵活和可定制的系统,基于MusicGen架构进行了一些关键的改进和调整:

    1. 文本编码器
      • 文本编码器的作用是将文本描述映射到一系列隐藏状态表示。
      • Parler-TTS使用的是一个冻结的文本编码器,该编码器完全初始化自Flan-T5模型。这意味着编码器的参数在训练过程中不会改变,它仅仅用于将输入的文本转换为模型可以理解的内部表示。
    2. Parler-TTS解码器
      • 解码器是一个语言模型,它基于编码器的隐藏状态表示自回归地生成音频标记(或称为代码)。
      • 这个过程中,解码器会逐步生成语音的音频表示,每一步都会考虑到之前的输出和文本描述,从而生成连贯且符合描述的语音。
    3. 音频编解码器
      • 音频编解码器的作用是将解码器预测的音频标记转换回可听的音频波形。
      • Parler-TTS使用的是Descript提供的DAC模型,但也可以选择使用其他编解码器模型,例如EnCodec。
    4. 架构的改进
      • Parler-TTS在MusicGen架构的基础上做了一些细微的调整,以提高模型的性能和灵活性。
      • 文本描述不仅通过文本编码器处理,还用于解码器的交叉注意力层,这使得解码器能够更好地结合文本描述和音频生成。
      • 文本提示通过嵌入层处理后与解码器输入的隐藏状态进行拼接,这样可以将文本提示的语义信息直接融入到语音生成的过程中。
      • 音频编码器选择DAC而不是Encodec,因为DAC在质量上表现更佳。
  • AI数据标注初创公司Sapien获500万美元种子轮融资

    Sapien

    2024年4月10日,总部位于美国旧金山的AI数据标注初创公司 Sapien 宣布筹集了 500 万美元的种子资金,本轮融资的投资者包括 Primitive Ventures、Animoca、Artichoke Capital 和 Yield Guild Games 等。

    该公司计划将筹集的资金用于增强其人工智能平台和扩大其区块链基础设施以建立人工标注团队。

    Sapien 成立于 2023 年,正在构建世界上最大、最多样化的人类数据标注网络,人工智能行业依靠该网络来为其高性能模型提供动力。Sapien 通过游戏化和区块链激励来进行人类数据标记的新颖方法创建了积极的强化循环,确保标注者的高度参与和客户的最佳数据质量。

    (消息来源:PR Newswire

  • AI数据安全访问平台PVML获800万美元种子轮融资

    PVML

    2024年4月10日,总部位于以色列特拉维夫的AI数据安全隐私初创公司 PVML 宣布筹集了 800 万美元的种子资金,本轮融资由 NFX 领投,FJ Labs 和 Gefen Capital 跟投。

    PVML 由 Shachar Schnapp 和 Rina Galperin 成立于 2021 年,该公司提供一个数据访问平台,为企业数据提供值得信赖的人工智能接口,并通过差分隐私保护。PVML 将差分隐私(一种密码学手段)与先进的 RAG(检索增强生成)相结合,不仅可以安全、可靠地访问结构化数据,还可以提供对非结构化数据的额外可选支持。

    (消息来源:CTech

  • FloQast获1亿美元E轮融资,以增强AI自动化财务和会计运营

    FloQast

    2024年4月10日,总部位于美国洛杉矶的财务和会计运营初创公司 FloQast 宣布筹集了 1 亿美元的 E 轮融资,希望通过更多人工智能功能来增强其平台。本轮融资由现有投资者 ICONIQ Growth 领投,BDT & MSD Partners 和 World Innovation Lab 等新投资者以及 Meritech Capital 和 Sapphire Ventures 参投。此次融资使 FloQast 的估值超过 16 亿美元,成为金融软件行业最有价值的私企之一。

    该公司计划将筹集的资金用于研发新技术、集成更强的AI功能以及全球市场扩张。

    FloQast 成立于 2013 年,其财务会计平台引入了大量人工智能驱动的自动化,简化了劳动密集型任务,如对账、文档请求和其他影响月末结算、财务报告和工资运营的工作流程。FloQast 目前被全球 2600 多个会计团队使用,包括 Zoom、Snoflake 和洛杉矶湖人队。

    (消息来源:SiliconANGLE

  • CodeGemma – 谷歌开源推出的代码生成大模型

    CodeGemma是什么

    CodeGemma是由Google发布的专注于代码生成和理解的大型语言模型,该系列包含三种不同规模的模型,分别是2B预训练模型、7B预训练模型和7B指令微调模型,旨在提供智能代码补全、生成和自然语言理解等功能。基于谷歌此前发布的Gemma模型,CodeGemma经过大量英语编程、数学数据的训练,以增强逻辑和数学推理能力,支持多种编程语言,并能够集成到开发环境中,简化代码编写流程,提高开发效率。

    Google CodeGemma

    CodeGemma的官网入口

    Google CodeGemma

    CodeGemma的功能特性

    • 代码补全:CodeGemma能够自动补全代码片段,包括函数、方法以及整个代码块,帮助开发者提高编码效率。
    • 代码生成:基于给定的上下文和指令,CodeGemma可以生成新的代码,这对于快速原型设计和解决编程问题非常有用。
    • 自然语言理解:CodeGemma结合了自然语言处理能力,可以理解和解释自然语言指令,使得与模型的交互更加直观和自然。
    • 多语言支持:支持多种编程语言,包括但不限于Python、JavaScript、Java等,使其能够服务于更广泛的开发者群体。
    • 高准确性:CodeGemma 模型基于 Web 文档、数学和代码中的 5000 亿个词元(主要是英语)数据训练而成,生成的代码不仅语法正确,而且语义上也更有意义,从而减少错误并缩短调试时间。
    • 集成开发环境:CodeGemma可以集成到各种开发环境中,减少编写样板代码的工作量,让开发者能够更专注于创新和核心代码的编写。

    CodeGemma的模型系列

    • CodeGemma 2B基础模型:20亿参数的模型专门针对代码填充进行了训练,旨在提供快速的代码补全和生成功能,尤其适用于对延迟和隐私要求较高的环境。
    • CodeGemma 7B基础模型:70亿参数模型的训练数据包含80%的代码填充数据以及20%的自然语言数据,使其不仅能够进行代码补全,还能理解和生成代码及语言。
    • CodeGemma 7B Instruct模型:在CodeGemma 7B的基础上,CodeGemma 7B Instruct模型经过了进一步的微调,以优化指令遵循能力,适合用于对话场景,特别是在讨论代码、编程或数学推理等主题时。

    CodeGemma模型系列

    CodeGemma的性能评估

    除了DeepSeek-Coder-7B,CodeGemma-7B在HumanEval基准测试中的表现超越了多数同类的7B模型,该基准测试广泛用于评估Python代码模型的性能。此外,在评估Java、JavaScript和C++等其他编程语言时,CodeGemma-7B也显示出卓越的性能,这些评估是基于MultiPL-E完成的,MultiPL-E是HumanEval基准测试的一个多语言扩展版本。根据技术报告,CodeGemma-7B在GSM8K测试中表现最为出色,位列所有7B模型之首。这些性能评估结果凸显了CodeGemma-7B在代码理解和生成方面的先进能力。

    CodeGemma性能对比

  • AI数据安全初创公司Cyera已筹集3亿美元C轮融资

    Cyera AI

    2024年4月9日,总部位于美国纽约的AI数据安全初创公司 Cyera 确认已筹集 3 亿美元的 C 轮融资,估值达 14 亿美元。本轮的投资方包括 Coatue、Spark Capital、Georgian、AT&T Ventures、红杉资本、Accel、Redpoint 和 Cyber​​starts。

    Cyera 成立于 2021 年,该公司构建了一个基于人工智能的数据安全平台,帮助企业了解其网络中所有数据的位置和移动,以保护企业数据免受网络攻击或防止数据无意中泄漏到大型语言模型中。简而言之,Cyera 构建了一个平台,可以对组织的数据、数据的创建位置、存储位置以及使用位置进行全面评估。

    (消息来源:TechCrunch

  • AI大模型初创公司Symbolica获3300万美元融资

    Symolica AI

    2024年4月9日,总部位于美国旧金山的AI大模型初创公司 Symbolica 宣布已筹集了 3300 万美元的总资金(A 轮 + 种子轮),由 Khosla Ventures 领投,Day One Ventures、General Catalyst、Abstract Ventures 和 Buckley Ventures 参投。

    Symolica AI 由特斯拉前高级自动驾驶工程师 George Morgan 于 2022 年成立,该公司正在构建一个新颖的结构化模型(符号人工智能模型),通过采用该模型,可以在不依赖大量数据和计算资源的情况下实现更高效、更可控的人工智能发展。

    (消息来源:TechCrunch

  • AI销售支持平台GTM Buddy获800万美元A轮融资

    GTM Buddy

    2024年4月9日,总部位于美国北卡罗来纳州达勒姆的AI销售支持平台 GTM Buddy 宣布已在 A 轮融资中筹集了 800 万美元,本轮融资由 Archerman Capital 和 Leo Capital 共同领投,Neon Fund 和 Stellaris Venture Partners 参投。

    GTM Buddy 成立于 2020 年,是一家致力于利用AI解决B2B销售转化挑战的,通过AI提供实时、针对性的指导,帮助销售代表提高成交效率和闭环更多交易。该公司的解决方案旨在优化销售过程,减少销售漏斗中的“泄漏”,并利用人工智能技术提升销售团队的整体表现。GTM Buddy的服务已被Lean Data、Kandji、Sayari Analytics、Bizzabo、Lob 等多家企业采用,以推动收入增长。

    (消息来源:VentureBeat