Stable Diffusion
Stable Diffusion是2022年發布的深度學習文本到图像生成模型。它主要用於根據文本的描述產生詳細圖像,儘管它也可以應用於其他任務,如內補繪製、外補繪製,以及在提示詞指導下產生圖生圖的转变。 它是一種擴散模型,由慕尼黑大學的CompVis研究團體開發的各種生成性人工神經網絡之一。 截至2022年10月,StabilityAI籌集了1.01億美元的資金。 Stable Diffusion的源代碼和模型權重已分别公開發布在Git…
共 18 篇文章
Stable Diffusion是2022年發布的深度學習文本到图像生成模型。它主要用於根據文本的描述產生詳細圖像,儘管它也可以應用於其他任務,如內補繪製、外補繪製,以及在提示詞指導下產生圖生圖的转变。 它是一種擴散模型,由慕尼黑大學的CompVis研究團體開發的各種生成性人工神經網絡之一。 截至2022年10月,StabilityAI籌集了1.01億美元的資金。 Stable Diffusion的源代碼和模型權重已分别公開發布在Git…
{{Infobox software | title = TAIDE | logo = Logo.TAIDE.png | logo_size = | logo caption = | screenshot = | screenshot_size = | caption = | developer = 中華民國國家科學及技術委員會 | released = ),是由中華民國國科會主導的生成式AI計畫,於2023年6月14日首次推出模型。 …
OpenClaw是一个开源的自主人工智能(AI)虛擬助理软件项目,因其图标是一只红色龙虾又被称作“龙虾”。OpenClaw由奥地利软件工程师彼得·斯坦伯格开发,最初于2025年末以Clawdbot的名字在GitHub上发布,后更名为Moltbot,最终定为现名。 2026年初,该AI项目因能够根据用户指令,在应用程序和在线服务中自主处理复杂任务而受到广泛关注。 功能 OpenClaw被设计为可代替用户执行任务的自主人工智能虛擬助理软件,…
Mistral AI是一家成立于2023年4月的法国科技公司,开发使用大型语言模型技术的生成式人工智能。 公司名稱 公司以密史脱拉风 ( )命名,密史脱拉风是法國南部一種強勁的寒風。 历史 Mistral AI 由Arthur Mensch、Guillaume Lample 和 Timothée Lacroix于 2023 年 4 月共同创立,他們都是Google DeepMind和Meta Platforms的前员工, 三人最初是在综…
LLaMA()是Meta於2023年2月發布的大型语言模型。它訓練了各種模型,這些模型的參數從70億到650億不等。LLaMA的開發人員報告說,LLaMA運行的130億參數模型在大多數NLP基準測試中的性能超過了更大的、具有1750億參數的GPT-3提供的模型,且LLaMA的模型可以與PaLM和Chinchilla等最先進的模型競爭 Code Llama 2023年8月,Meta继发布用于生成文本、翻译语言和创建音频的人工智能模型之后,…
Grok是xAI基于大型语言模型开发的生成式人工智慧聊天機器人,類似於ChatGPT。 它能夠實時回答用戶的問題,並利用X社交媒體平台的數據進行回應。 背景 2015年,伊隆·马斯克与萨姆·阿尔特曼共同创立OpenAI。2018年,由於埃隆·马斯克不認可OpenAI团队,他決定離開OpenAI董事会。 OpenAI随后于2022年推出ChatGPT ,并于2023年3月推出GPT-4。 2023年4月,伊隆·马斯克在接受塔克·卡森今夜秀…
通义千问(海外版稱為Qwen)是由阿里巴巴集团旗下负责云端运算服务的科技公司阿里云所開發的大語言模型及聊天機器人,涵盖文本、视觉、音频、代码等多模态能力。 历史 2023年4月7日,阿里巴巴集团旗下的云端运算服务公司阿里云正式宣布通义千问对已受邀的企业用户开启内测,标志着阿里巴巴正式踏入大语言模型领域,其後逐步開放,现已对公众免费使用。 2023年4月11日,阿里巴巴董事局主席张勇在阿里云峰会上正式对外发布大语言模型工具「通义千问」,并…
GPT-J,又称GPT-J-6B,是由开放人工智能研究团体EleutherAI开发的大型语言模型。该模型于2021年公开发布,是一个基于Transformer架构的自回归文本生成模型,主要用于根据输入提示预测后续文本。名称中的“6B”表示模型约有60亿个可训练参数。GPT-J使用Ben Wang开发的Mesh Transformer JAX训练,权重以Apache License 2.0发布,是早期具有公开权重的GPT-3类大型语言模型…
JAX,由Google开发、並由Nvidia做出部分貢獻的Python机器学习框架,用於变换数值函数。JAX结合了修改版的Autograd自動微分系統,以及來自OpenXLA專案的編譯器,可加速數值線性運算。其設計目標是在介面與程式設計風格上盡可能與NumPy保持相容,使使用者能夠以熟悉的方式撰寫高效能運算程式。此外,JAX亦可與TensorFlow、PyTorch等機器學習框架整合使用。 主要功能 JAX的主要功能是。 Equinox…
IBM Granite是由IBM於2024年發展的一系列解碼器單元AI基础模型。 於2023年9月7日宣布,並在4天後發表了初步論文。最初該計劃用於IBM基於雲端運算数据和生成式人工智慧平台Watsonx,IBM開源一些語言模型的原始碼。 Granite模型從網際網路、學術出版物、代碼数据集、法律和金融文件等資料組合來訓練。 基礎模型 基礎模型是指在大規模且多元資料上進行訓練的人工智慧模型,因此能夠適用於各種下游任務。 Granite的…
Flux(亦稱FLUX.1)是由總部位於德國弗賴堡的黑森林實驗室()所開發的文字轉圖像模型。該公司由多位前Stability AI員工創辦。與其他同類型模型相同,Flux能夠根據自然語言輸入(即提示詞)生成圖像。 歷史 黑森林實驗室於2024年成立,創辦人為Stability AI前員工羅賓·隆巴赫(Robin Rombach)、安德烈亞斯·布拉特曼(Andreas Blattmann)和帕特里克·埃塞爾(Patrick Esser)。…
开源人工智能(),根据开放源代码促进会(OSI)的定义,是一种可以自由使用、研究、修改和共享的AI系统。这包括用于训练模型的数据集、源代码以及,旨在促进一种协作且透明的人工智能开发方式,使他人能够重现基本相似的结果。 关于何种程度的开放才应被视为“开源”的争论十分激烈。一些仅发布模型权重(而不公开训练数据和代码)的大型语言模型被批评为(openwashing),实际上是封闭系统。流行的开源人工智能项目类别包括大型语言模型、机器翻译工具和…
TensorFlow是一个开源软件库,用于各种感知和语言理解任务的机器学习。目前广泛地用于研究和生产中,比如Google商业产品,如语音辨識、Gmail、Google 相册和搜索 历史 DistBelief 从2010年开始,谷歌大脑建立DistBelief作为他们的第一代专有的机器学习系统。50多个团队在Google和其他Alphabet公司在商业产品部署了DistBelief的深度学习神经网络,包括Google搜索、Google语音…
PyTorch是一个开源的Python机器学习库,基于库,底层由C++实现,应用于人工智能领域,如计算机视觉和自然语言处理。它最初由Meta Platforms的人工智能研究团队开发,現在屬於Linux基金会的一部分。它是在修改後的BSD許可證下發布的自由及开放源代码软件。 儘管Python接口更加完善並且是開發的主要重點,但 PyTorch 也有C++接口。 許多深度學習軟體都是基於 PyTorch 構建的,包括特斯拉自动驾驶、Ube…
Deeplearning4j是为Java和Java虚拟机编写的开源深度学习库,是广泛支持各种深度学习算法的运算框架。Deeplearning4j可以实施的技术包括受限玻尔兹曼机、深度置信网络、深度自动编码器、堆叠式降噪自动编码器、循环神经张量网络,以及word2vec、doc2vec和GloVe。这些算法全部包括分布式并行版本,与Hadoop和Spark集成。Skymind是Deeplearning4j的商业支持机构。 简介 Deepl…
BigScience 大規模開放科學與多語言開放存取模型(BLOOM) 是一個基於Transformer模型的自回歸大型語言模型(LLM),具有1760億個參數。該模型與其程式碼基礎,以及訓練所用的數據,均以自由許可證形式發布。 BLOOM於2022年3月至7月間,使用約3660億(1.6TB)個語料進行訓練。 BLOOM是BigScience合作計畫的主要成果,該計畫是一個為期一年的研究工作坊,自2021年5月開始,至2022年5月結…
OpenCog是一項以打造開源人工智慧框架為目標的開發專案,OpenCog Framework是一種應用於廣泛AGI研究的通用框架,其中OpenCog Prime是一種用於機器人和虛擬體化認知的架構,該架構定義了一組互動元件,用來產生與人類對等,從整體系统湧現而來的通用人工智慧(AGI),本‧格策爾(Ben Goertzel)是其主要設計者。使用OpenCog進行的研究已發表在期刊上,也在包含年度人工智慧大會在內的各種會議和研討會上被介…
OpenNN(Open Neural Networks Library)是一個使用C++程式語言編寫的函式庫,實現了神經網絡,這是深度學習研究的主要領域之一。它是一个開源庫,遵循GNU宽通用公共许可证(LGPL)。 特点 該軟件實現了任意數量的非線性處理單元層,用於監督學習。這種深層架構允許設計具有通用逼近特性的神經網絡。此外,它通過OpenMP進行多處理編程,以提高计算性能。 OpenNN包含作为一组函数的机器学习算法。這些函數可以通…