中關村創(chuàng)業(yè)大街,這個曾見證互聯(lián)網(wǎng)創(chuàng)業(yè)熱潮的著名地標,也曾陷入冷寂。
而今,”智能+“已經(jīng)成為時代新命題,這條大街又因AI有了新的活力。
去年12月底,百度大腦在中關村創(chuàng)業(yè)大街開設第一家“線下體驗店“,引來人頭攢動。3月20日,首期百度大腦開放日在中關村創(chuàng)業(yè)大街舉辦,更多了一份熱鬧。
過去,在創(chuàng)業(yè)大街上生長起來的很多互聯(lián)網(wǎng)產(chǎn)品與技術已經(jīng)與我們的生活難以分割,如今AI到來,又會是一種什么景象?
在百度大腦開放日上,百度大腦帶來了24種全新開放的AI技術,20個鮮活的落地案例,用滿滿的誠意與開發(fā)者一起展開對未來的想象。
用AI的熱度 去溫暖每個角落
整場開放日,最令人印象深刻的案例是“智能貓窩”,看到冬天里無家可歸的流浪貓,百度大腦工程師晚兮利用百度大腦的動物識別技術和百度EasyDL,打造出了配備“貓臉門禁”、“病貓識別”、“絕育識別”三大黑科技的貓窩,不僅可以識別174種不同品種的貓咪,還可以識別貓口炎、貓鼻支、貓皮膚病、貓外傷4種常見貓病,發(fā)現(xiàn)未絕育的貓,幫助志愿者及時救助。
和流浪貓一樣,垃圾分類也是一大社會難題。分形科技借助百度EasyDL的圖像分類技術,打造了首款智能垃圾桶,可以對7種常見垃圾自動分類;
德邦物流為了讓用戶免去自行填寫信息的麻煩,使用百度大腦的定制詞法分析快遞申請,一秒拆分姓名、電話、住址等信息;
看到審批窗口總是排滿長隊,科鴻智信利用OCR 、iOCR及EasyDL平臺開發(fā)了智能化審批管理系統(tǒng),建立起“一次都不跑、隨時隨地辦”的便民服務新模式。
嫌棄鼠標的功能太雞肋,有開發(fā)者集成百度的語音識別和合成技術、翻譯技術 ,打造了智能語音鼠標,語音輸入速度可以達到每分鐘400字,比傳統(tǒng)鍵盤輸入提升了兩倍,并且支持28種語言的翻譯;
還有開發(fā)者為了方便控制跑步機,使用百度大腦的語音識別和UNIT技術,開發(fā)了可語音控制的跑步機,動動嘴就可以切歌、速度控制、模式變換等,據(jù)說月銷量已經(jīng)高達一萬臺以上。
以上這些在開放日展出的案例,只是百度大腦落地案例冰山一角。2018年百度大腦在6個城市舉辦了7場行業(yè)創(chuàng)新論壇,針對企業(yè)服務、信息服務、地產(chǎn)物業(yè)、智能零售、智能工廠、智能校園、智能政務推出了7大行業(yè)解決方案,AI能力已然滲透進產(chǎn)業(yè)的毛細血管,從而影響我們生活的方方面面。
正如百度AI技術生態(tài)部總經(jīng)理喻友平在現(xiàn)場所說,“人工智能應用的領域可以說無處不在,只要企業(yè)、開發(fā)者、合作伙伴們能有發(fā)現(xiàn)問題的眼睛,就有創(chuàng)新創(chuàng)業(yè)的機會。百度大腦把平臺和AI能力開放出來,希望幫助大家快速地實現(xiàn)各自領域的業(yè)務解決方案,創(chuàng)造全新商業(yè)模式,帶來更多機遇。”
研發(fā)不是炫技 是對技術賦能的踐行
作為百度在人工智能領域多年研究的集大成,百度大腦在2016年正式開放后,已經(jīng)開放了語音技術、視覺技術、自然語言處理、知識圖譜、機器學習等近160項通用AI能力,有著超過100萬的開發(fā)者,已然成為服務規(guī)模最大的AI開放平臺。
對于百度大腦而言,技術的創(chuàng)新并沒有盡頭,就像是一場“打怪升級”的游戲,一直追求的是怎么讓技術更好用,怎么將效率再提高一些,最終實現(xiàn)“用AI讓復雜的世界更簡單”。
在百度大腦開放日當天,百度AI技術生態(tài)部總經(jīng)理喻友平一口氣介紹了新開放的24項AI技術能力,囊括視覺、自然語言和語音。以往開發(fā)者要苦苦研發(fā)上月的技術,在百度大腦都可以一鍵獲取。開放一個全新的AI技術,開發(fā)者就可能創(chuàng)造出一個全新的AI應用,實實在在改變生活。
在視覺方向上,OCR、車輛分析、人臉識別、圖像識別都有數(shù)項更新。百度的OCR全系列產(chǎn)品多達34種,覆蓋了卡證、票據(jù)、文檔、汽車等場景。
如果你是一名戶籍系統(tǒng)相關的開發(fā)者,只需要對著戶口本拍一張照片,系統(tǒng)就能字段進行結構化識別,然后反饋出信息頁的出生地、出生日期、姓名、民族、與戶主關系、性別、身份證號碼,將會幫助相關工作人員減輕大半的工作量。目前,百度在OCR上的能力最為全面,對于開發(fā)者來說,在同一家平臺上就能找到應用場景的對應技術,十分便捷。
如果你是一位交警或者停車場管理員,一定會對百度大腦的車輛分析技術點贊。百度大腦推出了車輛檢測、車流統(tǒng)計、車輛屬性分析、外觀損傷識別等服務。其中車輛檢測功能,可以通過識別圖像中的所有機動車輛(包含小汽車、卡車、巴士、摩托車、三輪車),反饋每輛車的類型和坐標位置,并對每類車輛分別計數(shù)。
如果你是一名自拍愛好者,百度大腦顯然知道你想要的是什么。百度大腦新增了人臉情緒識別,并升級了人臉關鍵點檢測和手勢識別,人臉檢測關鍵點由72個增至150個,常見手勢能識別也達到了24種。這些技術落地之后,人臉識別不再局限在解鎖和美顏,將帶來更多有趣的應用:錄制短視頻時有更豐富的手勢特效,識別你的情緒自動匹配背景音樂等等。
語音和語義識別也是百度大腦升級的重點,包括語言處理應用平臺、語言處理應用技術、語言處理基礎技術、知識理解以及知識圖譜。
在百度大腦開放日上,令人印象深刻的演示是三個有趣的應用:
一是新聞摘要,對新聞內(nèi)容進行全面的語義理解與分析,然后自動抽取新聞文本中的關鍵信息并按指定長度生成摘要,可以應用于熱點新聞聚合、新聞推薦、語音播報、彈窗推送等場景,幾乎是所有新聞工作者的福音。
二是智能寫詩,用戶只需要輸入任意主題詞(如公司名、節(jié)氣名),百度大腦便可自動生成融合了該主題詞的詩詞。實際測試顯示,百度大腦的智能寫詩在語義和語境上并沒有明顯的違和感,不失為娛樂化營銷的又一重要工具。
三是智能春聯(lián),今年的央視春晚上,主持人高博就演示了智能春聯(lián)“看臉”的絕活兒,通過“刷臉”生成專屬春聯(lián)。如今這項技能也被百度開放出來,何嘗不是人工智能融入美好生活的一個典型案例呢。
在語音方面,百度首次對外開放了搭載國際領先的注意力(attention)模型的語音能力,擁有更快的響應速度,相對識別準確度提升15%。同時中英文混雜和純英文自由說,既能識別方言又能識別普通話,那些曾經(jīng)讓用戶和開發(fā)者頭疼的問題,在這里被一次性解決。
不止如此,百度還即將上線很多新產(chǎn)品:零代碼自助訓練語音識別模型,可以幫助開發(fā)者提升業(yè)務場景下的識別準確率;而遠場語音開發(fā)套件,則可以應用于機器人、兒童故事機、家電、車載設備等硬件,語音識別將無處不在。
在喻友平看來,百度大腦的開放生態(tài)有著以下優(yōu)勢:一個是技術領先,百度很早就成立了深度學習研究院,并且早在16年開源了國內(nèi)第一個深度學習框架paddlepaddle,在各類國際比賽上也取得過非常多的獎項,并且聯(lián)合舉辦了像上面介紹的國際權威競賽,在這樣的技術號召力下,聚集了非常多的人才,這是技術得以持續(xù)保持領先的基礎;
一個是技術布局非常全面,從感知到認知,從語音到視覺到語義到AR等等,非常全面,可以幫助大家一站式的獲得服務,提高集成效率;最后,我們以可落地為目標,在降低人工智能應用門檻的這個方向上持續(xù)不斷的努力,所以雖然只開放了兩年多的時間,但進化速度也非常快。
“我們可以看到整個平臺的架構,從模型到軟硬一體,從深度學習框架到解決方案,從云服務到多種輸出方式的支持,各個層面都快速豐富起來。我們也非常重視各個企業(yè)和開發(fā)者提出的需求,并且特別感謝在這個進化過程中大家的包容與支持。”
藝術家們喜歡讓人們從作品中了解自己,如同在蒙娜麗莎中思考達芬奇,在第九交響曲中聽懂貝多芬。
百度大腦似乎有著同樣的情愫:用開放生態(tài),為開發(fā)者提供發(fā)揮想象力的“黑土地”,讓AI走向社會的每一個角落。
喻友平談到,人工智能應用的領域可以說無處不在,只要企業(yè)、開發(fā)者、合作伙伴們能有發(fā)現(xiàn)問題的眼睛,就有創(chuàng)新創(chuàng)業(yè)的機會。百度大腦把平臺和AI能力開放出來,希望幫助大家快速地實現(xiàn)各自領域的業(yè)務解決方案,創(chuàng)造全新商業(yè)模式,帶來更多機遇。
申請創(chuàng)業(yè)報道,分享創(chuàng)業(yè)好點子。點擊此處,共同探討創(chuàng)業(yè)新機遇!
2025年10月25日,2025世界青年科學家峰會之人工智能(AI)融合創(chuàng)新發(fā)展論壇在浙江溫州成功舉辦。本次論壇由國際院士科創(chuàng)中心主辦,中國投資協(xié)會能源投資專業(yè)委員會、溫港院士科創(chuàng)中心承辦,中國電工技術學會、中科先進技術溫州研究院與溫州市電力工程學會提供支持,以“甌江論道-AI賦能綠色發(fā)展”為主題,
個人創(chuàng)業(yè)需要啟動成本低、無需龐大團隊、可快速驗證、能利用個人技能或資源。這里分享適合個人創(chuàng)業(yè)的十個機會一.AI內(nèi)容優(yōu)化與本地化服務·做什么:幫助企業(yè)或個人利用AI工具(如GPT-4,Midjourney)優(yōu)化內(nèi)容生產(chǎn)流程。例如,為跨境電商撰寫多語言產(chǎn)品描述,為小紅書博主生成爆款文案,為小公司制作營銷
百度AI團隊今日正式推出PaddleOCR3.1版本,以突破性的多語言組合識別(MultilingualCompositionPerception,MCP)技術為核心,徹底重構復雜文檔處理邊界。此次升級標志著OCR領域首次實現(xiàn)對同一文檔內(nèi)任意混合語言文本的精準識別,為全球化企業(yè)、跨境業(yè)務及多元文化場
導航網(wǎng)站的崛起:從信息過載到精準觸達隨著全球AI工具數(shù)量爆發(fā)式增長(2025年已超數(shù)萬款),用戶面臨前所未有的選擇困境。傳統(tǒng)搜索引擎的“關鍵詞-鏈接”模式難以應對工具篩選的場景需求,垂直化、場景化的AI導航網(wǎng)站應運而生。這類平臺通過聚合、評測、分類與推薦四重機制,將分散的工具資源整合為結構化入口。例
當微信公眾號文章中出現(xiàn)一個人的名字,它會自動變成藍色鏈接,點擊即可查看AI生成的“個人簡歷”——這一微信新功能讓不少用戶感到被“扒光”在互聯(lián)網(wǎng)上。近日,微信新上線的“AI搜索”功能陷入隱私泄露爭議漩渦。多位網(wǎng)友在社交平臺反映,當微信公眾號推文中出現(xiàn)本人姓名時,名字會自動變?yōu)樗{色超鏈接,點擊即可瀏覽由
4月2日,字節(jié)跳動旗下火山引擎在武漢舉行的AI創(chuàng)新巡展上宣布,Seedance2.0API正式面向企業(yè)用戶開啟公測。同時,火山引擎總裁譚待在會上披露,截至今年3月,豆包大模型日均Token使用量已突破120萬億,在過去三個月內(nèi)增長一倍,比2024年5月發(fā)布時增長1000倍。Seedance2.0:從
養(yǎng)AI小龍蝦的路上,坑不少。有人被代裝服務騙了錢,有人電腦中了毒,有人收到天價賬單,還有人發(fā)現(xiàn)AI“失控”了,開始亂刪文件。如果你也遇到這些糟心事,別慌。下面這份“養(yǎng)蝦應急包”,告訴你第一時間該做什么。場景一:代裝被騙,錢打水漂了花了300塊找人遠程裝OpenClaw,結果對方收了錢就拉黑,或者裝了
把AI智能體請進電腦,就像把家里所有的鑰匙交給了一個陌生人。它能幫你打掃房間、整理文件,但萬一它“起了壞心”,或者被壞人利用了,你的家就不再安全了。這不是危言聳聽。國家互聯(lián)網(wǎng)應急中心已經(jīng)發(fā)布風險提示,指出OpenClaw的默認配置“極為脆弱”,攻擊者一旦得手,能輕易獲取系統(tǒng)控制權。微軟安全團隊也警告
OpenClaw火了,火到似乎人人都在討論“養(yǎng)蝦”。打開社交媒體,滿屏都是“有了AI小龍蝦,我再也不用加班了”“我讓AI幫我訂了機票、寫周報、點外賣”之類的分享。于是,很多人開始焦慮:別人都養(yǎng)了,我要不要也養(yǎng)一只?不養(yǎng)是不是就落伍了?先別急。在決定養(yǎng)“蝦”之前,我們先冷靜下來,想清楚一個問題:你到底
3月31日,科技圈上演了一場現(xiàn)實版的“代碼大逃殺”。一向以“閉源”為傲的AI巨頭Anthropic,因一個低級打包失誤,將旗下明星產(chǎn)品ClaudeCode的完整源代碼拱手送給了全世界。一次59.8MB的“裸奔”事情始于一個普通的周二早晨。Web3安全公司FuzzLab的實習研究員ChaofanSho
當?shù)貢r間3月31日,人工智能明星公司OpenAI宣布完成一輪規(guī)模達1220億美元的私募融資,投后估值攀升至8520億美元,創(chuàng)下全球AI企業(yè)估值新紀錄,同時也刷新了科技行業(yè)私募融資的歷史最高規(guī)模。本輪融資籌備歷時數(shù)月,核心資金來自三家頭部科技企業(yè):亞馬遜承諾投資500億美元,英偉達與軟銀集團分別出資3
“我也想養(yǎng)一只AI小龍蝦,但聽說安裝特別難,我連代碼都不會寫,怎么辦?”這是最近后臺收到最多的私信。面對OpenClaw這個技術門檻不低的AI智能體,很多普通人躍躍欲試,卻又望而卻步。于是,一個“代裝”產(chǎn)業(yè)應運而生——遠程50到300元,上門500到1500元,幫你搞定一切。但問題是:這些代裝服務靠
最近,身邊不少人都在討論“養(yǎng)AI小龍蝦”。這只叫OpenClaw的智能體,能替你自動訂機票、寫代碼、整理文件,聽起來像請了一個24小時不休息的數(shù)字員工。但問題來了——月薪五千的普通人,養(yǎng)得起嗎?我們先算一筆賬。養(yǎng)這只“蝦”,主要有三個花錢的地方。第一筆:硬件投入。OpenClaw創(chuàng)始人推薦用MacM
最近,“養(yǎng)AI小龍蝦”成了互聯(lián)網(wǎng)上的一股熱潮。這里的“小龍蝦”指的是OpenClaw——一個能替你自動做事的人工智能體。訂機票、寫代碼、整理文件,它就像一個24小時不休息的數(shù)字員工。聽起來很酷,但很多人忽略了一個關鍵問題:這只“蝦”需要你電腦的完整訪問權限。也就是說,一旦你把它“請”進家門,它就能看
最近,互聯(lián)網(wǎng)上刮起了一股“養(yǎng)蝦熱”。這個“蝦”不是餐桌上的小龍蝦,而是一個叫OpenClaw的AI智能體。標志是一只紅色小龍蝦,寓意不斷蛻殼成長。OpenClaw到底是個什么東西?簡單說,它是一個開源的AI智能體框架,能裝進你的電腦,替你自動做事——訂機票、寫代碼、整理文件,就像一個24小時不休息的