Visar inlägg med etikett Microsoft Bing. Visa alla inlägg
Visar inlägg med etikett Microsoft Bing. Visa alla inlägg

Bing! i Kina: Att approximera effekt med antal länkar

2014-02-17

Värt att reflektera för:



Är att Microsoft förklaring kanske är korrekt. Bing! för webbsökning var sist jag betraktande den för vissa typ-mängder av länkar till resurser tämligen känslig för antal d.v.s. att effekt samlad för ett antal länkar är benäget att komma närmare än tänkt konvergens endast påverkad av antalet länkar.


Rörande mängd jag noterade (och om jag minns rätt även för bildsökningen) tittande på ett antal sökord (utan att själv sökt påverka sökresultaten) var bl.a. en faktor identifierande detta DNS-namn och liggande känt indexerad av Bing! (vilket tryggast sker när länk vid denna tid i alla fall var mer eller mindre på startsida när det gällde små-sajter och/eller relativt nya: men p.s.s. också möjligt styrande också på stora sajter varierat utifrån också andra faktorer).


Praktiskt innebärande att man mycket väl om viss budget för att etablera sajter med dessa tillsammans med andra faktorer kan styra resultaten enklare än man kanske är van vid från andra sökmotorer.


Samtidigt ska tydligt understrykas att jag inte vet om det går att definiera idag samma "enkla" (för en entitet relativt low-competence men med ett antal - relativt få faktiskt - datorer resp. görlighet sätta upp DNS-namn samt applicera övriga ej refererade faktorer) mängd effekt-länkar. Vidare också att jag aldrig värderat Bing! vad jag minns rörande Kina och ej heller här. Men det är kanske värt att se möjligheten att en förklaring oavsett hur man definierar defekt kan vara relativt enkel påverkan utifrån snarare än Microsoft är moraliskt vekt relativt vinst alternativt är korrupt via agerande hos enskilda utanför riktlinjer eller att företag alt. enskilda av varierade orsaker är rädda för den kinesiska diktaturen och därmed lätt kan styras.


Vidare mer än att se möjligheten till påverkan här är den möjlig allmänt för många andra lösningar på nätet. Och särskilt att observera när styrande faktorer är onormalt effektiva för en aktör likt kommunistpartiet i Kina kontrollerande en stat men utanför sådana aktörer är svåra och/eller ekonomiskt ineffektiva för andra aktörer (särskilt SEO-branschen som ju ibland kan filtrera upp kvalitet på inverkande faktörer genom att benäget utnyttja dem). Jag upplevde för ett antal år sedan detta som ev. fallet rörande en del sökresultat på om jag kommer ihåg rätt. Det balanserade sig emellertid inte allt för långt efter varefter jag ej minns att jag där noterat fler problem (men har heller inte kontrollerat detta på ett antal år). Tänkbart är dock Google fortfarande ganska observant här. Minns jag rätt finns det diskuterat här långt tillbaka.


Man bör kanske se dessa frågor industriellt i kontext av samarbete mellan stora aktörer som en grundstruktur och från det söka inkludera fler.


Att generellt samarbeta diktatur rörande dessa frågor är på samma sätt som att leverera sådant som hård- eller mjukvara övervakning nätet eller något relaterat sådana frågor eller leverera tjänster eller kompetens ex. marketing ytterst olämpligt och vad jag hoppas att man för att minska risken för liknande problem understrykande möjlighet är aktörer man generellt ska juridiskt hindra från att alls leverera i eller relaterat företag agerande Kina när transformationen till demokrati är klar.

Microsoft: EU-oförsiktiga eller "uttryckande" vad "särskilda "mining-källor" uttrycker?

2014-02-07

En komplicerad titel ändå kanske bra då jag verkligen vet föga om hur Microsoft samplar webben. Rörande Tänkbart är Microsoft Bing! på väg att bli stark tyckte jag nog resultaten på efterföljande sidor var ungefär jämförbara som förväntat.


Men med väldigt mycket Microsoft sidor. Varför skulle Microsoft fylla på med så mycket egna sidor?


Kanske sunt resultat av algoritm. Kanske önskan att marknadsföra egna koncept.


Eller så mer spekulativt är det resultatet av hur enskilda samplingskällor via mer vitt-förgrenande mätningsnoder många av oss säkert i bloggar och diverse medier länge tillbaka kunde läsa möjligen existerade. Dock gissar jag inte brutalt stora reducerande sökrymd relaterat Microsoft produkter för core-källan där.


Eller kanske över-värdering relaterat något runt domäner och hur hur eget länkar. Jämför ex. Microsoft Academic Search som diskuterades kort i Tänkbart är Microsoft Bing! på väg att bli stark.


Hans gives safe-search advice:
  1. Search with easy concept you have enough experience to handle. I.e. name of news paper, Wikipedia.
  2. If more advanced searching it is both easier and safe for yourself and your family to pay experienced professional to search for you (i.e. mobile phone cheap, gaussian information discriminant, fisher information, buy new home).
Protect your family!

Accident including children that happend among our "search Google and Bing for me" customers:

"After bing searching för hours the male took the brwoser to surf out for more already heavely reduced in uncertainty. Later the night the wifte and one of the childrens (the older not sleeping) was very bored due to a science bias in the search result."

The next morning they decided to leave all the web searching to trained people that could take and filter away boring or non-cultural-correct fun material. The wifte later told me it saved marriage.

If it takes a weak to do expert quality: You still pay the same!

And no matter the time needed to find a good page choosen for your need, personality and idea the cost is based on the search word you provides-

I.e. Gustav Wasa $9 US or fisher information $90 US.
Lets do job creation together!

And currently to support work creations in the telecom industri everything including buy and mobile phone are free!).

The gold search experience requires perfection in service culture

Or for exclusive customers you can choose a solid California tech-nerd or the "famous" IT-ganja programmer - or why not someone engaged in providing Africa with internet refering to it delivering yor web-page url at your door. Another comes by with a true WLAN-car and make a video clip of you while recording your local home network.

Recommended by...

Logo search company A, Logo search company B and Soft drink company C if you haven't heard of A and B.

As well some small not to grand government agency say related event-information regarding forrest fire. And Justin B as part of his socio-medical program to get back on track. And oil-company E cause we aren't to good for anyone no matter the beaches. And we donate to Greenpeace of course by searching for oil-spil with Bing News for them one day each month.

- If we all need a phone we search free done by a trained expert and delivered by a real California tech-nerd! with glasses, a bit fat and pencils sticking out of his shirt.


I mycket jag läst publicerat av Microsoft folk om algoritmer m.m. i och runt om information retrieval (vad sökmotor kallar det dom gör innan länk-SEO-påbörjas, annonsförsäljning runt sökresultat är möjligt och det går att sök rätt på saker [Red. Här var jag komiskt och inget där ska tolkas som jag tycker att det är bra att köpa annonser - en bra produkt säljer sig själv - och samma test gäller så klart SEO, och när det gäller sökning ä sökmotorn jag vill se vad som gör sökningen åt dig snarare än här som i allt runt datorer ska det inbegripas att jag gör egentligen det mest från diverse bugg-utskrifter, sökresultat, dokument, artiklar m.m. datorn visar.]) är ganska engagerade i länkar inte långt ifrån Google "classic" (och ev. inte en dålig grund-del att göra väl innan andra källor adderas).


Tänk här att värdet Microsoft Academic Search adderar delvis passerar mindre Microsoft-internal legacy och mer genom att passera trust eller annan vikt via sina länkar. Fel-länkande - egentligen kanske inte fel i sig - kanske naturligt orsakar problem givet att Microsoft medarbetare antar jag publicerar en del som även det får komma med i.


Betänk att Bing! är ung. Och ingenting publicerat därifrån indikerar just att man tänker mer utanför inarbetade äldre algoritmer rörande hur språkmodeller etableras o.s.v. Därmed är de tidigt i den etablerade problematiken att de baserar språkmodeller och övriga statistiska mått för ranking från samma data som ska rankas vilket ju är uppblandat med en försvarlig mängd spam. För Google med flera som kanske gjorde likartat tidigt etablerades lättare en utgångspunkt för statistik för hur en sund webb bör se ut görande detektion av spam lättare. Istället krävs mer av att tillämpa jobbigare metoder för detektion d.v.s. mer av att flgga människa för att bygga träningsexempel i tveksamma rymder, utgå från spam i sig i större andel och riskerande överträning, samtidigt som avsaknad av dessa mönster, manipulerande innehåll, konkret spam m.m. inte är indikation om värde för läsaren lika lite som något av tidigare alltid självklart inte är det. Att ta den vägen är enkelt och smidigt när webben är enkel med föga av ytterst kommpetenta (såväl som fullständigt okunniga) aktörer som lever på att styra trafik snabbt via throw-away sidor resp. bygga långsiktiga mönster.


En väg att försöka hantera det av och till föreslagen är att försöka indikera betrodda entiteter som får donera ut trust. Med mindre än att man mer eller mindre kontrollerar dem själv eller de ligger mer på nivå av Wikipedia än ex. gamla trotjänaren DMOZ där försvarliga delar utan just feedback eller hanterande kollektivt kontrolleras smidigare mer eleganta SEO-aktörer sedan mer än tio år i något fall (eller säg åtta om jag räknar fel på när vi chattade lite runt det där för några år sedan). Microsoft Academic Search är ett exempel på en långsiktig lösning, delvis självförvaltande via författarna själva, användbar i sig själv och passande in i Bing! konceptet övergripande för att introducera detta. Även om alternativ finns i denna domän särskilt kommer det här också med ett bonus-värde runt att korrekt identifiera personerna för artiklarna smidigt (och en del relaterat det samma inkl. mer förvånande år för publicering eftersom nu inte allt har eleganta abstract sidor som via självklar gemensam punkt kan bindas till artiklar spindlarna ex. på universiteten).


Eller så är det någon lokal konkurrent till Microsoft här som försöker motivera upp EU med strategisk "förädling" av vad som kommer ut Microsoft och når oss.


Den sista känns tveksam. I övrigt har jag ingen preferens egentligen. En mängd andra förklaringar kan finnas också. Ex. produkt A bunddlar Bing och Bing visar upp A och båda får lite bättre möjlighet till nykundsbonus av deras gemensamma arbetsgivare. Också en aning tveksamt. Rent personligen fick jag förövrigt ut en del Bing värde för ett till två år sedan och det är därför trevligt att se att den kanske kan komma att bli en kompletterande sökfunktion dagligen.

Microsoft Bing! Quality assurance problem och helt avstannad utveckling framåt förutom hantering spam

2013-08-21

Följande upp det nya Bo-konceptet Sunny Vitahuset publicerat på Twitter, Youtube, blogg m.m. tittade jag hur det märktes på Bing!.


Nyfiken på om de anti-spam-lösningar och indexeringslösningar vågar och/eller orkar ta upp så snabba volym och rekommendations-indikationer visade sig inte Obamas nyköpta hundvalp alls. Däremot i video-sökningen fanns en försvarlig andel pornografi (jag tror inte det är relevant sökresultat för Sunny oavsett filtreringsnivå: porgrafi-konsumenten har ofta gissar jag inget problem med att addera tydliga cue words t.ex. kvinna gör något i informations-domän pornografi.


www.bing.com/videos/search?q=sunny&qpvt=sunny&FORM=VDRE

Fortfarande vad jag från tumbnails gissar är pornografi också med strikt-filter.


Exakt vad problemet så återkommande lite varstans egentligen ligger har jag funderat över genom åren. Ett möjligt svar jag reflekterade över nyligen efter att ha träffat på deras EntityCube och läst vad de publicerat om den är:


  • Vi betraktar idéerna runt kuben man diskuterar i artiklarna.
  • Varje algoritm eller kocnept är by the book.
  • Väölända stabila algoritmer.
  • Ett tämligen pedantiskt noggrant helhetstänk.

När jag tänker på det tycker jag mig minnas något publicerat av Microsoft relaterat något NIST projekt där de om jag minns rätt använt Concept net <(MIT) till något. Samma sak by the book.


Menoavsett hur stabila och goda algoritmer det är - kanske rent av som cosinus similarity - med i de flesta referensböcker räcker det inte i sådana här sammanhang. De kan vara funktionella detaljer också om de normalt även i sådana avgränsningar behöver ses som utgångspunkt att ta upp oavsett om det är något teoretiskt nyare, mer avancerat, mer kostnadskrävande i CPU o.s.v. adderande innovation eller om det snarare handlar om föga avancera, kanske inte alls eleganta, rent av tämligen smutsiga extra filter lösningar för att skjuta ner "underligt" innehåll vi kanske trivialt kan ta det mesta av med bara ord-mönster indexering men som vår statistiska nät förvirras av.


Det är lite som de sär koncepten som komponenter och försöker bygga med lite som Visual Basic men givetvis ändå praktiskt helt annorlunda. Och visst det är klart det går bra med egentligen vilken referensbok som helst i domänen statistisk language processing och hyggligt indata men då får ju inte top-end.


Samma sak med ata. Oerhört vackert och elegant tänk att se kompletterande värden Twitter, webb m.m. Men lite samma sak där verkar man tänka först och hela vägen parallella datakällor man ser lite p.s.s. Det rekommenderas och förklarar indirekt eller direkt vad man avsåg. Men lämnar man standardalgoritmer och standard-datakällor som primära utgångspunkten måste man ju i verkligen om man ska nå längre än vad du får med ett par referensböcker, stora resurser och väldigt nogranna och potenta systemutvecklare (för det är fortfarande ett förbannat svårt område): med en idé vad folk egentligen gör, tänker och agerar när de "rekommenderar" i resp. kanal.


Det skiljer sig radikalt mellan olika publiceringskanaler. Och radikalt beroende av vilken roll också grovt pbulicist har. En marketing inriktad pornograf gör ju en helt annan sak än en gammal tänkt som gör retweets på sina barn-barns- låg-kvalitativa teckningar de fotograferat och ingen människa egentligen vill se hgre i sina sökresultat därför.


Refererar vi en just en referensresurs i ett Tweet som ej är en summering av något mer genomarbetat gäller ju givetvis att mindre tid i genomsnitt investerats i att välja den d.v.s. har mindre quality assurance och större bias Wikipedia m.m.


Utan det tror jag inte för ett ögonblick att någon stabilt får ut rankningsvärde av Facebook eller Twitter adderande kvalitetsdimensioner till andra rankningsfaktorer. Det kan verka fungera men regelmässigt falerar det no doubt utan mer och skämmer ut en stor brand värde-påverkande billboard produkt som Bing!.


Man börjar med människan: Vad vi gör när vi publicerar eller rekommenderar. Vad vi gör när vi letar information. Och tar eller skapar de algoritmer och modeller vi behöver närmare sökmotorn från det.


Rörande just spam på webbsökningen gäller att de numera har mindre problem upplever jag med uppenbart inte vad jag söker efter alls (jämför problemet ovan för video-sökningen). Men i övrigt upplever jag inte att sökresultaten någonsin på år nu blivit kvalitativt bättre i övrigt. Relativt upplevelse av domänen i övrigt står de still.


Om förklaringen stämmer med verkligheten bakom det kan jag ine säkert veta. Och även om så är det ganska underligt. Ev. någon management strategi med områdes-smal rekrytering. Deras visuella ide med bilder på startsidan gillar jag dock liksom en del andra sådana komponenter. Men oavsett elegans tror jag inte att det är dom långsiktiga barriärer Microsoft borde ha byggt redan här för att vara något värdeskapande för ägarna över åren som kommer (om det någonsin varit det).


Microsoft köp av Yahoos! sökmotor var kanske sunt i någon revenue-dimension men jag tror inte att det just adderade något av vad Microsoft kanske behöver nära själva algoritmerna och modellerna. Det är kanske oftare mindre företag mer teknik-inriktade på något nytt. Men även där behöver man ju bäst tror jag en övergripande modell för att kunna resonera om var man kan få värde av sådana köp.


Omvänt kan man ju fundera vad egentligen en fet computer-grid med mycket av rå-statistik är värt för dig när din tid är knapp. Ganska mycket av och till. Från det perspektivet är Bing! mycket attraktiv och fanns möjlighet hade jag gärna köpt det för att få det klart i en stabil-struktur och rullat över annat via bit för bit mellan-lager framför det förvandlande det till en grovare datakälla. Själv i den domänen är jag i deen svårlösligt lite jobbiga riktningarna mellan hash-tabeller i Perl för visst data tagande för lång tid i den dagliga uppdateringen relativt minsta antal nyheter - tappar kontinuerligt ungefär relativt världes tid 2 - 3 timmar dagligen för att boota upp och Perl är riktigt snabb runt dom här operationerna så jag har inte ens prövat en c-portningen - jag initialt för versionen vill indexera dagligen eller välja databaslösningar vilka för Mysql och postgres på min utveclingdata inte hinner med i närheten av ens samma dag att ta in samma mängd nyheter.


Jag vill ha hela Bing! grid:en med allt data.


Men det börjar väl bli dags att surfa in på DELL och se vad prisvärt men snabbt kring sådant här man kan hitta. Helst vill jag ha något med fullständigt brutalt med hyggligt snabbt ram läggande sig som mellan-lager eller nästan helt istället för hårddiskar. Men förra gången jag handlade verkade indexering av minnet vara brutalt begränsat under vad jag ungefär ville ha. D.v.s. cluster krävs ganska tidigt.